GraphRAG与LIR3AG发布,AWS推S3 Vectors|RAG技术本周大事

源自21位全网作者

01-09 17:17

内容由AI生成

精选参考来源

1. [RAG] GraphRAG

2. token立省90%,让8B模型也能"深思熟虑"的RAG新框架LIR3AG来啦

3. AWS S3 Vectors vs 向量数据库:降90%成本,谁主沉浮?

4. 不装了!不能帮GPU分担向量数据库的CPU不是好至强

5. [RAG] LightRAG

6. RAG系统评估指标入门 检索增强生成(RAG)通过整合外部知识库解决大语言模型的知识过时与幻觉问题,但评估其性能面临多维挑战:检索质量、上下文利用能力及答案本身质量。业界已确立三大核心评估维度:上下文相关性(检索内容是否精准聚焦)、答案忠实度(生成内容是否严格基于上下文)和答案相关性(输出是否直接回应用户问题)。为突破人工评估瓶颈,Ragas与ARES代表了自动化评估框架的两代演进。 Ragas:无参考评估的开创者 Ragas的核心创新是无参考评估,摆脱对黄金标准答案的依赖,通过LLM提示技术实现快速量化: 答案相关性:基于生成答案反向构造问题,计算与原始问题的语义相似度 上下文相关性:提取上下文中关键句子,其与总句数比例即为得分 忠实度:将答案拆解为独立声明,统计能被上下文支持的比例 该方法显著加速迭代周期,但存在明显局限:"LLM即裁判"模式对提示词敏感,性能不稳定,尤其在长上下文场景下表现不佳。 ARES:基于合成数据的精准评估 ARES通过微调定制化裁判模型实现质的飞跃,分为三阶段: 合成数据生成:利用LLM从知识库自动构建"问题-上下文-答案"三元组,特别设计"强负例"(语义相近但内容矛盾的样本)提升判别难度 裁判模型微调:为每个评估维度独立训练轻量级分类器(如DeBERTa),取代通用LLM,提升效率与可复现性 统计置信校准:引入预测能力推理(PPI),通过约150个人工标注样本生成置信区间,将评估从启发式评分升级为具备统计学严谨性的结论 实验表明,ARES在上下文相关性评估准确率上比Ragas平均高出59.3个百分点,性能更稳定。#RAG #评估 #评测

7. Agentic RAG:用LangGraph打造会自动修正检索错误的 RAG 系统

8. 【智图译站】ARAG——一种创新的RAG框架及其在城市时空问答的应用

9. 给RAG装上强化学习大脑:RouteRAG用RL 让大模型“聪明”检索,小模型推理能力直逼GPT-4o

10. ComRAG: 面向工业级实时社区问答的动态向量存储RAG框架

11. DecEx-RAG:过程监督+智能剪枝,让大模型检索推理快6倍

12. 当大模型走进诊室:Embedding 与 RAG 如何支撑真实的 AI 医疗应用?

13. 多模态 RAG-Anything:让大模型真正“读懂一切”

14. 3小时搭建RAG语音Agent:NVIDIA揭秘生产级方案四大核心

15. 检索做大,生成做轻:CMU团队系统评测RAG的语料与模型权衡

16. Milvus为何是向量数据库首选?

17. 从零搭建生产级Agent:Agno框架+Milvus知识库完整实战指南!

18. VLDB 2025 | GaussDB-Vector:面向大语言模型应用的大规模持久化实时向量数据库

19. 最新测评发布:VexDB 持续领跑,向量数据库性能之王

20. ragflow v0.23.1 发布:Memory 稳定性全面增强,RAG 图像与表格理解升级,新增 GitHub / GitLab / Asana / IMAP 数据源

21. 垂直领域RAG也行啦,斯坦福多路召回「外挂」把SOTA提升10+%,含实战分析

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章