来源:互联网 更新时间:2026-08-26 20:49
最近英伟达的一项新研究,可以说是为RAG在长上下文时代“正名”了一把。随着长文本LLM的出现,模型能处理更长的文本序列,RAG似乎显得没那么重要了——但事实果真如此吗?
In Defense of RAG in the Era of Long-Context Language Models
检索增强生成(RAG)克服了早期LLM中有限的上下文限制,过去一直是基于上下文的答案生成的可靠解决方案。最近,长上下文LLM的出现使得模型能够包含更长的文本序列,这就让RAG的吸引力有所下降。
那么,OP-RAG具体是怎么做的呢?
传统RAG的做法是:检索与查询最相关的前k个文本块,然后按相似度排序后,按一定顺序放入大模型的prompt中。而OP-RAG打破了这一惯例——它不按相关性降序排列,而是保持了这些文本块在原文中的顺序。简单说,如果一个文本块在原文中间出现在另一个文本块之前,那么在处理答案时,它也会被放在前面。

论文里做了一系列实验,结果表明,OP-RAG在长文本问答任务中的表现,比传统RAG和长上下文LLM都要好。最亮眼的数据是:使用Llama3.1-70B模型时,OP-RAG只用16K tokens,就达到了44.43的F1分数;而同样使用Llama3.1-70B但不加RAG,即便用上128K tokens,也只能得到34.32的F1分数。差距不是一星半点。


腾讯ima怎么把微信内容一键导入知识库?
腾讯ima怎么创建共享知识库?
Celestia价格预测2026-2032:TIA币能否引领山寨币上涨行情?历史价格回顾
比特币(BTC)核心周期指标复刻历史走势 价格或跌破5.8万美元关键支撑位
比特币 2025 年价格预测:BTC 的未来走势
新浪互联网热点小时报丨2026年07月26日16时_今日实时互联网热点速递
新浪机器学习热点小时报丨2026年07月25日18时_今日实时机器学习热点速递
WorkBuddy微信版怎么获得积分?
5000元起的鼠标哪个最值得入手?
新浪人工智能热点小时报丨2026年07月30日18时_今日实时人工智能热点速递
腾讯ima知识库怎么分类管理?
短剧《史上最强洪荒修为》剧情介绍
海尔消毒柜自动消毒如何中止
博世壁挂炉关闭暖气怎么操作
男生高性价比充电头?
车载冰箱重置到出厂设置几步?
管线机怎么接云米净水器
Windy卫星云图怎么看?云层变化识别技巧
WorkBuddy积分怎么获得?
5000-6000元鼠标有什么推荐?
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc