来源:互联网 更新时间:2026-07-27 07:15
先聊个核心问题:大模型这么强,为什么还要搞什么RAG?

说到底,大模型再牛,也有三个绕不开的短板:
传统上,大家有两条路可以走:
RAG 给出了第三条路:把知识放在外部,每次回答问题前,先检索出相关资料作为上下文,让模型基于真实资料作答。说白了,就是让大模型学会“查资料”而不是“背答案”。
RAG 的流程可以拆成两个阶段:索引阶段(Indexing)和检索生成阶段(Retrieval & Generation)。整个过程就像搭积木:先建好知识库,然后让大模型在回答问题时,随时从知识库里翻资料。
文档 → 分块(Chunk) → 向量化(Embedding) → 存入向量数据库
这一步没什么花哨的,就是把原始文档切碎、转成向量、存进数据库。至于怎么切、用什么模型转,后面会细说。
当用户提问时,流程开始反着跑:
Embedding 是 RAG 的地基——地基不稳,楼上再花哨也没用。常见的 Embedding 模型有这些:
| 模型 | 特点 |
|---|---|
| OpenAI text-embedding-ada-002 | 效果好,API 调用方便,但需付费 |
| BGE (BAAI) | 开源,中文支持好,社区活跃 |
| M3E | 轻量级,中文开源首选 |
| Jina Embeddings | 支持多语言,API 友好 |
选哪个?看你手头的数据语言和预算。中文场景,BGE 和 M3E 是性价比很高的选择。
单一向量检索有时不够精准——毕竟语义相似度不一定能覆盖所有需求。业界常用的做法是混合检索:
两者加权融合,既能理解语义,又能精确匹配,效果往往比单打独斗好得多。
初步检索出来的结果,排序不一定理想。这时候可以用 Cross-Encoder 模型(比如 BAAI/bge-reranker)对检索结果重新打分排序,把真正相关的内容排在最前面。这一步相当于给检索结果做了一次“精筛”。
用户的问题不一定适合直接检索。比如“那个东西怎么用”——口语化表达,缺少关键实体。这时候需要:
都是为了让检索更精准,找得更准。
一个实际开发场景:在 Dify 中构建一个 RAG 应用。整个过程基本不用写代码,零基础也能上手。
整个过程不需要写代码,所以零基础也能快速搭建一个私有知识库问答系统。
| RAG | Fine-tuning | |
|---|---|---|
| 知识更新频率 | 高(实时更新知识库) | 低(需要重新训练) |
| 成本 | 低(只需维护向量数据库) | 高(GPU 训练成本) |
| 可解释性 | 高(答案可溯源到原文) | 低(知识融入权重黑箱) |
| 适用场景 | 私有知识、动态知识 | 风格学习、复杂推理模式 |
选哪个?其实不是二选一的问题。实际项目中,两者经常结合使用:RAG 保证知识准确性,Fine-tuning 提升特定任务的推理能力。互补才是王道。
RAG 不是银弹,它解决了一个非常核心的问题:让大模型从“我知道”变成“我能查到”。
在企业落地场景中,RAG 几乎是必选项。结合 Dify 这样的低代码平台,搭建一套私有知识库问答系统的门槛,已经被拉到了地板上。
如果你还没动手试过,不妨从上传一份你手头的技术文档开始,体验一下 RAG 带来的改变。
摩托车活塞环性能如何
ThinkBook系列最新价格全解析:2026年选购避坑与实时询价指南
GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?
Ondo将于今日上线股票永续合约
电视剧《罗曼诺夫后裔》剧情介绍
暗黑4S14野蛮人终局BD攻略
区块链OTC交易所有哪几家比较正规?
什么是山寨币?山寨币指数如何查看?全球前10大山寨币盘点
Binance新增15种bStocks代币化证券为杠杆抵押资产
全球十大加密货币APP v3.11.5正版下载
GLM-4.5发布,全网最全测评和使用教程来了!
洛的网名三字男生霸气(精选100个)
本周比特币行情预判:BTC后市的三种推演与两强对决
剑侠世界3雪峰论剑怎么打-剑侠世界3雪峰论剑打法介绍
Meme币DOGS今晚上线!开局就解锁91%代币是否带来风险?
五千元以下的笔记本几乎消失!经销商:至少一年看不到涨价尽头
姓徐和李取网名男生霸气(精选100个)
25年来最惨单月 微软市值本月重挫近4万亿:押注AI也没赢麻
超长高标准质保+总部直保售后体系:小牛真实售后体验大起底
比特币守住关键支撑,HYPE市值升至第九并反超DOGE
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc