五种 RAG 怎么选:先认清会在哪失败

552 字
3 分钟
五种 RAG 怎么选:先认清会在哪失败

卡在「要不要上 RAG」这一层时,选型往往从品牌对比开始——向量库谁家热、embedding 哪家分高。更稳的问法是:系统会在哪失败? 失败模式定了,检索架构才有得选。

RAG 不是勾选项。Demo 能跑、生产抖三抖,多半是失败模式没对齐,不是「少接了一个向量库」。


先问五句,再谈架构名

你会撞上哪类失败优先看
关键词对不上、专名漏检Hybrid
答案藏在实体关系里GraphRAG
一步检索不够,要拆任务调工具Agentic
检索脏了还硬答,可信度崩Corrective(CRAG)
料在 PDF 图 / 表 / 扫描页里Multimodal

五种怎么走

架构在补什么流程骨架
Hybrid语义 + 精确关键词查询 → 向量 + BM25 → 融合排序 → LLM
GraphRAG实体关系推理查询 → 实体抽取 → 知识图谱 → 子图检索 → LLM
Agentic多步规划与工具查询 → 规划 Agent → 搜索 / SQL 等工具 → 推理 Agent → 答案
Corrective / CRAG检索质量门禁查询 → 检索 → 质量评估(过→LLM;不足→重搜)→ 答案
Multimodal文 / 图 / 表统一进索引多模态输入 → 多模态嵌入 → 统一索引 → 多模态 LLM

Hybrid 解决的是「搜得到字面」;Graph 解决的是「绕得过关系」;Agentic 解决的是「一步不够」;CRAG 解决的是「搜错了还装懂」;Multimodal 解决的是「料根本不在纯文本里」。


选型时别踩的坑

先买向量库再找场景:品牌对比可以后置;失败模式要前置。

五种当互斥菜单:生产里常见叠用(Hybrid + CRAG 很常见),图是选型地图,不是五选一考卷。

把 Agentic 当默认升级包:多一步 Agent 就多一截延迟与失控面;任务不复杂时别硬上。

CRAG 只加评估不设重搜出口:门禁开了却无处可逃,评估等于白做。

认清自己会撞上哪一种失败,比背全五种名字有用。旁边那篇「Agent 记忆八选一」管的是上下文账单;这篇管的是检索失败模式——两道题别糊成一道。

评论区

像发消息一样写就好:点工具栏插入表情 / 图片,表情会直接显示。插图 ≤5MB。