什么是 稠密检索(Dense Retrieval)?

稠密检索(Dense Retrieval)是一种语义搜索方法,它把查询和文档表示为稠密嵌入向量,并通过向量相似度检索结果。

工作原理

稠密检索是许多现代 RAG 系统的基础,因为它能在查询和文档用词不同的情况下找到语义相关片段。查询编码器把用户请求映射为向量,文档编码器把分块映射为向量,向量数据库或近似最近邻索引返回最相近结果。它的优势是语义匹配;弱点是精确标识符、罕见名称、数字和严格过滤条件可能被漏掉,除非配合元数据过滤、混合检索或重排。

主要特点

  • 以嵌入向量而不是精确词项匹配作为主要检索信号
  • 在模型支持时,可跨改写、同义表达和多语言内容进行语义匹配
  • 通常依赖向量数据库或近似最近邻索引
  • 对嵌入模型质量、分块、归一化和领域不匹配很敏感
  • 生产环境常与稀疏检索、元数据过滤和重排器结合

常见用途

  1. 查找能回答自然语言问题的文档片段
  2. 检索语义相近的客服工单
  3. 支撑知识库、政策和开发者文档上的 RAG
  4. 使用兼容嵌入模型搜索多语言内容
  5. 在交叉编码器重排前提供候选片段

示例

loading...
Loading code...

常见问题

稠密检索和关键词搜索有什么区别?

稠密检索比较嵌入模型学到的向量,而关键词搜索主要比较词项。稠密检索可以在用词不同的情况下匹配语义。

稠密检索会取代 BM25 吗?

不一定。BM25 对精确词、标识符和罕见短语仍然很强,因此许多生产系统采用混合检索。

稠密检索效果差的常见原因是什么?

常见原因包括嵌入模型弱、分块不佳、领域不匹配、缺少元数据过滤,以及查询本身需要精确匹配。

为什么稠密检索后还要重排?

稠密检索适合高效生成候选结果,但重排器能更细致比较完整查询和片段,从而改善最终排序。

相关工具

相关术语

相关文章

向量嵌入工程指南:模型选型、语义检索评测与安全迁移

向量嵌入如何支撑语义搜索和 RAG?本文从向量空间、任务类型、归一化与距离函数讲到模型选型、混合检索、重排、Recall@k 评测、索引容量、权限过滤和双索引迁移,帮助开发者用真实查询集验证 Embedding,而不是依赖排行榜、固定维度或无条件相似度阈值。还覆盖向量版本契约、数据删除、跨租户隔离、近似索引取舍和生产监控。

2026-02-21

RAG 是什么?检索增强生成原理与实战指南【2026】

RAG 是什么?本文系统讲解检索增强生成如何在大语言模型回答前引入外部知识依据,覆盖企业知识库构建、文档清洗与分块、Embedding 向量化、向量数据库、稀疏与稠密混合检索、重排序、提示词约束、引用溯源、离线评估和 Python 实战。适合构建客服问答、内部文档检索、代码知识库与需要持续更新资料的 AI 应用,并说明 RAG 与模型微调的选型差异。

2026-02-21

向量数据库指南:RAG、pgvector、搜索引擎与成本选型

向量数据库什么时候需要、什么时候不需要?本文讲解 Embedding、HNSW、元数据过滤与 RAG,比较 PostgreSQL + pgvector、搜索引擎、专用数据库和托管服务,提供租户隔离、混合检索、召回率、尾延迟、索引更新、数据迁移、备份恢复与总成本的生产选型矩阵和 Python 示例,适合企业知识库、语义搜索、推荐和大规模检索系统。

2026-02-21