当前位置：首页 > news >正文

【RAG召回排序】2025最全排序模型梳理

news 2026/7/13 6:39:09

2025年检索重排模型全景盘点：从顶尖榜单到实用工具

在检索增强生成（RAG）和智能搜索领域，检索与重排模型的性能直接决定了系统的最终效果。今天我们就从权威排行榜出发，盘点当前最受关注的模型与工具。

一、权威检索重排排行榜速览

目前业内最受关注的两大检索重排模型排行榜分别是：

BGE-Reasoner 榜单（https://github.com/VectorSpaceLab/agentic-search/tree/main/BGE-Reasoner）：由向量空间实验室维护，聚焦于具备推理能力的检索模型，其榜单数据直接反映了模型在复杂场景下的信息筛选能力。
Bright Benchmark（<https://brightbenchmark.github.io）：一个综合性的检索模型评测平台，通过多维度的数据集和严格的评估指标，为研究者和开发者提供模型性能的客观对比。

这两个榜单是当前检索重排领域的风向标，能够帮助我们快速定位最前沿的技术成果。

二、Bright Benchmark 前五名深度解析

1. INF-X-Retriever（INF）

核心亮点：以63.4的总分大幅领先第二名，在榜单上形成断层优势，展现出碾压级的性能。
注意事项：目前仅支持英文场景，中文任务中无法直接使用，但其技术思路值得关注。

2. DIVER-v3-GroupRank（Ant Group & Sun Yat-sen University）

核心亮点：由蚂蚁集团与中山大学联合研发，以46.8分位居第二。它创新性地引入了分组排序机制，在处理大规模候选集时具备更优的效率与效果。
技术价值：其论文（https://arxiv.org/abs/2508.07995）详细阐述了分组策略的设计思路，对工业界落地具有重要参考意义。

3. BGE-Reasoner-0928（USTC & BUPT & BAAI）

核心亮点：由中国科学技术大学、北京邮电大学与北京智源人工智能研究院联合推出，是兼具推理能力与检索精度的代表模型。
生态价值：它不仅在榜单上表现优异，还拥有完整的开源生态（https://github.com/VectorSpaceLab/agentic-search/tree/main/BGE-Reasoner），便于开发者进行二次开发与部署。

4. Lattice Hierarchical Retrieval（UT Austin & UCLA & Google）

核心亮点：由德克萨斯大学奥斯汀分校、加州大学洛杉矶分校与谷歌团队共同开发，采用独特的分层格子结构，能够高效处理多粒度的语义信息。
开源支持：项目已开源（https://github.com/nilesh2797/lattice），其分层检索的架构设计为处理复杂长文本提供了新的技术路径。

5. ReasonRank (rerank RaDer)（RUC & Baidu & CMU）

核心亮点：由中国人民大学、百度与卡内基梅隆大学联合打造，是一款专注于重排任务的模型，通过对召回结果的二次精排，显著提升最终检索的准确率。
技术定位：它证明了在检索流程中，“重排”环节对最终效果的决定性作用，与“召回”环节同等重要。

三、其他值得关注的模型与工具

🌟 行业标杆与创新突破

hifi-rag：NeurIPS 2025冠军模型，其核心创新在于用大模型做内容过滤，打破了“唯召回率论”的行业惯性，强调“过滤效果才是提升RAG性能的关键”。
Youtu-Embedding：在CMTEB（中文多模态嵌入基准）榜单上效果最好的中文嵌入模型，是处理中文场景的首选方案之一。
ReasonEmbed：与BGE-Reasoner同属一个开源生态，专注于生成具备推理能力的文本嵌入，为后续的检索与重排提供了高质量的语义基础。

🛠️ 实用工具与衍生模型

jina-embedding：由Jina AI推出的轻量级嵌入模型，以高效的部署体验和稳定的性能，在开发者社区中广受好评。
conan-v1：一款新兴的重排模型，通过结合上下文感知的注意力机制，在动态场景下展现出出色的自适应能力。
Yuan-embedding-2.0-zh：其创新的训练范式值得研究，尤其在处理低资源语言和领域适配场景时，提供了新的技术思路。

📊 经典与生态工具

cross-encoder/stsb-roberta-base：经典的交叉编码器模型，在语义相似度计算任务中表现稳定，是许多重排系统的基线选择。
ColBERT：通过交互式注意力机制实现细粒度的语义匹配，是学术界和工业界都广泛认可的检索模型。
Qwen带提示词重排：基于通义千问大模型的重排方案，通过精心设计的提示词工程，充分释放大模型的推理能力来优化排序结果。
SBERT：经典的语义相似度模型，其论文（https://arxiv.org/abs/1908.10084）被引次数极高，至今仍是构建语义检索系统的基石。

🧩 Milvus 生态工具

Phrase Match：Milvus的短语查询功能，支持多个关键词短语的精确匹配，非常适合需要精准定位关键词的检索场景。
zilliz/semantic-highlight-bilingual-v1：Milvus推出的语义高亮模型，通过对召回结果的token级打分，能够更细粒度地计算句子与查询的相似度，提升检索结果的可解释性。

我可以帮你整理一份检索重排选型对照表，把这些模型的核心特点、适用场景和优缺点都列出来，方便你快速做技术选型。需要吗？

http://www.jsqmd.com/news/254818/

相关文章：

AI技术唾手可得的时代，挖掘新需求是产品突围的关键——某知名聚合DNS管理系统的需求洞察

编程已终结！AI时代的原生智能软件架构长啥样？Claude给了个指南

安卓神器 --- 浏览器之 yandex 狐猴浏览器 chrome firefox

P11714 [清华集训 2014] 主旋律 Sol

夏天还不算开始——我，不会退役

GD5F1GM7UEYIGR：兆易创新1Gbit SPI NAND闪存，高效低功耗

4B超越8B比肩30B！清华、面壁智能端侧智能体天花板开源

企业软件供应链安全治理立项，方案书/立项书该怎么写？

[Non] 字符串问题

谷歌Veo 3.1更新：更一致性、更具创造力和控制力

评正高写书10万字什么价格？

Day15对象的方法与遍历对象

SCI分区是怎么划分的？

深圳ACFlow智能营销系统：2026年中小企业AI驱动营销新范式

ACP：2.从一个 .NET 实战开始，看 Agent 带来的真实差异

工业级文本转SQL新思路：成本暴降、超3000列超大数据库依然稳健

C++跨平台开发挑战的技术

万卡的部署架构

IDM插件开发创意赛

Claude Code 在 Windows 下的 nul 文件问题解决方案

建模智能体，AI 时代的数据治理新范式

DCDN和CDN科普：动态内容加速的秘密武器

苹果手机照片怎么导入电脑？苹果手机传输照片就用这5招

探索AI原生应用领域，AI代理引领新潮流

LLM伦理推理让临床决策更公平

从ChatBI到Agentic BI：衡石如何构建“自主决策与执行”的数据智能体

基于深度学习的肺炎检测系统（YOLOv8+YOLO数据集+UI界面+Python项目+模型）

2025年华南理工大学计算机考研复试机试真题（解题思路 + AC 代码）

2025年济南大学计算机考研复试机试真题（解题思路 + AC 代码）