Mistral 推出 Agentic Search:从“只读片段”到“翻阅全文”,FinanceBench 正确率从 26.7% 跃升至 86%
thinkindev • 2026-08-21
1126 views
Mistral 近日公布了一项面向智能体场景的检索层方案 Agentic Search,将传统一次性文档检索升级为可导航、可验证的搜索循环。该方案为模型提供 search、open、navigate、read 和 grep 五种操作原语,使其能够深入检查长文档、跟随引用跳转,并在给出答案前进行核对,而不是直接接受首批命中的文本块。官方测试显示,在 FinanceBench 基准上,这一搜索循环将正确率从 26.7% 提升至 86%,同时降低了尾部延迟;在另一个测试框架中,同一模型还进一步获得 10.5 个百分点的提升。这套机制面向复杂报告、金融文件等需要跨页面推理和证据验证的场景,体现出 AI 检索从“向量相似度匹配”向“任务驱动型阅读”演进的趋势。不过,上述数据由 Mistral 自行测试,其跨模型、跨数据集的稳定性和可复现性仍需第三方评估。
核心要点
- Mistral 发布 Agentic Search,提供 search、open、navigate、read、grep 五种操作原语。
- 该搜索循环使模型能检查长文档、跟踪引用并验证答案,而非仅取首批检索片段。
- 官方测试中 FinanceBench 正确率从 26.7% 提升至 86%,尾延迟降低,但数据为厂商自测。