开源|Weave Router:50毫秒内为智能体系统精准路由模型,推理成本直降40-70%
thinkindev • 2026-10-02
1612 views
随着智能体(Agentic)系统从单模型调用走向多模型协同,如何在成本、延迟与任务适配之间取得平衡成为关键。Weave Router 是一款开源模型路由器,专为智能体系统设计,通过 OpenAI 兼容端点将每个提示路由到合适的模型。官方数据显示,其路由开销低于 50 毫秒,并且仅需更换端点即可让现有应用降低 40% 至 70% 的推理成本。该项目提供快速代理路径,开发者无需大规模重构即可接入。它体现了 AI 基础设施从单一强模型调用向按需动态调度异构模型演进的趋势,对需要大规模调用模型的团队尤其具有实用价值。
核心要点
- 开源模型路由器,兼容 OpenAI 端点,路由开销低于 50 毫秒
- 仅更换端点即可降低 40% 至 70% 的推理成本
- 面向智能体系统,支持现有应用快速代理接入