谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力
thinkindev • 2026-07-28
1701 views
谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应用场景,以及复杂推理任务,使得小型模型也能具备更深层次的逻辑推理能力,弥合大小模型之间的性能差距。当前蒸馏方案支持以gemini-3.1-pro作为教师模型,以gemini-2.5-flash作为学生模型,为开发者在成本、速度与智能之间提供了更优的平衡点。这一工具将显著降低企业在生产环境中部署高性能AI的门槛,推动端侧和规模化推理的进一步普及。
核心要点
- Gemini蒸馏服务可将大模型的推理能力迁移至小型模型,提升效率并降低成本。
- 当前仅支持gemini-3.1-pro作为教师模型,gemini-2.5-flash作为学生模型。
- 适用于高吞吐、低延迟应用场景及需要深度推理的复杂任务。