漫话开发者 - UWL.ME Mobile

Z.ai正式确认,此前以ox-alpha名称匿名参与评测的模型,实际是GLM-5.3-Flash。该模型采用3200亿参数的混合专家(MoE)架构,每次推理仅激活180亿参数,在编码和智能体相关基准测试中表现接近Claude Opus 4.8。这一消息意味着高效稀疏激活路线在头部模型竞争中再次展现出较强的能效比,因为较少的活跃参数通常有助于降低推理成本与响应延迟。对于需要复杂代码生成、自主任务执行和工具调用的开发场景,此类模型可能提供更具性价比的选择。该发布也反映出前沿模型正在从单纯扩大参数规模,转向通过架构优化和专家路由提升实际能力。

核心要点

  • ox-alpha被确认是Z.ai的GLM-5.3-Flash模型
  • 该模型为3200亿参数MoE架构,仅激活180亿参数
  • 在编码和智能体基准上表现接近Claude Opus 4.8

Read more >