漫话开发者 - UWL.ME Mobile
Loading more...
漫话开发者 - UWL.ME Mobile

据TechCrunch报道,AI实验室PrismML近日发布Bonsai 2 27B模型,成功将阿里巴巴的Qwen3.8 27B压缩至仅5.9GB,体积小到足以在智能手机上运行,同时仍保留原模型98.2%的基准测试得分。这一进展在端侧AI部署上具有重要意义:过去27B级别的大模型通常依赖云端GPU或专用加速卡,而Bonsai 2 27B的压缩方案有望让高性能语言模型直接运行在移动设备上,显著降低推理延迟与网络依赖,并提升隐私保护能力。TechCrunch指出,PrismML目前尚未进行大规模融资,但其轻量化技术路线已经引起业界关注。若该技术继续成熟,可能推动AI助手、实时翻译、离线知识问答等应用从云端走向终端,并促使芯片、操作系统与开发者生态围绕端侧大模型加快布局。

核心要点

  • PrismML发布Bonsai 2 27B,将阿里Qwen3.8 27B压缩至5.9GB。
  • 压缩后模型体积适合智能手机运行,并保留98.2%的Qwen基准测试成绩。
  • 端侧大模型有望降低云端依赖,提升隐私保护和实时响应能力。

Read more >