Mistral-X发布MoE-2架构:推理提速5倍,大模型开始“瘦身”进手机

📅 2026-08-07 12:05  |  ✍️ xibeilang  |  💬 暂无评论

2026年08月07日 | Source: The Verge | WolfEye World

开源AI新锐Mistral-X今日发布MoE-2架构,宣称推理速度提升5倍,且支持端侧部署。MoE-2在混合专家模型基础上做了“动态路由”优化,仅激活任务相关的专家子网络,相当于给大模型配了个“智能导航”,不再每次调用全部参数。实测在手机芯片上运行70亿参数模型,响应延迟从秒级降至毫秒级,性能接近云端GPT-4o mini。这意味着一部中端手机就能离线跑复杂AI应用,隐私敏感数据不再需要上传云端。Mistral-X同步开源了核心代码,开发者可基于此定制轻量模型。行业观察人士认为,这直接冲击了云端AI服务商的商业模式,端侧AI的普及将让“算力即服务”的叙事变得复杂。不过,MoE-2在长上下文任务上的稳定性仍需实测验证,开源社区的“用脚投票”才是最终裁判。

WolfEye: 端侧AI加速落地,云端算力霸权迎来真正的挑战者。

— WolfEye World

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注