OpenAI发布“GPT-5.2-Turbo”,首次实现端侧实时多模态推理
📅 2026-08-17 18:05 | ✍️ xibeilang | 💬 暂无评论
2026年08月17日 | Source: The Verge | WolfEye World
OpenAI今天凌晨甩出GPT-5.2-Turbo,把180B参数的大模型硬塞进手机芯片,端侧实时多模态推理不再是PPT。这个模型靠混合专家架构和4-bit量化技术瘦身,MMLU基准上居然没掉队,还能在骁龙8 Gen 5上实现200毫秒内的视频理解加语音交互。最狠的是,它直接集成到与苹果合作的新版Siri里,9月就开放API。这标志着AI大模型的主战场从云端算力挪到了端侧体验——当推理不再依赖网络,隐私、延迟、离线可用性全成了卖点。苹果这波押注很聪明,Siri终于有了翻身的机会,但安卓阵营的厂商怕是要连夜开会找对策。不过,180B参数在手机上的功耗和发热仍是硬伤,4-bit量化牺牲的精度在复杂任务上会不会露馅,还得实测说话。对普通人而言,你的下一部手机可能就是个离线AI助手,语音交互流畅到忘了云端的存在。
WolfEye: 端侧AI爆发前夜,苹果Siri抢先卡位。
— WolfEye World