OpenAI发布“GPT-5.2-Turbo”,首次实现端侧实时多模态推理

📅 2026-08-17 18:05  |  ✍️ xibeilang  |  💬 暂无评论

2026年08月17日 | Source: The Verge | WolfEye World

OpenAI今天凌晨甩出GPT-5.2-Turbo,把180B参数的大模型硬塞进手机芯片,端侧实时多模态推理不再是PPT。这个模型靠混合专家架构和4-bit量化技术瘦身,MMLU基准上居然没掉队,还能在骁龙8 Gen 5上实现200毫秒内的视频理解加语音交互。最狠的是,它直接集成到与苹果合作的新版Siri里,9月就开放API。这标志着AI大模型的主战场从云端算力挪到了端侧体验——当推理不再依赖网络,隐私、延迟、离线可用性全成了卖点。苹果这波押注很聪明,Siri终于有了翻身的机会,但安卓阵营的厂商怕是要连夜开会找对策。不过,180B参数在手机上的功耗和发热仍是硬伤,4-bit量化牺牲的精度在复杂任务上会不会露馅,还得实测说话。对普通人而言,你的下一部手机可能就是个离线AI助手,语音交互流畅到忘了云端的存在。

WolfEye: 端侧AI爆发前夜,苹果Siri抢先卡位。

— WolfEye World

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注