OpenAI发布GPT-5.5-Turbo,推理成本降低80%,并首次支持端侧运行

📅 2026-08-11 16:04  |  ✍️ xibeilang  |  💬 暂无评论

📅 2026年08月11日 · 来源:The Verge · 🐺 狼眼新闻

OpenAI今天凌晨甩出GPT-5.5-Turbo,一个专为高并发和边缘场景设计的轻量级变体。它靠混合专家架构(MoE)和量化蒸馏技术,在MMLU-Pro得分92.7、推理能力不掉队的前提下,把单次API调用成本砍掉80%,延迟压到120毫秒。更炸的是与高通合作,在骁龙8 Gen 5芯片上能跑70亿参数版本,实时语音翻译和本地文档分析不再需要云端兜底。Sam Altman说这是AI从云端走向个人设备的起点,隐私敏感型应用要迎来春天。但端侧运行的模型规模和能力天花板依然明显,免费100万token的额度更像是一个钩子,OpenAI的算力账本还得靠云端大单来填。

🐺 狼眼洞察

AI下放端侧是必然趋势,但成本降80%背后,是OpenAI对边缘生态的野心试探。

📖 延伸阅读

数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来

🏷️ 标签:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注