OpenAI发布GPT-5.5-Turbo,推理成本降低90%并支持百万级上下文窗口
📅 2026-08-09 00:09 | ✍️ xibeilang | 💬 暂无评论
2026年08月09日 | Source: The Verge | WolfEye World
OpenAI凌晨放了个大招:GPT-5.5-Turbo把API推理成本砍到每百万token仅0.8美元,比GPT-5.0降了90%,上下文窗口一口气扩到100万token——相当于把《三体》三部曲整本塞进模型“脑子”里。它靠混合专家架构和稀疏注意力机制,在MMLU-Pro上刷到92.7分,还原生支持实时视频流理解和语音克隆,微软Copilot和Notion AI已经接入。但开发者社区泼了盆冷水:官方没把KV Cache费用算进去,实际总成本可能没那么香。对于普通人,这意味着AI写小说、分析长文档的门槛又低了一截。
WolfEye: 价格战打到脚踝,但隐藏成本让“便宜”成了营销话术。
— WolfEye World