OpenAI发布GPT-5.5-Turbo,推理成本降低90%并支持百万级上下文窗口

📅 2026-08-09 00:09  |  ✍️ xibeilang  |  💬 暂无评论

2026年08月09日 | Source: The Verge | WolfEye World

OpenAI凌晨放了个大招:GPT-5.5-Turbo把API推理成本砍到每百万token仅0.8美元,比GPT-5.0降了90%,上下文窗口一口气扩到100万token——相当于把《三体》三部曲整本塞进模型“脑子”里。它靠混合专家架构和稀疏注意力机制,在MMLU-Pro上刷到92.7分,还原生支持实时视频流理解和语音克隆,微软Copilot和Notion AI已经接入。但开发者社区泼了盆冷水:官方没把KV Cache费用算进去,实际总成本可能没那么香。对于普通人,这意味着AI写小说、分析长文档的门槛又低了一截。

WolfEye: 价格战打到脚踝,但隐藏成本让“便宜”成了营销话术。

— WolfEye World

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注