OpenAI自研芯片Atlas落地:推理成本砍掉65%,英伟达的蛋糕被自己客户咬了一口

📅 2026-09-01 03:04  |  ✍️ xibeilang  |  💬 暂无评论

📅 2026年08月31日 · 来源:The Verge · 🐺 狼眼新闻

OpenAI今天正式亮出与博通联手打造的自研推理芯片Atlas,专为GPT-6和下一代多模态模型定制。5nm工艺,FP8与MXFP4混合精度,推理吞吐量比H100高出4.2倍,单位Token成本直降65%——这意味着以后用GPT-6聊天,可能比现在用GPT-4还便宜。芯片已通过流片验证,今年第四季度先在微软Azure小规模部署,专供旗舰聊天机器人的实时推理。OpenAI这一步棋走得又狠又准:从纯软件公司转型软硬一体,直接抄了英伟达的后路。但量产能力和生态成熟度是最大变数,毕竟英伟达的CUDA壁垒不是靠一块芯片就能推倒的。对普通用户来说,最直观的改变是——AI服务的账单可能会瘦身。

🐺 狼眼洞察

OpenAI造芯是必然,但能不能量产才是真考验,别让PPT变成笑话。

📖 延伸阅读

数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来

🏷️ 标签:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注