Cerebras发布WSE-4:9万亿晶体管把大模型推理压到8毫秒

📅 2026-08-18 06:05  |  ✍️ xibeilang  |  💬 暂无评论

2026年08月18日 | Source: 量子位 | WolfEye World

Cerebras今天甩出第四代晶圆级引擎WSE-4,直接把人脑级响应从科幻拉进现实。这颗采用台积电3nm工艺的巨无霸集成超9万亿晶体管,片上存储带宽高达220PB/s,跑Llama-4-1T时延迟仅8毫秒——相当于你刚眨完眼,AI已经把答案递到你面前。其动态稀疏计算架构更是把推理成本打到每百万token仅0.4美元,比通用GPU便宜一个量级。CEO透露已拿下三家超大规模云厂商意向订单,Q4量产。业内直言,专用AI推理芯片对英伟达通用GPU的替代拐点已至。但别急着欢呼,9万亿晶体管的功耗和散热仍是现实难题,且量产爬坡能否如期兑现,还得看台积电的产能脸色。

WolfEye: 专用芯片正在用成本优势撬动GPU王座,英伟达的护城河开始漏水。

— WolfEye World

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注