Anthropic发布Claude Ultra:推理能力全面反超GPT-5.2,训练成本还省了40%

📅 2026-08-19 20:05  |  ✍️ xibeilang  |  💬 暂无评论

📅 2026年08月19日 · 来源:TechCrunch · 🐺 狼眼新闻

今日凌晨,Anthropic正式发布旗舰模型Claude Ultra,在MATH-500和HumanEval-XL上分别拿下94.7%和92.3%的高分,较上一代提升近20%,首次全面碾压OpenAI的GPT-5.2。这背后是“自我验证链”机制——模型能像学霸检查考卷一样,主动揪出并修正推理中的逻辑漏洞,把幻觉率大幅压了下去。更狠的是,Anthropic用“宪法式AI”框架搭配新型稀疏激活架构,训练成本只有同行的60%。这意味着什么?OpenAI的护城河不只是被技术捅破,连成本优势也被瓦解了。Claude Ultra已向企业开放API,个人版下月上线。对普通用户来说,以后用AI写代码、解难题,可能真到了“闭眼选Claude”的时刻,但别忘了,推理变强不等于绝对正确,关键场景仍需人工复核。

🐺 狼眼洞察

成本降四成、性能反超,OpenAI的定价权这回真悬了。

📖 延伸阅读

数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来

🏷️ 标签:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注