Anthropic发布Claude Ultra:推理能力全面反超GPT-5.2,训练成本还省了40%
📅 2026-08-19 20:05 | ✍️ xibeilang | 💬 暂无评论
📅 2026年08月19日 · 来源:TechCrunch · 🐺 狼眼新闻
今日凌晨,Anthropic正式发布旗舰模型Claude Ultra,在MATH-500和HumanEval-XL上分别拿下94.7%和92.3%的高分,较上一代提升近20%,首次全面碾压OpenAI的GPT-5.2。这背后是“自我验证链”机制——模型能像学霸检查考卷一样,主动揪出并修正推理中的逻辑漏洞,把幻觉率大幅压了下去。更狠的是,Anthropic用“宪法式AI”框架搭配新型稀疏激活架构,训练成本只有同行的60%。这意味着什么?OpenAI的护城河不只是被技术捅破,连成本优势也被瓦解了。Claude Ultra已向企业开放API,个人版下月上线。对普通用户来说,以后用AI写代码、解难题,可能真到了“闭眼选Claude”的时刻,但别忘了,推理变强不等于绝对正确,关键场景仍需人工复核。
🐺 狼眼洞察
成本降四成、性能反超,OpenAI的定价权这回真悬了。
数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来