Anthropic发布Claude X1,92.7%基准分把GPT-5甩在身后

📅 2026-08-09 20:05  |  ✍️ xibeilang  |  💬 暂无评论

📅 2026年08月09日 · 来源:TechCrunch · 🐺 狼眼新闻

Anthropic今天甩出一张王牌——Claude X1在MMLU-Pro基准测试中拿下92.7%的得分,比上一代直接跳涨11个百分点,碾压所有公开模型。这背后靠的是”自适应思维链”机制,简单说就是模型学会了自己把握思考节奏:遇到高难度数学题时自动延长推理时间,碰到简单问题则秒回,像个懂得分配考试时间的老手。CEO Dario Amodei透露,该模型已在医疗诊断和气候模拟领域试点,推理准确率比人类专家团队高出18%。更狠的是,API定价每百万token仅15美元,比上代便宜30%,明显是冲着中小创业公司来的。这一手直接加剧了与OpenAI和Google DeepMind的军备竞赛,企业级AI应用怕是要迎来新一轮洗牌。

🐺 狼眼洞察

降价30%加性能跃升,Anthropic这是要掀桌子的节奏,OpenAI得赶紧接招了。

📖 延伸阅读

数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来

🏷️ 标签:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注