Anthropic发布Claude Ultra,数学推理碾压GPT-5.2达12%

📅 2026-08-16 18:05  |  ✍️ xibeilang  |  💬 暂无评论

2026年08月16日 | Source: TechCrunch | WolfEye World

今日凌晨,Anthropic正式甩出下一代旗舰模型Claude Ultra,这是继Claude 5之后的最大版本迭代。官方技术报告显示,它在MMMU-Pro、GPQA-Diamond等基准测试中全面领先,尤其在复杂数学推理和跨模态代码生成上,得分比OpenAI GPT-5.2高出约12%。这背后是首次落地的“持续学习”架构——模型能在推理过程中动态调用外部工具链,不用重新训练就能适应新领域,相当于给AI装了个“随取随用的工具箱”。CEO Dario Amodei透露,Claude Ultra已通过内部“AI安全三级”评估,并锁定了多家财富500强客户,覆盖医疗诊断和自动驾驶仿真场景。分析人士直言,这会把大模型军备竞赛再推高一个段位,监管机构恐怕得加速出台AI能力分级标准了。

WolfEye: 持续学习是杀手锏,但安全评估标准若不统一,竞赛越激烈风险越大。

— WolfEye World

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注