中国AI大模型公司“深度求索”发布DeepSeek-R2,数学推理能力超越人类专家水平
📅 2026-08-21 12:05 | ✍️ xibeilang | 💬 暂无评论
2026年08月21日 | Source: 36氪 | WolfEye World
深度求索今日发布DeepSeek-R2,数学推理能力在多项基准测试中超越人类专家水平。这意味着AI不再只是“会算数”,而是能像数学家一样发现规律、构造证明。在IMO级别的竞赛题和高等数学难题上,R2的得分率已超过顶尖人类选手,且推理过程可追溯,不是靠暴力枚举蒙答案。这一突破背后是强化学习与形式化数学验证的结合,让模型学会“思考”而非“记忆”。对学术界,这可能是数学研究的加速器——AI可以帮人类验证猜想、探索证明路径。对产业界,R2的推理能力可直接用于金融风控、密码学、物理模拟等高精度领域。但别急着欢呼,AI数学再强,也还不会问出“为什么这个定理重要”这种原创性问题。深度求索这次是用开源策略打天下,能否撼动OpenAI和Google在推理模型上的地位,还得看生态怎么建。
WolfEye: AI数学超人类,但提出问题的人还是我们。
— WolfEye World