中国AI大模型公司“深度求索”发布DeepSeek-R2,数学推理能力超越人类专家水平

📅 2026-08-21 12:05  |  ✍️ xibeilang  |  💬 暂无评论

📅 2026年08月21日 · 来源:36氪 · 🐺 狼眼新闻

深度求索今日发布DeepSeek-R2,数学推理能力在多项基准测试中超越人类专家水平。这意味着AI不再只是“会算数”,而是能像数学家一样发现规律、构造证明。在IMO级别的竞赛题和高等数学难题上,R2的得分率已超过顶尖人类选手,且推理过程可追溯,不是靠暴力枚举蒙答案。这一突破背后是强化学习与形式化数学验证的结合,让模型学会“思考”而非“记忆”。对学术界,这可能是数学研究的加速器——AI可以帮人类验证猜想、探索证明路径。对产业界,R2的推理能力可直接用于金融风控、密码学、物理模拟等高精度领域。但别急着欢呼,AI数学再强,也还不会问出“为什么这个定理重要”这种原创性问题。深度求索这次是用开源策略打天下,能否撼动OpenAI和Google在推理模型上的地位,还得看生态怎么建。

🐺 狼眼洞察

AI数学超人类,但提出问题的人还是我们。

📖 延伸阅读

数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来

🏷️ 标签:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注