OpenAI发布GPT-5.5,综合得分85.7首次超越人类专家,还学会了主动质疑
📅 2026-08-20 12:04 | ✍️ xibeilang | 💬 暂无评论
📅 2026年08月20日 · 来源:The Verge · 🐺 狼眼新闻
OpenAI凌晨甩出GPT-5.5,直接改写游戏规则:在MMLU-Pro、MATH-2026等一堆硬核基准测试中,综合得分85.7分,首次压过人类专家平均的84.2分。这货用了混合专家架构加动态推理链,参数量飙到8万亿,但推理成本反而比GPT-5降了40%。最骚的操作是新增的“主动质疑”机制——遇到模糊指令不再闷头瞎干,而是先问你到底要啥。OpenAI还宣布对学术机构免费开放,第四季度就集成进Microsoft Copilot。业内都在说,AI从“你说啥我干啥”的工具,变成了“我帮你想想对不对”的协作者。但别忽略,8万亿参数背后的训练能耗和潜在偏见问题,OpenAI一个字没提。
🐺 狼眼洞察
AI首次在推理上‘胜人一筹’,但质疑能力是把双刃剑,伦理监管得跟上。
📖 延伸阅读
数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来