OpenAI发布GPT-5.5,综合得分85.7首次超越人类专家,还学会了主动质疑

📅 2026-08-20 12:04  |  ✍️ xibeilang  |  💬 暂无评论

2026年08月20日 | Source: The Verge | WolfEye World

OpenAI凌晨甩出GPT-5.5,直接改写游戏规则:在MMLU-Pro、MATH-2026等一堆硬核基准测试中,综合得分85.7分,首次压过人类专家平均的84.2分。这货用了混合专家架构加动态推理链,参数量飙到8万亿,但推理成本反而比GPT-5降了40%。最骚的操作是新增的“主动质疑”机制——遇到模糊指令不再闷头瞎干,而是先问你到底要啥。OpenAI还宣布对学术机构免费开放,第四季度就集成进Microsoft Copilot。业内都在说,AI从“你说啥我干啥”的工具,变成了“我帮你想想对不对”的协作者。但别忽略,8万亿参数背后的训练能耗和潜在偏见问题,OpenAI一个字没提。

WolfEye: AI首次在推理上‘胜人一筹’,但质疑能力是把双刃剑,伦理监管得跟上。

— WolfEye World

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注