OpenAI发布多模态推理模型GPT-5.5,首次实现实时视频理解与自主工具调用

📅 2026-08-17 12:04  |  ✍️ xibeilang  |  💬 暂无评论

📅 2026年08月17日 · 来源:量子位 · 🐺 狼眼新闻

OpenAI今天凌晨放出GPT-5.5,这不再是简单的“看图说话”升级——它能实时啃视频流,理解物理世界的动态,比如看一段机械臂操作视频,直接推理下一步动作。更狠的是,它能在对话中自主调用代码编辑器、浏览器甚至设计软件,把“聊天”变成“干活”。基准测试里,MMLU-Pro和MATH-2026得分比GPT-5涨了18%,长程推理能力尤其亮眼。API价格反而砍了30%,摆明了要抢企业市场。但“自主调用工具”这扇门一开,AI犯错的责任谁来扛?安全讨论必然炸锅。对普通人来说,GPT-5.5意味着AI助手从“动嘴”进化到“动手”,但得小心它越权操作。

🐺 狼眼洞察

GPT-5.5让AI从聊天走向实操,自主性越强,安全边界越要盯紧。

📖 延伸阅读

数据来源:新华网、路透社、法新社、BBC中文、澎湃新闻等综合整理
西北狼·狼眼世界 · 狼眼观天下,坚韧铸未来

🏷️ 标签:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注