header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

OpenAI修复GPT-6图像Bug,Luna视觉定位翻倍

动察 Beating AI 快讯,OpenAI 修复了 GPT-6 Sol 和 GPT-6 Luna 的一个图像编码 Bug。这个问题会降低模型对图片的理解能力,修复后 API 和 Codex 的视觉任务都会改善,包括让 Agent 看屏幕操作电脑的 Computer Use。


OpenAI 公布的测试中,GPT-6 Luna(Max)在 RefCOCOg 视觉定位评测上的平均 IoU 从 28.8% 升到 60.0%,提高 31.2 个百分点。这个测试主要看模型能不能根据一句描述,在图片里准确找到对应的物体或区域。


两款模型 9 月 22 日才正式上线 API,OpenAI 的更新日志在 9 月 25 日就记录了这次修复。官方没有公布 Sol 的具体提升,也没有说明 Bug 从什么时候开始、影响了多少图片请求。


OpenAI 还罕见地建议使用图片输入的开发者重新跑一遍评测,并重试此前受影响的工作流。

AI 解读
OpenAI 9月22日才把 GPT-6 Sol/Luna 推上 API,9月25日便记录图像编码 Bug 修复,并罕见建议开发者重跑评测、重试工作流。Luna(Max)RefCOCOg 平均 IoU 从 28.8% 升至 60.0%,提高 31.2 个百分点;Sol 提升和影响请求量均未披露。

这延续 GPT-6 的低价多模态攻势:9月23日 Sol/Luna 刚以半价对标 Opus 5.5,Luna 被定位为高频任务与 Codex 子 Agent 的批量执行者。视觉定位翻倍,最直接受益者是 Computer Use 这类看屏 Agent。DeepSeek 8月亦开放视觉理解 API,多模态正从卖点变成 Agent 基础设施准入项。OpenAI 补洞,把竞争从 token 单价拉向视觉可靠性。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成