OpenAI正式向全球用户开放GPT-5.6「全系列模型」,同时ChatGPT与Codex完成深度融合,全新生产力平台ChatGPT Work强势登场。
终于来了!
就在今日,OpenAI一次性发布GPT-5.6三大核心模型——Sol、Terra、Luna,全面开放给所有用户。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜


毫不夸张地说,Sol此次直接对标Claude Fable 5:
· Agents' Last Exam:Sol斩获53.6%,领先Fable 5达13.1分;
· Terminal-Bench 2.1:Sol得分88.8%,启用Ultra模式后跃升至91.9%,而Fable 5仅为83.1%;
· Coding Agent Index:Sol以80分刷新行业最高纪录(SOTA),高出Fable 5整整2.8分。
更震撼的是定价策略——
Fable 5每百万token输入收费$10、输出$50;
Sol直接腰斩,仅需$5与$30;Terra再降一半至$2.5与$15;Luna则低至$1与$6。

同日,ChatGPT与Codex正式合并,OpenAI“超级智能应用”时代正式开启。
自此,统一入口、统一平台——只保留一个ChatGPT。

GPT-5.6,全面上线
自6月27日首次亮相以来,万众期待的GPT-5.6终于全面开放。
Sol、Terra、Luna三款模型悉数上线,无一缺席。
旗舰Sol(太阳):专攻高难度编码、专业级知识处理、网络安全及科研攻坚任务,被公认为当前最强通用模型。
Terra(大地)+ Luna(月亮):聚焦极致成本效益,在保持高性能的同时大幅压缩使用开销。

全面压制Fable 5,编程能力登顶新王
先看最硬核的编程能力,OpenAI将Sol定义为“史上最强编程模型”。
在Artificial Analysis Coding Agent Index评测中,Sol启用max推理模式获得80分,刷新SOTA纪录,领先Fable 5达2.8分。
同时,其输出token减少近半、响应时间缩短超50%、综合成本降低约三分之一。

这种优势覆盖全系模型:Terra表现略优于Fable 5,Luna则已超越Opus 4.8。
且三者均仅需约1/3的执行时间、约一半的输出token、约1/4的费用即可完成同等任务。
在考验终端长周期工程能力的Terminal-Bench 2.1与DeepSWE测试中,Sol同样刷新多项SOTA。


多Agent协同作战,Ultra模式正式启用
若单模型性能仍不足,那就调用多个。
本次GPT-5.6新增两大高阶推理配置——
max档:相较原有xhigh模式,赋予模型更充裕的推理时间;
ultra档:默认调度四个Agent并行运行,复杂任务可扩展至十六个Agent协同处理。
以更多token投入,换取更强结果质量与更快交付效率。
在BrowseComp、SEC‑Bench Pro、Terminal‑Bench 2.1三项关键评测中,引入并行Agent后,“分数‑耗时”曲线整体左移——更高分、更快速。



本代GPT‑5.6还悄然补齐了一项长期短板——视觉审美与设计能力。
它能自主“观察”渲染效果,识别界面与功能缺陷,并主动优化修正,最终交付完整可用成果。
如下图所示,GPT‑5.6独立完成的航海小游戏、博物馆官网、室内设计方案等,均展现出设计能力质的飞跃。

GPT-5.6在“端到端知识工作”场景中的表现同样惊艳。
Sol在BrowseComp中达92.2%、在OSWorld 2.0中达62.6%,双双刷新SOTA。
尤其在OSWorld上,不仅超越Opus 4.8,更将输出token减少85%。
通过本地 Codex 或 OpenClaw OAuth 凭证直接调用 ChatGPT/Codex Responses 的 image_generation 工具来生成或编辑光栅图像,然后保存




GPT‑5.6炼就自身
OpenAI「AI自我进化引擎」落地成真
GPT‑5.6最具未来感的一面,正发生在OpenAI内部实验室中。
官方明确表示,GPT‑5.6是目前加速AI研发效率最强的模型。

研究人员用它诊断系统故障、优化训练架构、执行实验、解析结果数据。
在GPT‑5.6内测阶段,每位活跃研究员的日均输出token量,达到GPT‑5.5峰值水平的两倍以上。
更惊人的是,过去半年间,OpenAI投向内部编程推理研究的算力占比飙升100倍,内部Agent调用token总量增长约22倍。

在一套衡量“递归式自我改进(RSI)”的内部评估体系中,Sol比GPT‑5.5高出16.2分。
简言之,OpenAI正用AI驱动下一代AI的研发进程。

发布会现场,研究人员透露了一个关键细节——
最小的Luna模型,正是由Sol亲自完成后续训练!

整个流程如下:只需输入初步需求,Sol便自动完成训练配置筛选、GPU资源调度、启动脚本生成与全流程验证,实现从零开始的模型后训练闭环。
这项工作过去需要整支资深工程师团队协作完成。
如今,那个“全自动AI研究员”,已不再遥远。

这或许正是当下AI狂奔时代最有力的注解。
ChatGPT与Codex
正式合二为一
就在今日,ChatGPT桌面端迎来重磅升级。
新增原生浏览器支持与Computer Use功能,可直接访问本地文件、调用应用程序,实现点击、输入、文件搬运等真实操作。
真正的转折点在于:原Codex应用已完全整合进新版ChatGPT桌面端!



伴随GPT-5.6同步发布的另一款重量级产品,正是ChatGPT Work。
这是一个具备跨App与跨文件协同能力的智能Agent,可持续数小时专注推进单一项目,将目标真正落地为成品。
它堪称OpenAI打造的“Claude Cowork”本土化版本!

同样支持通过手机端ChatGPT远程操控。
即便电脑不在身边,工作流依然无缝延续。

从预览版到全量发布,仅用半个月;从技术追赶,到全面反超,OpenAI仅凭一场发布会便完成跨越。
但真正令人震撼的并非榜单排名,而是Sol亲手训练出Luna这一事实。
当AI开始训练AI,时间维度已被彻底改写。
竞赛的终点线正在消融,剩下的,只是下一个版本号。
参考资料:
https://www.php.cn/link/f535640eb9d804cee5b539fdd800d8b3
https://www.php.cn/link/03934d845075fb92a3a221dbe9b197a1
本文来自微信公众号“新智元”,作者:ASI启示录,编辑:桃子 摩西,36氪经授权发布。

















