7月9日,OpenAI 正式发布了 GPT-5.6 模型家族——包含旗舰模型 Sol、均衡模型 Terra 和高性价比模型 Luna 三款。这是 OpenAI 迄今为止最强大的模型系列,在编程、知识工作、网络安全和科学研究等多个领域刷新了基准测试记录,同时将每美元智能产出提升到了新高度。
从发布到全面上线仅用了13天,GPT-5.6 的推出速度本身就说明了 OpenAI 对这款模型的信心。
三款模型,覆盖从旗舰到极致性价比
GPT-5.6 采用新的命名体系:数字代表代际(5.6),而 Sol、Terra、Luna 则是持久的能力层级。这种设计让不同预算和需求的用户都能找到合适的模型。
Sol 是旗舰模型,定价为每百万 token 输入5美元、输出30美元,在编码、网络安全和科学研究等硬核任务上表现出色。Terra 定价输入2.5美元、输出15美元,性能与 GPT-5.5 相当,适合日常工作。Luna 则以输入1美元、输出6美元的价格,提供了超越 Claude Opus 4.8 的能力。
效率革命:更少 token,更多智能
GPT-5.6 最引人注目的不是单纯的能力提升,而是效率的飞跃。在 Agents' Last Exam(涵盖55个专业领域的长期智能体工作流评估)中,Sol 以53.6%的成绩领先 Claude Fable 5 达13.1个百分点,而成本仅为后者的约四分之一。
在编码领域,Sol 在 Artificial Analysis Coding Agent Index 上创下80分的新纪录,比 Fable 5 高出2.8分,同时使用的输出 token 不到后者的一半,耗时不到一半,成本降低约三分之一。更令人印象深刻的是,Terra 和 Luna 分别以约四分之一的成本超越了 Fable 5 和 Opus 4.8。
Ultra 模式:多智能体并行协作
GPT-5.6 引入了一种全新的工作模式——Ultra。它默认协调四个智能体并行处理任务,通过更高的 token 消耗换取更强的结果和更快的完成速度。在 BrowseComp、SEC-Bench Pro 和 Terminal-Bench 2.1 等评估中,多智能体配置一致地将分数-延迟前沿向上和向左推移,在更短时间内达到更强的结果。
开发者可以通过 Responses API 中的多智能体测试版构建类似 Ultra 的体验。这意味着复杂的工程任务、安全审计或科学研究工作流可以以前所未有的速度推进。
设计能力的质变
对于关注工业设计和产品开发的读者来说,GPT-5.6 在设计能力上的进步尤其值得关注。OpenAI 称其带来了"设计判断力的阶跃变化"——仅凭高层级指令,GPT-5.6 就能创建出美观、人体工学且功能完备的界面。
更强的计算机使用能力让它能够检查和优化渲染后的结果,而不仅仅是生成代码。在 Figma 的测试中,GPT-5.6 让团队能够将复杂设计转化为交互原型。Canva 的评价是它在幻灯片创建方面比竞品模型强约1.6倍的 token 效率。这对于医疗器械界面设计、产品原型快速迭代等场景有着直接的应用价值。
网络安全与科学研究:突破性进展
在网络安全领域,GPT-5.6 是 OpenAI 迄今最强的安全模型。在 ExploitBench 上,它以73.5%的成绩大幅超越 GPT-5.5 的47.9%;在 ExploitGym 上,将真实漏洞转化为可用攻击的成功率几乎翻倍。但 OpenAI 强调,模型在防御任务(安全代码审查、补丁、威胁建模)上的表现更为突出。
在生命科学领域,GPT-5.6 在 GeneBench Pro、LifeSciBench 和 MedChemBench 上均展现出对 GPT-5.5 的帕累托改进。这对于生物医学研究和医疗器械开发领域的从业者来说,意味着更强大的AI辅助研究工具即将到来。
自我改进的加速器
一个特别值得关注的信号是,OpenAI 在内部研究中大量使用 GPT-5.6 来加速AI研究本身——诊断训练失败、优化内核、运行实验、解释结果。在内部研究调试评估中,Sol 比 GPT-5.5 高出18.3个百分点。过去六个月,内部编码推理的计算份额增长了100倍,智能体 token 使用量增长了约22倍。
这种"AI加速AI研究"的飞轮效应正在自我强化,预示着未来模型迭代的速度可能进一步加快。
GPT-5.6 的核心启示:AI 模型竞争的焦点正从"谁更聪明"转向"谁更高效"。Sol 以更少的 token、更低的成本实现了超越竞品的能力,这意味着同等预算下可以完成更多有价值的工作。对于产品开发者和研究者而言,AI 工具的性价比拐点已经到来。
GPT-5.6 现已通过 ChatGPT、Codex 和 OpenAI API 全面上线。ChatGPT Plus、Pro、Business 和 Enterprise 用户可以通过中等及以上推理设置访问 Sol 模型。API 开发者可以通过 Responses API 使用 Programmatic Tool Calling 和多智能体功能。
参考来源:OpenAI 官方博客《GPT-5.6: Frontier intelligence that scales with your ambition》,2026年7月9日。
- 作者:lee
- 链接:https://ligan.cc/article/openai-gpt-5-6-multi-agent
- 声明:本文采用 CC BY-NC-SA 4.0 许可协议,转载请注明出处。







