OpenAI Strikes Hard! GPT-5.6 Series Prices Plunge Up to 80%, AI Begins Self-Optimizing Code for Instant Leap

华尔街见闻
2026.07.31 00:58

OpenAI 宣布 GPT-5.6 系列大幅降价,Luna 模型价格暴跌 80%,Terra 下调 20%,代码检查成本降 10 倍。Sol 模型推出极速模式,速度提升 2.5 倍。新价格 7 月 30 日生效,旨在加速廉价无限使用 AI 时代的到来。

OpenAI 今天突然宣布 GPT 5.6 系列全面大降价。

最快最便宜的模型 Luna 价格直接暴跌百分之八十。主打日常办公的 Terra 模型价格也下调了百分之二十。连带应用程序里帮你检查代码的自动批准模式,成本也直接降了十倍。

此外,主打最高智商的 Sol 模型推出了极速模式。速度最高飙升两点五倍。

按照 OpenAI 说法是真正无限使用且极其廉价的 AI 时代正在加速到来。

降价细节

先看价格表,我做了个小统计

Sol 的价格没有调整,但速度上有单独的提升,也就是下面要说的快速模式。DeepSeek V4 Pro 的输入价格是缓存未命中时的报价,如果缓存命中,价格会降到 0.003625 美元每百万 token。

拿智能水平和成本一起看会更直观。第三方评测机构 Artificial Analysis 给 DeepSeek V4 Pro(Max 推理模式)打出的智能指数是 44.27 分,单个任务的成本大约是 0.0448 美元。换算成成本和智能的比值,DeepSeek V4 Pro 比 GPT-5.6 Luna High 模式高出 1.9 倍,也就是说同等智能水平下,Luna High 更划算。

新价格从 7 月 30 日开始生效,随后会陆续同步到 AWS 平台。ChatGPT 和 Codex 的订阅价格和额度都没有变化,但用 Terra 和 Luna 处理任务时,消耗的额度会更少。

一个新功能:快速模式

OpenAI 在 API 里加入了快速模式,用来替代之前的优先处理功能。

对于 Sol 来说,快速模式下的速度最高可以达到标准模式的 2.5 倍,价格是标准模式的两倍,智能水平完全没有变化。快速模式向下兼容,之前标记为优先处理的请求会自动切换到快速模式,不需要用户额外操作。

在 Codex 里,这个功能对应的是/fast 模式。

自动批准模式,成本降了十倍

针对智能体的自动批准功能 (也就是 App 里的替我审核),成本降到了原来的十分之一左右。

这个功能现在会用 Luna 模型来提前拦截高风险操作,避免主智能体直接执行可能有问题的动作。

降价的核心秘密:AI 开始自己优化自己

这么大幅度的降价和提速到底怎么做到的。

核心秘密在于模型开始自己优化自己了。

在人类工程师的带领下,Sol 模型自主重写并优化了底层生产内核。它自己设计并跑了数百个实验来提升 token 的生成效率,甚至还在监控模型训练,遇到问题直接自己介入解决。

这套操作直接让模型端到端的运行成本降低了百分之二十,token 生成效率提高了百分之十五。

底层的路由变得更聪明,软件生成 token 更高效,上下文管理也让 AI 避免了重复劳动。相同的算力现在能办更多的事。

这形成了一个正向循环:模型越强,就越能自主参与优化工作,而优化工作反过来又能让下一代模型更便宜、更高效。

谁能用上这次降价

Terra 和 Luna 在 ChatGPT Work、Codex 和 OpenAI API 里都能用。

Free 和 Go 用户可以使用 Terra,Plus、Pro、Business 和 Enterprise 用户则可以在 Terra 和 Luna 之间自由选择。

为什么要这么做

OpenAI 把这次降价放在了一个更大的思路里:根据任务的重要程度、出错代价、紧急程度和规模,匹配合适的模型。

比如一个典型的编程流程,可以先用 Sol 理清需求、定好方案,再交给 Luna 去写代码、跑测试、核对结果,这样能在保证质量的同时把整体成本压下来。

OpenAI 还表示,会继续同时投入更强的算力和更高效的算力使用方式,一边是 Luna 和 Terra 这样让大规模任务变得更便宜的路线,一边是 Sol 配合快速模式,让最重要的任务能跑得更快。

风险提示及免责条款

市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。