GPT-5.6 Luna 的输入价格从 1 美元/百万 token 降至 0.2 美元,输出从 6 美元降至 1.2 美元,降幅达 80%。上线仅三周,OpenAI 就对其旗舰模型进行了大幅降价。更值得关注的是降价的原因——GPT-5.6 Sol 通过自主编写代码优化了推理效率,将运行成本降低 20%,省下的成本直接补贴给用户。

OpenAI 在 7 月 30 日发布的技术博客详细解释了 GPT-5.6 如何同时实现"更强"和"更便宜"。核心突破在于:Sol 使用 Codex 自主重写了 OpenAI 生产环境的 GPU 内核代码,采用 Triton 和 Gluon 两种开源 GPU 编程语言。修改后的内核使整体推理成本降低了 20%,且通过了开源验证工具 FpSan 的正确性验证。
推测解码优化与自主训练修复
除了内核优化,Sol 还自主设计并执行了数百个实验来优化"推测解码"技术——一种让小模型先预测 token、大模型再批量验证的加速方法。Sol 调整了小模型的架构、大小和特性,使 token 生成效率提升超过 15%。训练过程中遇到硬件故障和不稳定情况时,Sol 选择自主排查和修复,无需人类介入。

这是 AI 模型首次在生产环境中自主完成代码优化和训练修复的完整闭环。以前只有人类工程师能干的活,现在模型自己完成了。
Luna 降价 80%,性价比碾压竞品
GPT-5.6 系列本次调价分为三档:
- GPT-5.6 Luna:输入 0.2 美元(原 1 美元),输出 1.2 美元(原 6 美元),降幅 80%
- GPT-5.6 Terra:输入 2 美元(原 2.5 美元),输出 12 美元(原 15 美元),降幅 20%
- GPT-5.6 Sol:价格不变,新增 Fast 快速模式,速度快 2.5 倍,价格翻倍,模型能力不变

降价后的 Luna 在性价比上优势明显:Claude Haiku 4.5 输入价 1 美元/百万 token,Luna 仅需 0.2 美元,便宜 5 倍。GPT-5.6 Terra 输入价 2 美元,低于 Claude Sonnet 4.6 的 3 美元。同时 Luna 在 Agents' Last Exam 上的成绩超过了 Claude Fable 5,单任务成本降低约 99%。
Replit CEO Michele Catasta 评价:"GPT-5.6 Luna is the closest we've come to intelligence too cheap to meter."——这是我们离"智能便宜到白菜价"最近的一次。
OpenRouter 再加码五折
在 OpenAI 降价的基础上,OpenRouter 进一步将 Luna 价格打五折:输入 0.1 美元、输出 0.6 美元。这个价格处理大批量任务极具吸引力。

AI 自主研究:一条提示词完成全套工作
OpenAI 研究员给 GPT-5.6 Sol 一条"相当模糊"的提示词——找到合适的训练配置、选好 GPU、启动训练脚本、确认一切正常。Sol 完整完成了所有步骤:选 GPU、配置参数、启动训练、验证结果,中间训练出问题时还能自主排查和修复。
OpenAI 研究员 Kathy Shi 表示:"以前这些工作需要一个高级研究团队忙好几周,现在已经非常接近自动化研究了。"Sol 在 OpenAI 内部的递归自改进基准测试上比 GPT-5.5 高出 16.2 分。

1306 名 AI 大厂员工呼吁踩刹车
就在降价两天前,来自 OpenAI、Anthropic、谷歌 DeepMind、Meta 等公司的 1306 名 AI 员工签署公开信,呼吁政府介入控制 AI 发展速度。公开信指出:"AI 自动化研究的加速可能快到我们来不及理解和控制。"签名名单包括 OpenAI 首席研究官 Mark Chen、Anthropic CEO Dario Amodei,以及 Safe Superintelligence 的 Ilya Sutskever。
苏米注:OpenAI 一边让 AI 自主优化自身能力,一边参与签署公开信呼吁踩刹车——这种"离奇的闭环"恰恰反映了当前 AI 行业的矛盾状态:技术能力正在超越人类的控制预期,而商业化竞争又推动着各家公司不得不加速前进。GPT-5.6 Luna 的 80% 降价只是一个开始,当 AI 能够自己降低自己的运行成本时,价格战将不再是人类主导的游戏。