GPT-5.6 API价格最高降80%,Luna定价对标上代nano,Sol新增Fast mode
OpenAI宣布GPT-5.6 API价格调整,入门款Luna降幅高达80%,Terra降价20%,旗舰Sol维持原价但新增Fast mode。OpenAI称降价源于GPT-5.6 Sol参与生产系统优化,GPU Kernel优化和推测解码改进使服务成本显著下降。同时,Codex与ChatGPT CLI中的Auto-review模型升级为Luna,预计该环节成本降至约十分之一。
事件概述
OpenAI今日宣布GPT-5.6 API价格调整,最高降幅达80%。入门款Luna价格大幅下调,主力款Terra降价20%,旗舰款Sol价格不变但新增Fast mode,加速不加价。官方表示,降价动力来自GPT-5.6 Sol参与自身生产系统优化所带来的效率提升。
核心信息
-
新价格:
- GPT-5.6 Luna:每百万Token输入0.2美元、输出1.2美元(此前分别为1美元和6美元)
- GPT-5.6 Terra:每百万Token输入2美元、输出12美元(降幅20%)
- GPT-5.6 Sol:每百万Token输入5美元、输出30美元,价格不变
-
Fast mode:Sol新增Fast mode,速度最高为标准模式2.5倍,价格为标准模式2倍,模型智能水平不变。该模式将取代此前的Priority Processing,原本使用priority标签的API请求可自动切换。
-
降价原因:GPT-5.6 Sol参与了生产环境的系统优化,包括重写和优化GPU Kernel,使端到端服务成本下降20%;改进推测解码,使Token生成效率提升15%以上。OpenAI特别强调,整个过程由人类主导,模型负责写代码、跑实验和监控异常,但目标设定、结果验证和代码上线仍需“Human in the Loop”。
-
定位变化:Luna的输入价格已与上一代GPT-5.4 nano持平,输出价格更低。但Luna并非传统简单分类/抽取模型,而是定位成本敏感型工作负载,支持工具调用、长上下文和多步工作流。这意味着支撑Agent工作的模型,已进入过去简单小模型的价位区间。
-
订阅与额度调整:ChatGPT和Codex的订阅价格不变,用户额度总量不增加,但调用Terra和Luna时消耗的额度相应减少。同时,ChatGPT和Codex CLI中的Auto-review模型从GPT-5.4升级为GPT-5.6 Luna,结合模型升级和降价,OpenAI预计该环节成本将降至原来的约十分之一。
值得关注
降价最狠的Luna面向高频、成本敏感型Agent工作流,尤其是代码审查、后台监控等需要判断和工具调用的场景。结合GPT-5.6参与自身效率优化,OpenAI正在形成“模型优化→成本下降→价格降低→更多高频调用→推动下一轮优化”的循环,长期运行Agent的门槛进一步降低。新一轮竞争压力也随之给到其他模型厂商。
