打开API账单的普通人,这几天会先看见一行「变便宜了」的数字。
约7月31日,OpenAI在X等平台宣布下调GPT-5.6系列价格:入门款Luna输入/输出约0.2/1.2美元每百万Token,报道称降幅约80%;主力Terra约2/12美元,约降20%;旗舰Sol保持约5/30美元,但新增Fast模式,速度最高约达标准模式2.5倍、价格约为标准模式两倍。
真正的变化不是又一次「大模型促销」,而是OpenAI把能调用工具、跑多步工作流的Agent日工价,压进过去「分类抽取小模型」的价格带——高频Agent终于更像水电费,而不是奢侈品。
先把三档价位和官方说法摊开
公开转述与中文科技媒体核对后的价目大致如下。
Luna:面向成本敏感、高并发、可工具调用与长上下文的工作负载;输入约0.2美元、输出约1.2美元每百万Token。
Terra:日常干活主力,输入约2美元、输出约12美元每百万Token。
Sol:高难度任务,原价不动;Fast模式加速约2.5倍、价格翻倍,智能水平不变,并取代部分Priority处理路径。
官方给出的降本故事很「元」。
OpenAI称GPT-5.6 Sol参与自身生产系统优化:重写与优化部分生产环境GPU Kernel、改进推测解码、参与训练监控;端到端服务成本下降约20%,Token生成效率提升约15%以上。
公司强调过程仍是「人在回路」:模型写代码、跑实验,上线与否由人定。
用中文圈流行的说法,是「左脚踩右脚」式效率飞轮的雏形——旗舰模型先把自己跑便宜,再把便宜传给中低档价目表。
订阅侧也有同步。
ChatGPT Work与Codex等:月费与总额度未必下调,但调用Terra/Luna时额度消耗按新价折算,同样一笔订阅可以多干几次活。
自动审查等后台任务切到更便宜模型,官方甚至称相关成本可降至原先约十分之一量级。
对天天跑代码审查、客服草稿、数据清洗流水线的团队,这比「旗舰又涨分」更直接:同样预算能把循环次数做上去。
三档模型:便宜的不再只会干杂活,开始进Agent流水线
为什么砍的是Luna:价格战打在Agent上
过去小模型降价,多半服务分类、抽取、排序。
这次Luna被定位为「能调用工具、执行多步任务」的高频负载——审查、监控、验证、循环试错,正是Agent账单最容易爆炸的地方。
降价80%,等于把「舍不得每分钟跑一遍」的后台智能,变成默认工序。
竞争压力同样真实。
开源与低价API持续挤压企业客户的支付意愿;闭源阵营若只守旗舰高价,份额会被中间档吃掉。
Sol原价+Fast双轨,是在守高端利润的同时,用Luna/Terra抢量。
对Anthropic等对手,社交讨论里已经出现「轮到你了」的喊话——压力在价格表,也在工作流默认选型。
模型参与降本,再把降本写进价目表,飞轮才转起来
开发者和企业可以怎么改账单
第一,分层路由。
简单高频走Luna,常规业务走Terra,难题与关键决策走Sol;别再用旗舰刷日志。
第二,重算Agent循环。
以前因贵而关掉的自动审查、回归测试、客服草稿多轮,可以按新价重新打开,但要设预算熔断与人工抽检。
第三,对照开源。
DeepSeek等低价/开源选项同周仍在刷屏;选型要看延迟、工具调用稳定性、合规与数据驻留,而不是只比美元标价。
第四,别迷信「永远降价」。
价目表可以再调;真正长期便宜的是效率飞轮是否持续,以及你自己的缓存、批处理与提示词是否浪费Token。
发票变薄时,工作流步骤往往变多,总账要重新算
这轮降价不证明什么
不证明大模型已经「白菜价到可以无限滥用」。
Sol与Fast仍然贵;质量、安全与合规成本不在Token单价里。
也不证明OpenAI已经靠模型完全自治升级——官方自己把「人在回路」写进新闻稿。
它证明的是:智能体时代的竞争,正从跑分海报,转向「每完成一次真实任务花多少钱」。
也可以顺手盯竞品是否跟降:开源模型与其他闭源API若不动价,企业路由表会更快往便宜档倾斜。
这次新闻最硬的部分可以压成几句。
Luna约降80%到0.2/1.2美元每百万Token,Terra约降20%,Sol原价加Fast。
OpenAI用旗舰优化生产系统的故事,给中低档让出价格空间。
智能体的日工价被砍进杂活区间之后,下一场考试是:谁敢把更多工作流交给便宜模型,又不出事故。