一个月降两次价:OpenAI 这波操作,把大模型价格战打成明牌了

早上打开电脑,习惯性刷了一圈 AI 新闻,然后愣住了——OpenAI 又降价了。
是的,又。距离上一次降价才过去不到一个月,GPT-5.6 Sol 的 API 价格在 8 月 25 日再次下调。这是三十天内的第二次,节奏快得让人怀疑他们产品经理是不是把降价按钮设成了快捷键。
先看数字。GPT-5.6 Sol 的输出价格从每百万 token 30 美元降到 20 美元,降幅 33%;输入价格从 5 美元降到 4 美元,降了 20%。长上下文输出更狠,直接从 45 美元砍到 30 美元。中端的 Terra 降 20%,最便宜的 Luna 输入价从 1 美元干到 0.2 美元,输出从 6 美元降到 1.2 美元——80% 的降幅,基本就是清仓价了。
需要说明的是,这轮降价只针对按量计费的 API 部分,订阅套餐价格没动。所以普通 ChatGPT 用户感受可能不明显,但对靠 API 吃饭的开发者和创业公司来说,这是一份实打实的成本大礼包。
降价的理由,官方说法是推理内核优化了,端到端服务成本降了 20%,token 生成效率提升 15% 以上。技术进步带来成本下降,这个逻辑本身成立。但如果只看技术,就太天真了——挑时间点看看就明白了。
Anthropic 刚在 6 月递交了 S-1 文件,IPO 路演窗口正好卡在 8 到 9 月,目标 10 月上市,估值喊到 2 万亿美元。OpenAI 挑这个节骨眼对旗舰模型砍价 33%,用圈内一位博主的话说,就是明摆着冲着 Anthropic 去的。你在台上讲故事讲营收讲毛利,我在台下把行业价格锚点直接砸下去,这路演 PPT 恐怕得连夜改。
其他几家也没闲着。谷歌新发的 Gemini 3.7 Flash 直接以前代一半的价格首发,Anthropic 干脆取消了原定的涨价计划,把首发优惠价定为永久价格。再加上 7 月底 DeepSeek V4 Flash 低价入场,整个市场的价格曲线几乎是垂直往下砸。
价格战的底气从哪来?算力。OpenAI 现在锁定的算力容量超过 10 吉瓦,目标 2030 年冲到 30 吉瓦:和 Oracle 签了 3000 亿美元的合作,对应 4.5 吉瓦;和 AMD 敲定 6 吉瓦的 GPU 协议;俄亥俄州又锁定 8 吉瓦。这套打法本质是个飞轮——效率提升,成本下降,于是降价,拉来更多用户和收入,再回头砸钱建算力,循环往复。而另一边,英伟达刚宣布 Groq 3 LPX 全面量产,还和 Poolside 签了 60 亿美元的授权协议。基础设施的军备竞赛越猛,token 的边际成本就越低,降价这事儿只会越来越频繁。
对我们这些用 AI 的人来说,这件事比听起来重要得多。
第一个受益的是智能体(Agent)应用。Agent 最大的痛点从来不是不够聪明,而是太烧钱——一个复杂任务动辄几十轮调用,token 像流水一样淌出去。现在旗舰模型输出价一个月降了 33%,入门模型降了 80%,很多原本算不过账的场景瞬间成立了。OpenAI 自家的 Codex 周活跃用户刚突破 2000 万,不是没有原因的。
第二个信号是,应用层的黄金窗口真的来了。模型调用成本占运营成本的比重持续走低,意味着创业公司可以把省下来的钱花在产品打磨和获客上。去年大家还在讨论 AI 应用会不会被模型厂商顺手碾掉,今年的现实是:模型厂商打得越凶,做应用的日子越好过。低价就是最好的创业补贴。
第三个变化在企业侧。过去两年,企业 AI 落地卡在一个尴尬的位置:试点项目人人愿意做,一到规模化就因为成本失控被 CFO 否掉。模型价格一路下行之后,这类项目的总拥有成本被大幅拉低,很多去年算不过账的内部工具——智能客服、文档流水线、代码辅助——今年的预算表突然就绿了。降价潮真正的意义,不是让某个极客省了几美元,而是把 AI 从演示阶段推向了日常生产。
当然也别高兴太早。降价公告里藏着一行小字:OpenAI 正在调查 Codex 额度消耗过快的反馈,并明确禁止订阅账号转售和多人共享。羊毛可以薅,规则的口子正在收紧。
我个人的判断是,token 正在重走十年前移动流量的老路——从按 KB 计费的奢侈品,变成无限量套餐的日用品。当年流量降价催生了短视频和移动支付的爆发,这一轮 token 降价,会催生什么?现在没人能给出准确答案,但方向已经清楚了:凡是今天因为太贵而做不成的 AI 产品,都值得重新算一遍账。
明天早上醒来,说不定又有一家降价了。这个行业的精彩之处就在于,你永远不用等太久。