8 月 5 日,海外 AI 巨头集体低头:OpenAI 把 GPT-5.6 Luna 的价格一刀砍下 80%,中端 Terra 降 20%;谷歌紧急推出平价轻量化 Gemini 新品;Anthropic 不敢直接降价,只能"同价升级性能"变相跟上。
这不是一次常规的促销,而是被百亿价差逼到墙角的防守战。
发生了什么:中国 AI 的"8 周闪电战"
彭博社 8 月 4 日的报道把过去两个月称为中国 AI 的密集攻势:阿里 Qwen3.8-Max、月之暗面 Kimi K3、DeepSeek V4 Flash、智谱 GLM-5.2、字节 Seedance 2.5,五款重磅模型在八周内接连亮相,多项全球基准追平甚至反超美国旗舰。
真正让硅谷脊背发凉的不是性能,是价格。Artificial Analysis 实测显示:完成同样的复杂工作负载,DeepSeek 只需 0.03 美元,Claude Fable 5 要 3.15 美元——价差超过 100 倍。
调用量的天平已经倾斜。OpenRouter 周报显示,7 月 27 日至 8 月 2 日这一周,全球调用量前五名全是中国模型:DeepSeek-V4-Flash 以 7.22 万亿 Token 登顶,小米 MiMo-V2.5、腾讯 Hy3、DeepSeek-V4-Pro、智谱 GLM-5.2 紧随其后。中国模型周调用量已连续 14 周超过美国。
"DeepSeek 死亡地带":中端模型最难活
Artificial Analysis 那张广为流传的坐标图(横轴性能、纵轴价格)上,DeepSeek 用极致性价比划出了一片"死亡地带":同样的价钱性能不如它,同样的性能价钱贵过它,落在这个区间的产品等于白做。
这就是 Luna 降价 80% 的直接原因。值得注意的是,降价确实立竿见影:Luna 周调用量环比暴涨 456%,以 1.95 万亿 Token 首次登榜第八。价格武器依然有效,只是这次挥刀的方向是朝着自己。
降价能赢吗?先看看谁在给 OpenAI 输血
这场价格战最微妙的背景是:7 月 31 日,亚马逊刚披露完成对 OpenAI 总计 500 亿美元的全额投资。也就是说,OpenAI 敢把 Luna 砍到地板价,靠的是史上罕见的资本输血,而不是成本结构真的追上了对手。
行业现状是:巨头们算力投入巨大、普遍持续亏损,大幅降价进一步压缩盈利空间。中国模型的低价来自架构效率、电力成本和工程优化的结构性优势;美国巨头的低价来自补贴。一个是成本,一个是烧钱,持久战的结局不难推演。
更值得注意的是,连 Anthropic 都选择了"同价升级"而不是跟降——前沿旗舰的溢价窗口还在,但中端和轻量市场已经守不住了。行业正在分裂成两层:靠资本硬撑的旗舰层,和被中国模型重新定义价格的走量层。
开发者现在该做的四件事
第一,重新谈价。你的供应商刚降价 80%,如果你还按上个月的合同付费,现在就是谈判窗口期。所有 API 合同都应该加上"价格随行就市"条款,别签锁价长约。
第二,按工作负载分层选型。Agent 批量任务、日志处理、初稿生成这类走量场景,DeepSeek-V4-Flash 这个级别的模型已经把成本打到原来的几十分之一;只有真正需要旗舰能力的环节才值得付溢价。
第三,实测后再迁移,别看榜单搬家。注意 DeepSeek 类模型有"费 Token"的特性,单价便宜不代表总账便宜。用自己的真实工作负载跑一周,对比"每任务总成本"而不是"每 Token 单价"。
第四,盯 Agent 工作负载的专项优化。上海 ZenGen Labs 的判断很准:DeepSeek V4 Flash 真正改变游戏规则的地方是 Agent 场景。模型调用正在从"人问一句"变成"Agent 自动跑几百步",走量层的定价权决定 Agent 经济的成本底座。
写在最后
两年前美国巨头靠性能代差收"智能税",如今中国模型用体系化的持续产出证明:接近顶尖水平的模型是可以被低成本复制的。当供给不再稀缺,定价权就会易主。
对开发者来说,这是最好的时代——巨头打架,用户得利。但记住一点:补贴式的低价不会永远持续,把架构做成"模型可替换",比押注任何一家的价格承诺都重要。