2026年7月的第三周,可能是中国AI行业历史上最密集的一周。
7月16日,月之暗面发布 Kimi K3——2.8万亿参数,全球最大开源模型。72小时内,用户请求量指数级爆发,直接把服务器干崩。7月19日深夜,月之暗面被迫发公告:暂停 C 端新用户订阅。
7月21日凌晨,阿里千问发布 Qwen3.8-Max 预览版——2.4万亿参数,100万上下文,免费开源,官方定调"能力仅次于 Fable 5"。
7月21日,DeepSeek V4 满血版正式发布。带着业界首创的峰谷计费——推理价格按时段动态浮动,V4 Flash 谷期每百万输出 Token 只要 0.28 美元,不到 Fable 5 的 1%。
三件事连在一起看,一条主线就出来了:中国 AI 不再是追赶者,它在改写价格规则、开源规则和竞争规则。
K3:一个开源模型,因为太受欢迎而被迫"关门"
这件事本身就够魔幻。
月之暗面发布 K3 的时候,核心卖点是"全球参数最大的开源模型"。2.8万亿参数,自研 KDA 混合线性注意力机制,100万 Token 上下文窗口。
然后发生了什么?全球开发者涌进来,K3 在 Code Arena 榜单上发布几小时就登顶,以 1679 分超越了 Claude Fable 5 的 1631 分。这是中国大模型第一次拿下这个榜单的榜首。
Vercel 创始人公布的评测结果显示 K3 代码任务成功率达 92%。OpenRouter 上排名几小时内冲到 Top 3。Anthropic 在 K3 发布后不到 24 小时,紧急把 Fable 5 从限量测试改为永久可用。
这不是"我们本来就计划这么做"——这是被逼的。
当一个开源的中国模型在多个基准上逼近甚至部分超越付费旗舰,你还不把旗舰放开,就没人等了。
然后月之暗面自己的服务器撑不住了。48 小时内用户请求量指数级增长,逼近集群承载极限。团队发公告暂停新用户订阅,把所有算力优先服务已有用户。
一个模型因为太火被迫"关门",这在 AI 行业是第一次。这背后藏着一个被低估的信号:全球开发者对中国大模型的需求,已经进入了连创始团队自己都猝不及防的爆发期。
华尔街把这个叫"Kimi 时刻"。月之暗面同步启动了赴港 IPO,估值 315 亿美元。
V4:把 AI 推理做成"峰谷电价"
DeepSeek 走的是另一条路。
V4 满血版的定价逻辑在整个 AI 行业找不到先例。V4 Pro:百万输出 Token 平时 0.87 美元,高峰期 1.74 美元。V4 Flash:平时 0.28 美元,高峰期 0.56 美元。
这不是固定价格,不是订阅制,而是像电力市场一样的动态计价。
这件事背后有一个更大的判断:AI 推理正在从"奢侈品"变成"基础设施"。当一个城市的用电量可以精确预测、用户已经离不开电的时候,动态计价就比统一定价更能优化资源配置。DeepSeek 把同一套逻辑套在 AI 推理上,说明它认为 AI 推理已经到了"谁都不能不用"的阶段。
而且峰谷计费天然利好中国时区的开发者。全球 API 调用高峰集中在美西白天——对东亚用户来说正好是深夜,是 DeepSeek 的低谷时段。一个北京团队在晚上 12 点跑批量评测,花的钱不到 Fable 5 的 1%。
这不是商业手段,这是结构性优势。
性能方面,V4 整体接近 Claude Opus 4.8 级别,编码能力直追 GPT-5.6 Sol。Agent 能力有大幅增强,3D 和 SVG 生成明显提升。民间验货口诀也传开了——看到思考链里出现"I'm"而非"Let me",就是接入 V4 正式版了。
Qwen3.8:免费到底,把天花板往上捅
同一天凌晨,阿里默默把一颗更大的炸弹扔了出来。
Qwen3.8-Max 预览版——2.4 万亿参数、100 万上下文、向所有用户免费开放。官方定调直接对准 Fable 5:"能力仅次于 Fable 5"。
参数规模是 GPT-5.5 的 1.6 倍,是 Claude Opus 4.8 的 2 倍。在参数这个维度上,Qwen3.8-Max 是目前公开模型中体量最大的之一。而且用了最宽松的开源协议,允许自由下载、修改和商用部署。
2.4 万亿参数的模型,免费给你用——半年前没有人会相信这句话。
三件事,一条主线
把 Kimi K3、DeepSeek V4、Qwen3.8 连起来,不是"三个中国模型发布了"那么简单。
K3 负责向上突破天花板——全球最大开源模型、Code Arena 登顶、逼 Anthropic 紧急开放 Fable 5。V4 负责向下压成本——峰谷计费把推理成本打到 Fable 5 的 1%,让 AI 推理按"电价"来算。Qwen3.8 负责把门槛踩平——2.4 万亿参数、免费开源、随便商用。
一个往上捅天花板,一个往下压成本,一个把门全部打开。
这不是"中国模型在追赶"的叙事,这是"中国模型在重新定义竞争规则"的叙事。
对于 AI 编程开发者来说,这件事最直接的影响很简单:你手里的模型选择正在爆炸式增长,而且成本在断崖式下降。一个月前,你的默认选项可能是 Fable 5 或 GPT-5.6,价格是固定的。现在,你有三个中国开源旗舰可选,其中两个免费、一个按峰谷计价。
多模型路由不再是"未来趋势",而是"今天就该做的事"。白天用 V4 Pro 跑实时任务,晚上用 V4 Flash 批量处理,复杂工程切到 K3 或 Qwen3.8。哪家的成本低、哪家擅长什么任务,这应该是你工具箱里的基础配置,而不是加分项。
中国 AI 这一周做的事,本质上是把牌桌上"闭源+高价"的默认规则,换成了"开源+低价+分层定价"的新规则。
Anthropic 和 OpenAI 当然不会坐视不管。但当一个全球开发者社区已经通过真金白银和 GitHub Star 投了票——K3 暂停注册、V4 热搜登顶、Qwen3.8 开源协议被连夜下载——规则就已经被改写了。
不是因为谁说了什么,而是因为开发者用脚投了票。