人人都会AI编程

DeepSeek V4把Fable 5价格打到1/57,Kimi K3用2.8万亿参数抢了5个全球第一

更新时间:2026-07-22

7月17日和7月19日,48小时内,中国两家AI公司各放了一颗炸弹。月之暗面发布Kimi K3,2.8万亿参数,全球最大开源模型,在5项编程评测中拿下世界第一;DeepSeek发布V4正式版,SWE-bench 80.6%,性能逼近Opus 4.8,但价格只有Fable 5的1/57。一个问"AI编程能多强",一个问"AI编程能多便宜"。这不是两个产品的竞争,是两种哲学的碰撞。

DeepSeek V4:把定价锚连根拔起

先说数据。V4正式版(GA)7月19日上线,1.6万亿参数,100万Token上下文,MIT开源协议。SWE-bench Verified 80.6%,只比Opus 4.6的80.8%低0.2个百分点;LiveCodeBench 93.5分,开源模型第一;Codeforces Rating 3206,接近顶尖竞赛选手水平。开发者实测评价:整体接近Opus 4.8级别,编码能力直追GPT-5.6 Sol。

真正让行业炸锅的是价格。V4引入了AI行业首个"峰谷计费"——借鉴电力市场的分时定价。非高峰时段,V4 Pro输出0.87美元/百万Token,V4 Flash输出0.28美元/百万Token。对比Fable 5的50美元、GPT-5.6 Sol的30美元、Kimi K3的15美元,V4 Flash的价格是Fable 5的1/178。高峰时段(北京时间9-12点和14-18点)翻倍,但仍是闭源旗舰的零头。缓存命中后,输入成本再降两个数量级,V4 Flash缓存命中输入只要0.0028美元/百万Token。

发布72小时内,V4的API被调用超过1.2亿次,其中83%来自月消费不到50美元的小团队和个人开发者。用V4的人在跑量。

Kimi K3:2.8万亿参数不是答案,是问题

K3走了完全相反的路。2.8万亿参数,896个专家网络中每次激活16个,原生支持100万Token上下文和视觉理解。架构上用自研的Kimi Delta Attention将长上下文拆解为"已总结的历史"和"新增变化",让百万Token场景下的解码速度最高提升6.3倍。

成绩单足够亮眼。Arena.ai前端代码竞技场1679分登顶全球第一,超过Fable 5的1631分和GPT-5.6 Sol的1618分;SWE Marathon 42.0分全球第一,碾压GPT-5.6 Sol的39.0和Fable 5的35.0;Program Bench 77.8分全球第一;FrontierSWE 81.2分,比GPT-5.6 Sol高9.9分;Terminal Bench 2.1得分88.3。

K3的API定价3美元/15美元(缓存未命中输入/输出),编码场景缓存命中率超过90%,有效输入成本可降到0.30美元/百万Token。但单次调用平均Token消耗是V4的4.7倍——用K3的人在攻坚。

K3的权重将在7月27日完整开源,这意味着你可以私有化部署一个在多项编程评测中超越GPT-5.6 Sol的模型。但2.8万亿参数的部署门槛极高,推荐配置需要64个以上加速器,中小团队难以独立承担。同时,有测试指出K3的幻觉率偏高,在事实准确性上仍落后于闭源旗舰。华泰证券研究报告认为,K3的Coding能力已进入全球前沿梯队,国产模型与海外的差距正在明显收窄,但整体仍落后于Fable 5和GPT-5.6 Sol。

两条路,你走哪条

对用AI编程的开发者来说,这两条路不是二选一,而是分层使用。

日常编码和批量任务,用V4。 非高峰时段跑Agent循环、代码审查、批量重构,V4 Flash的成本低到可以忽略。一个每天让AI跑8小时代码审查的团队,月账单从1200美元(Opus)降到22美元。把不需要顶级推理能力的任务全卸载到V4上,这是用量端的降本。

复杂架构推理和长周期工程任务,用K3。 K3在FrontierSWE、SWE Marathon等长周期评测中领先,说明它擅长处理需要多步推理、仓库级理解和持续工具调用的任务。但产出必须人工审查——它的幻觉问题意味着你不能盲信它的每行代码。另外,Claude Code创始人Boris Cherny在7月20日的访谈中透露,Anthropic内部约90%的代码已由Claude Code完成,他本人同时运行几百个Agent、每天发几十个PR。当模型能力足够强时,瓶颈从"代码质量"转移到了"任务编排"。V4和K3都具备被编排的能力,关键是你会不会用。

关键判断:跑分不是选型标准,成本结构才是。 V4和K3的发布说明一个问题——开源模型已经能在特定维度上超越闭源旗舰,而且价格低一到两个数量级。当性能差距缩小到个位数百分比,选模型的决策因素从"谁更聪明"变成了"谁更划算"。

7月27日K3权重开源,7月24日V4旧端点关闭。两个日期之间,中国AI编程的两条路都走到了关键路口。你不需要站队,但你需要重新算账。