7 月 19 日,DeepSeek V4 正式版(GA)上线并开源。距离 4 月的预览版仅三个月,这次正式版带来的不只是性能提升,还有一套颠覆性的定价策略——峰谷计费。对用 AI 编程的开发者来说,这可能是目前性价比最高的选择。
两个版本,1M 上下文标配
V4 延续了双版本策略,均以 MIT 协议开源:
- V4-Pro:1.6 万亿总参数 / 490 亿激活,性能比肩顶级闭源模型,面向复杂 Agent 任务。
- V4-Flash:2840 亿总参数 / 130 亿激活,响应更快、成本更低,适合高频调用。
两个版本均标配 100 万 token 上下文,支持思考/非思考双模式,思考模式可通过 reasoning_effort 参数(high/max)调节强度。架构上采用了全新注意力机制——token 维度压缩结合 DSA 稀疏注意力,大幅降低长上下文的计算和显存开销。
编程能力:开源最强
GA 版本在编程基准上表现突出:
- SWE-bench Verified:80.6%,仅落后 Opus 4.6 的 80.8%,为开源最强。
- LiveCodeBench:93.5%。
- Codeforces Elo:3206。
实测反馈中,V4 GA 的 Agent 能力显著增强,思维链更简洁可读,不再倾倒原始代码。在 3D 生成和 SVG 输出等场景也有明显改善。
峰谷计费:AI 首个分时定价
这是本次发布最引人注目的变化。DeepSeek 引入了峰谷计费,北京时间为准:
| 时段 | 时间 |
|------|------|
| 高峰 | 每日 9:00–12:00、14:00–18:00 |
| 低谷 | 其余所有时段 |
高峰价格恰好为低谷的 2 倍。以 V4-Pro 为例(每百万 token):
- 低谷输出:$0.87(高峰 $1.74)
- 低谷输入(未命中缓存):$0.435
- 缓存命中输入:$0.0036
V4-Flash 更低:低谷输出 $0.28,输入 $0.14。对比来看,V4-Pro 低谷输出价是 GPT-5.6 Sol 的 1/34、Fable 5 的 1/57。
实操建议:把批量推理和非实时任务安排在低谷时段(晚间和午休),仅此一项就能砍掉一半 API 账单。
迁移提醒:7 月 24 日旧接口下线
这是开发者必须注意的硬期限:旧模型名 deepseek-chat 和 deepseek-reasoner 将于 2026 年 7 月 24 日 15:59 UTC 停止服务。当前这两个名称分别指向 V4-Flash 的非思考模式和思考模式。
迁移方式很简单——base_url 不变,只需将 model 参数改为 deepseek-v4-pro 或 deepseek-v4-flash。接口同时兼容 OpenAI ChatCompletions 和 Anthropic API 格式。
与编程工具的适配
V4 针对 Claude Code、OpenClaw、OpenCode、CodeBuddy 等主流 Agent 编程工具做了专项优化,在代码任务和文档生成场景表现均有提升。DeepSeek 内部也已将 V4 作为自用 Agent 编程模型,反馈体验优于 Sonnet 4.5,交付质量接近 Opus 4.6 非思考模式。
选型建议:复杂 Agent 场景用 V4-Pro 思考模式并设 reasoning_effort: max;日常补全和轻量任务用 V4-Flash 非思考模式即可,响应快且成本极低。
小结
DeepSeek V4 GA 的核心价值在于:以开源模型的身份把编程能力推到接近顶级闭源水平,同时用峰谷计费把成本压到行业最低区间。如果你的工作流重度依赖 API 调用,V4 值得立即评估——尤其别忘了 7 月 24 日的迁移截止日期。