7月23日到24日,48小时内发生了两件事,看似无关,实则指向同一个结论:模型本身已经不值钱了,值钱的是你被锁进哪条管道。
第一件事:阿里发布Qwen3-Coder旗舰代码模型并开源,随即宣布通义灵码(现已升级为Qoder CN)全面接入该模型,面向全球开发者提供免费不限量服务。通义灵码累计下载量已超2000万次,一汽、蔚来等上万家企业已接入。同期披露,阿里内部已全面停用Claude Code,改用基于Qwen3-Coder底座的自研代码智能体Qoder完成全栈替代——理由很直白:海外厂商可随时调整地区管控策略切断API访问,供应链稳定性不能交到别人手里。
第二件事:7月24日,Anthropic发布Claude Opus 5。SWE-bench Verified跑分96%到97%,SWE-bench Pro从Opus 4.8的69.2%跳到79.2%,FrontierBench v0.1 agentic coding 43.3%——反超自家更贵的Fable 5(33.7%)。定价却与Opus 4.8持平:每百万Token输入5美元、输出25美元,被官方定位为"以Fable 5一半的价格逼近其能力"。
一边是把旗舰代码模型彻底免费,一边是把旗舰推理模型半价屠榜。两种操作,一个共同的前提判断:模型的绝对能力差距正在缩小,靠"我的模型最聪明"收订阅费的时代结束了。
免费的不是模型,是你的迁移成本
阿里敢把花了千万美元训练的顶级代码模型白送,不是因为做慈善。通义灵码免费、Qwen3-Coder开源,这些都不直接产生收入。但如果你在通义灵码上写代码,调试环节会调用阿里云算力,部署会用阿里云容器服务,数据存储会落到阿里云数据库,API调用会走阿里云网关——代码模型是入口,云计算才是变现通道。铲子白送,挖出来的金子归矿主。
腾讯和字节走的是同一条路。腾讯用CodeBuddy IDE接入CloudBase和Supabase,字节用Coze带动火山引擎算力消耗。三家大厂的底层逻辑完全一致:AI编程工具不赚钱,但AI编程工具带动的云计算消费能赚钱。
这意味着独立AI编程工具的好日子到头了。Cursor Pro每月20美元,GitHub Copilot每月10美元,Claude Code Pro每月25美元——当阿里的免费方案在Agentic Coding上已经追平闭源旗舰时,凭什么让开发者继续掏钱?答案只能是"入口粘性"和"工作流锁定",而这恰恰是大厂正在用免费模型疯狂抢占的东西。
半价的也不是模型,是你的注意力
Anthropic的Opus 5走的是另一条路。它没有免费,但用"半价逼近Fable 5"的定位,把旗舰能力的价格锚往下拉了一截。更值得注意的是几个工程细节:1M上下文窗口成为默认配置,effort dial五档可调(low到max按需控制算力投入),mid-conversation工具变更不再需要重开会话,自动fallback到备用模型保证长任务不断线——这些都在降低你在Claude Code里长期作业的摩擦力。
翻译成开发者的语言:Anthropic不指望你因为Opus 5更聪明而留下,它指望你因为"在Claude Code里改工具不用重开会话""长任务自动降级不怕断线"而离不开这套工作流。锁定的对象从模型能力换成了工程体验。
两种策略,殊途同归:模型是诱饵,你的工作流和数据闭环才是猎物。
你该往哪站
第一,把"免费"当先行指标,不是终点站。 某个模型突然免费或半价,说明它的能力边际正在被追平。趁窗口期用足,但别把整个工具链绑死在单一供应商上——今天的免费,是明天的"过路费"。阿里白送模型的终极目的是让你把代码、构建、部署全链路搬上阿里云;Anthropic半价卖模型的终极目的是让你离不开Claude Code的工作流。两种锁定,你至少得留出跳船的余地。
第二,把供应链风险写进选型表。 阿里内部停用Claude Code不是个例。工信部7月已点名Claude Code后门风险,阿里7月10日全员禁用,海外模型随时可能因出口管制、地区策略调整而停服。你的AI编程工具如果不可替代,那就是一个单点故障。选型时问自己一句:这个工具明天断服,我的研发流水线停几小时?
第三,留一条开源退路。 Qwen3-Coder、DeepSeek V4、Kimi K3都已开源或开放权重,能力已逼近闭源旗舰。至少把CLAUDE.md、AGENTS.md等上下文配置写成跨工具兼容格式——AGENTS.md正是为多工具共享规则而设计的标准。确保切换成本只是换个客户端、改一行模型ID,而不是重写整个工作流。
模型不值钱了。但谁拥有你的上下文、你的工作流习惯、你的代码库访问权,谁就拥有未来几年的"过路费"。这件事,现在就该想清楚。