仅仅一周时间,AI 编程模型的定价体系被彻底重构了。
Anthropic 发了 Opus 5,半价拿到接近 Fable 5 的性能。Frontier-Bench 分数是 Opus 4.8 的两倍多,IMO 2026 满分 42/42。输入 5、输出 25 美元/百万 token。等于把旗舰价格直接腰斩。
xAI 的 Grok 4.5 正式入驻 GitHub Copilot 和 Cursor,输入只要 2 美元、输出 6 美元,不到 Fable 5 的十分之一。两个月前还只能在 Grok Build 里用,现在铺到全球最主流的两个编程平台上了。
而 DeepSeek V4 早就把开源地板价打到 Flash 版输入 0.14 美元、输出 0.56 美元。MIT 协议,百万上下文。
从最贵到最便宜,同一个任务输出价格差了 89 倍。
这还不是最关键的。真正有意思的是,Copilot 开始支持多模型切换了,Cursor 也同时跑多个底座。模型不再是壁垒,路由和编排才是。
几个判断:模型能力天花板已经不是竞争焦点。编程 Agent 会迎来第二波爆发,因为单任务成本降了两个数量级。多模型路由会成为基础架构。
7 月 29 号 DeepSeek V4 正式版延到 8 月中,Harness 开启内测。如果 V4 正式版 SWE-bench 冲到 65%+,配上地板价和百万上下文,开源模型足够好且足够便宜就不只是判断了。是现实。
AI编程 ClaudeOpus5 Grok45 DeepSeekV4 性价比横评
