DC娱乐网

DeepSeek跑分距Claude只差0.1分,报价砍到了五十七分之一 8

DeepSeek跑分距Claude只差0.1分,报价砍到了五十七分之一

8月12日深夜,两个小时内,DeepSeek V4 Pro和Grok 4.6接连发布。

一个1.6T参数,一个1.5T参数,两家都在同一晚把刀架到了Claude Fable 5的脖子上。

DeepSeek这边,Terminal Bench 2.1跑分从预览版的72.1直接冲到87.9,而Claude Fable 5是88.0——只差0.1分。

价格呢?Fable 5的API是百万token输入10美元、输出50美元。DeepSeek是输入0.43美元、输出0.87美元,缓存命中输入只要0.0036美元。

算下来,输出便宜57倍,缓存输入差了快276倍。

Grok更直接。GDPVal-AA v2拿到1753分,反超GPT-5.6 Sol的1728和Fable 5 Max的1741,三项测试排第一。报价输入2美元、输出6美元,比Fable 5便宜5到8倍。

有人氪了300美元开SuperGrok Heavy,连着开发4个小时、开了一堆Agent调研,周额度只掉了1%。

这不是又一次"国产模型追赶"的老故事。真正的变化是:过去大模型有个不可能三角——性能、价格、速度,你只能挑两个。聪明的又贵又慢,便宜的差一截,快的烧钱。

这一晚,DeepSeek用价格把三角撕开,Grok用速度把三角填满。夹在中间那些既没性价比、又没性能突破的模型,定价体系一夜之间全作废了。

马斯克已经放话Grok 4.7三到四周后发,要超越所有模型。梁文锋那边连涨价预告都发过了。

这两家不是在抢用户,是在联手重新画一条行业的及格线。打不过这条线的模型,连被比价的资格都没有。



DeepSeek Grok Claude AI大模型