DC娱乐网

深夜双王开炸!梁文锋和马斯克,几乎在同一时刻掀了桌子。 8月12日晚,DeepS

深夜双王开炸!梁文锋和马斯克,几乎在同一时刻掀了桌子。
8月12日晚,DeepSeek官网API文档悄然换版,V4 Pro预览版切换为正式版DeepSeek-V4-Pro-0813。
差不多同一时间,马斯克旗下团队甩出Grok 4.6,两款主攻智能体的旗舰正面撞车。
这场对轰释放了三个信号,值得所有开发者盯紧。
第一个信号,是国产模型真的挤进了第一梯队。
V4 Pro没动架构,只靠重新后训练,多项Agent测试就大幅跃升。
终端操作测试Terminal-Bench 2.1拿到87.9分,距顶尖的Fable 5只差0.1分。
软件工程测试DeepSWE从预览版的12.8分暴涨到62.7分,接近原来的4.9倍。
Grok 4.6也不含糊,综合智能指数61分追平GPT-5.6 Sol,法律任务Harvey LAB更是拿下15.8%,把对手远远甩开。
第二个信号,是价格的天花板被彻底捅破。
海外旗舰输出价还停在每百万Token几十美元,Fable 5要50美元。
DeepSeek只标0.87美元,约为Grok 4.6的七分之一、Fable 5的五十七分之一。
摩根士丹利也点破了这层变化:中美大模型价差正在收窄,竞争重点从价格战转向智力战。
第三个信号,是实测里两者已难分伯仲。
有博主用同一套提示词跑Flappy Bird,DeepSeek消耗2万Token、成本0.019美元,成品的场景层次和操作反馈明显更细。
Grok则在60种Bento卡片设计上扳回一城,排版配色更成熟。
当然V4 Pro也没有场场封神,画鹈鹕时把运动方向画反了,樱花树的光影细节也不及GPT-5.6和Claude。
看完这场对垒,我的判断是:顶尖智能不再高不可攀,才是这次真正的分水岭。
过去开发者只能在用不起和不够强之间硬选,如今低价高能第一次走到了一起。
值得留意的是,DeepSeek已预告近期会整体上调API定价,涨幅较大,这波红利窗口未必长久。
马斯克那边也放话Grok 4.7马上就来,这场以小时为单位的竞速,才刚刚开始。