DeepSeek又炸场了。7月31日V4-Flash正式版API悄然上线,没有发布会,只在文档更新日志里加了寥寥几行。结果2840亿总参数、130亿激活参数的MoE模型,在9项Agent和代码基准测试上全面碾压自家1.6万亿参数的V4-Pro预览版——DeepSWE从7.3分飙至54.4分,暴涨6倍多;TerminalBench 2.1拿到82.7分,逼近Claude Opus 4.8的85分。价格更狠:输入1元/百万token,输出2元,缓存命中时低至0.02元——Claude同级别输出要540元。开发者社区给这张性能-价格散点图起了个名字:"斩杀线"。落在左上角的模型,贵且弱,直接判出局。马斯克也悄悄关注了DeepSeek的X账号。当130亿激活参数能干翻1.6万亿参数的旗舰预览版,"算力即智力"的规模法则再次被动摇。