DC娱乐网

v4 flash 快赶上opus4.8了

今天 DeepSeek V4-Flash 正式公测。我翻了一遍 benchmark,有一个数字让我来回看了好几遍。

DeepSWE 从 7.3 涨到了 54.4。

不是微调,不是新架构,也不是更大的模型。284B total,13B activated,参数一个没动。就是后训练,把 DeepSWE 从 7.3 拉到54.4,翻了七倍多。

只看 Flash 自己 Preview 到 0731 的变化,结论也够清楚了:后训练的杠杆效应,比大多数人以为的大得多。

过去一年聊模型能力提升,话题基本围着"搞大模型"和"推理时多算"转。后训练一直被当"对齐""安全"的配套活,很少人把它当能力提升的主线。

DeepSeek 这次等于说:把后训练做好了,一个 13B 激活的模型在 Agent 场景下能做的事,比你预想的大一个量级。(加上scaling law 不得炸)

对小团队来说,这其实是好消息。不是只有烧钱训大模型这一条路。