DC娱乐网

DeepSeekV4Flash正式版跑分出炉小鲸鱼是真的强,现在第三方测评平台的

DeepSeekV4Flash正式版跑分出炉小鲸鱼是真的强,现在第三方测评平台的数据也出来了。

我们看看artificialanalysis.ai的测评数据:deepseek v4 flash干到跟gpt 5.6 luna,智谱glm 5.2差不多水平了。有些评测指标上面提升了接近一倍,只能说后训练提升的太狂暴了。我之前就说过,deepseek v4预览版就是没有怎么后训练的版本,但是架构的潜力还是很大的,只要后训练拉上来,智能一定能提升上来。

这个在智谱glm 5.2和腾讯的hy3上面,都看到了后训练的威力。

这个只是评分,实际使用咋样呢?反正我这几天用的不错,跟gpt 5.6 luna的体感差不多。我也看了别人的测评。有个家伙,测了游戏,前端,后端,评论区一片声音说拉完了。结果别人在中间说,搞错了,用的思考强度是high,不是max。然后就开了max再测,这下评论区就说,还不错啊,强啊。

你看,有些人,你不套路他不行。所以,你要效果好,得把思考强度开到max。

至于说成本,嘿嘿,见图2,没有比它便宜的了。其实你们用得多的人,就会有个感觉,虽然现在模型这么多,但是智能不错,还能敞开用的,就这个模型了,没有之一。

小鲸鱼吃亏在什么地方呢?没有多模态,就看不到图,然后生成网页后,不知道根据图来调整。虽然梁文锋认为多模态不在主线,还是要搞的,不搞就吃亏。

不过,不要忘了,小鲸鱼还有个大杯的正式版没出呢。那可是1.6T的大家伙。