DC娱乐网

最近深度体验了一下deepseek v4 flash 0731和Qwen3.8

最近深度体验了一下deepseek v4 flash 0731和Qwen3.8 flash。我就不拿b站的有些让AI画画、做小游戏这些蛋痛的娱乐测试了,就是那手头上已经商业化的软件项目,做重后端复杂业务逻辑的实战。让相同的AI Agent根据需求,先出计划,再改代码,基本90%的代码都是后台处理。

直接拿的阿里正规的团队版token plan的api测试,因为里面这两模型都有,方便在同一基准下做对比。deepseek v4 flash跑起来快很多,Qwen3.8 flash对于复杂内容的业务,明显思考的步骤和关联的检查的要比deepseek v4 flash内容更多,总体时间也明显要多一些。deepseek v4 flash现在单价要贵一些,但思索深度一般,消耗的少;Qwen3.8 flash单价更便宜,但思索深度大,消耗的多。

总的来说,对于要AI处理一个来小时的中等任务,二者总成本其实差不多,感觉差距也就20%,Qwen3.8 flash贵一点,基本可以忽略。如果用 Deepseek 官方的,那肯定还是 Deepseek 总价会高一些。

代码最终成果上Qwen3.8 flash更好一些,也更健壮,有时候更广和更深度的思考确实对于复杂业务有帮助。

后面再等一个哪家的团队版api同时有Qwen3.8 flash和GLM5.3 flash的。