阿里发布Qwen3.8Flash 阿里今晚放出新王炸,Qwen3.8‑Flash 正式亮相!作为多模态 MoE 模型,总参数规模 125B,实际每 token 只激活 6B,训练开销直接压到上一代 Qwen3.7‑Plus 的 1/9,这个算力控制做得是真的厉害。
简单说就是用很小的运行成本,拿到大模型的实力,编程、办公任务反而还更强,还支持百万级超长上下文,多模态也一并拿下。
以往大模型想要能力强,就得烧大量算力,成本居高不下。而这次千问这套架构,相当于把 “强性能” 和 “低成本” 同时攥手里,不管是普通用户办公写材料,还是开发者写代码做二次开发,都很吃香。
既能把训练推理成本打下来,能力还不缩水,国产大模型在性价比这条赛道又往前狠狠迈了一步,期待后续实际上手的表现!



