DC娱乐网

2万亿大模型开始跑超节点了 2 万亿参数的大模型,已经开始嫌一张卡,甚至一台服务

2万亿大模型开始跑超节点了
2 万亿参数的大模型,已经开始嫌一张卡,甚至一台服务器太小了。

8 月 12 日,阿里云正式上线灵骏真武 M890 超节点实例,首批在乌兰察布开售。

一套实例里面有 64 张卡。

阿里云称,这是国内首个成功运行超 2 万亿参数大模型的超节点形态算力,Kimi K3 和 Qwen3.8 Max 已经通过它对外提供服务。

更夸张的是,2 万亿还不是上限。

官方给出的能力是,单个超节点最高可以承载十万亿参数级 MoE 大模型推理。

我觉得这个数字真正有意思的地方,不是大模型又变大了。

而是「一台计算机」正在重新被定义。

以前一台机器里的 GPU 不够,就跨服务器通信。但模型越大,几十张卡之间交换的数据越恐怖,通信本身开始成为瓶颈。

所以 M890 干脆把 Scale-up 从 16 卡扩到了 64 卡,卡间互联达到 800GB/s。

把 64 张卡尽量做得像一张巨大的卡。

说真的,这可能就是超节点突然变热的原因。

模型还在继续膨胀,算力已经不能只靠堆更多机器解决。

得先想办法,让更多芯片真的像一台机器一样工作。

过去大家卷的是谁能训练出更大的模型。

现在连承载这些模型的「电脑」,都得跟着一起重新造。大模型 多模态人工智能 算法 人工智能 科技 人工智能替代人工 超节点