DC娱乐网

过去两年,AI基础设施的竞争主要围绕GPU数量、芯片算力、HBM带宽和高速网络展

过去两年,AI基础设施的竞争主要围绕GPU数量、芯片算力、HBM带宽和高速网络展开。

但随着大模型进入长上下文、复杂推理和多智能体阶段,决定一套系统能够产出多少有效Token的因素正在变得更加复杂。

GPU依然是算力底座,其实际利用率却越来越取决于模型权重、KV Cache和MoE专家能否在正确的时间到达正确的计算节点。 AI SSD:大模型推理的存储范式转移