DC娱乐网

贾清扬团队优化的专为 GLM 5.2 设计的推理引擎,在 2 个 Grace B

贾清扬团队优化的专为 GLM 5.2 设计的推理引擎,在 2 个 Grace Blackwell 节点上能跑到102 至 647 tokens/秒的吞吐量。不过没说开不开源