DC娱乐网

摩尔线程已经完成 Kimi K3 的适配。7 月 27 日,摩尔线程基于AI训推

摩尔线程已经完成 Kimi K3 的适配。

7 月 27 日,摩尔线程基于AI训推一体智算卡MTT S5000及MUSA软件栈,率先完成Kimi K3的极速适配与稳定拉起。

这不仅展现了MUSA软件生态面向前沿模型的快速响应与全栈协同能力,也再次验证了国产全功能GPU支撑万亿级大模型创新的工程实力。

摩尔线程在模型开源后第一时间完成模型结构解析、权重加载、核心算子、缓存管理与分布式运行链路的适配,并打通从SGLang-MUSA推理框架,到MATE算子库、Triton MUSA、TileLang MUSA适配路径。MTCC编译器,MUSA运行时均高效支持SGLang JIT、DSL算子在MTT S5000上快速部署运行。

面对KimiK3官方MXFP4 checkpoint,摩尔线程设计了加载期在线逐层量化方案,无需离线转换,为Day-0快速拉起K3模型推理提供了关键支撑。

在MTT S5000平台上,Kimi K3已经完成模型加载、服务启动和基础推理链路验证。运行过程中,Prefill和Decode节点,MTT S5000均展现出卓越的计算承载力,系统全程稳定运行,显存管控高效。

此次实现Kimi K3的极速支持,标志着摩尔线程在极短时间内完成了对前沿架构的精准解构、全链路打通与稳定验证。在此基础上,摩尔线程将继续推进KDA融合内核、TileLang-MUSA算子优化、MUSA Graph、Prefix Cache、长上下文内存管理以及大规模PD分离等能力,持续释放Kimi K3在MTT S5000上的性能潜力。

未来,摩尔线程将继续依托MUSA软件栈强大的生态兼容性,持续在第一时间拥抱并赋能前沿大模型生态,以高性能、可规模化的全功能GPU基础设施,加速AGI技术的创新与产业化落地。

308_IO摩尔线程