摩尔线程官方宣布,摩尔线程基于AI训推一体智算卡MTT S5000及MUSA软件栈,率先完成Kimi K3的极速适配与稳定拉起。这不仅展现了MUSA软件生态面向前沿模型的快速响应与全栈协同能力。
PChome 7月29日消息,摩尔线程官方宣布,摩尔线程基于AI训推一体智算卡MTT S5000及MUSA软件栈,率先完成Kimi K3的极速适配与稳定拉起。这不仅展现了MUSA软件生态面向前沿模型的快速响应与全栈协同能力,也再次验证了国产全功能GPU支撑万亿级大模型创新的工程实力。

官方介绍,摩尔线程在模型开源后第一时间完成模型结构解析、权重加载、核心算子、缓存管理与分布式运行链路的适配,并打通从SGLang-MUSA推理框架,到MATE算子库、Triton MUSA、TileLang MUSA适配路径。MTCC编译器,MUSA运行时均高效支持SGLang JIT、DSL算子在MTT S5000上快速部署运行。KDA是Kimi K3最核心的架构创新之一。它以固定大小的递归状态压缩历史信息,减少长上下文场景下随序列长度持续增长的KV Cache压力,但也引入了与传统Attention完全不同的计算和内存管理方式。

此次实现Kimi K3的极速支持,标志着摩尔线程在极短时间内完成了对前沿架构的精准解构、全链路打通与稳定验证。在此基础上,摩尔线程将继续推进KDA融合内核、TileLang-MUSA算子优化、MUSA Graph、Prefix Cache、长上下文内存管理以及大规模PD分离等能力,持续释放Kimi K3在MTT S5000上的性能潜力。