Kimi K3开源,国产算力争相跑通,但仅在推理,未达训练
7月27日23时许,Kimi K3完整权重正式开放。随着权重开放,国产AI芯片厂商迅速展开一场3T级模型适配竞赛。阿里云、华为昇腾、海光等相继宣布完成K3适配。
7月27日23时许,Kimi K3完整权重正式开放。
K3拥有2.8万亿总参数、约1040亿激活参数,采用MoE架构,拥有896个路由专家,每个Token激活其中16个,是目前参数规模最大的开放权重模型之一。
随着权重开放,国产AI芯片厂商迅速展开一场3T级模型适配竞赛。阿里云、华为昇腾、海光等相继宣布完成K3适配。
不过,对于仍处于算力紧张状态的月之暗面而言,这些新增的潜在算力能否真正进入Kimi线上生产集群,目前仍没有明确答案。

此前,K3上线后因用户请求量大幅超出预估、逼近现有集群承载极限,Kimi暂停C端新用户订阅,并表示正在推进算力扩容。
截至7月28日,距离暂停新用户会员订阅已过去一周多,会员订阅仍未全面开放。
Kimi方面向财闻表示,目前“还没有恢复会员订阅,只是预约订阅,会根据前一天的情况,开放极少量名额。”
另一边,K3开源后,国产算力平台正在密集“跑通”这款2.8万亿参数模型。
7月27日深夜,华为昇腾CANN宣布,Kimi K3已经在昇腾950PR/DT系列上实现0Day推理部署支持,相关部署方案还涉及Atlas A3系列。由于K3拥有896个路由专家,对大规模专家并行能力提出更高要求,也成为国产超节点验证集群能力的新场景。
7月28日,阿里云则宣布真武M890超节点实例完成K3 Day0适配。据披露,该超节点由64张真武M890通过高速互联组成,显存规模达到9TB。
阿里云、平头哥与Kimi团队从软件栈、算子等层面进行了联合适配,首Token时延降低约35%。阿里云同时表示,双方将进一步展开国产算力合作。
阿里方面同时向财闻表示,此次完成适配的是推理环节。
同日,海光信息也完成K3在DCU平台的适配、部署和性能验证。至此,K3已经成为国产AI芯片集中展示超大模型部署能力的一块“试金石”。
与此同时,Fireworks、SiliconFlow、Novita等平台已上线K3托管推理服务,用户可直接通过在线入口或API调用;Cursor也已将K3加入可选模型,并由Fireworks、Together AI、Baseten等第三方基础设施提供推理支持。
不过,第三方平台部署K3与进入Kimi线上生产集群并非同一概念。
财闻就月之暗面目前是否已经与华为、阿里开展相关算力合作向Kimi方面询问,Kimi方面未就这一问题回应。
目前,也没有公开信息显示,本轮Kimi扩容新增了多少算力、采用何种芯片,以及具体由哪些供应商承接。
K3技术报告同样没有提到。
报告详细介绍了3T级预训练所使用的流水线并行、专家并行、数据并行和上下文并行等基础设施方案,并披露MoonEP等集群优化技术,却没有公布预训练主集群使用的芯片型号、云服务商和集群所在地。
对于2.8万亿参数的MoE模型而言,竞争也已经不只是单颗芯片的算力。数十乃至更多计算芯片共同运行模型,对显存容量、芯片互联、专家并行和推理软件栈都提出更高要求。
盘古智库高级研究员江瀚向财闻表示,多家厂商短时间完成适配,意味着国产算力的竞争正在从单点芯片能力转向软硬件生态协同,“行业协同效率从季度级压入日级”。

