关键词: Kimi K3 月之暗面 国产算力 昇腾芯片 AI算力
7月17日,月之暗面正式发布新一代大模型Kimi K3。7月19日,月之暗面决定即日起暂停C端新用户订阅,将已有算力全部投入服务已订阅用户,确保已订阅用户权益不受影响。同时,团队已在全速推进算力扩容,待新算力陆续到位后将逐步开放更多订阅名额,直至全面恢复正常订阅。
值得注意的是,月之暗面在公告中披露,对于后续新订阅用户,将拆分Kimi主权益(包含Kimi Web、Kimi APP、Kimi Work)和Kimi Code权益,以便更精准匹配算力,保障用户体验。这一举措表明,公司正通过精细化运营来优化现有算力资源的配置效率。

Kimi K3发布后迅速引发市场强烈反响。该模型参数规模达2.8万亿,基于KDA混合线性注意力机制与注意力残差技术构建,采用896选16超稀疏MoE架构,原生支持视觉理解,拥有100万token上下文窗口,是全球首个开源的3万亿级别模型。
在Arena综合文本排名中,该模型以1679分登顶前端代码竞技场,超越Claude Fable 5,相比前代产品实现从第18名到第1名的跨越式提升。在前端领域,该模型在品牌与营销、参考设计、数据与分析等7个细分方向中的6个均排名第一。
月之暗面官方表示,K3在多项公开编程及智能体基准测试中超越OpenAI和Anthropic旗舰产品,且成本较同类美国顶级模型低约40%。编程单次成本约0.94美元,不到海外顶尖模型的一半。
公开信息显示,月之暗面前代模型K2的训练曾在配备英伟达H800 GPU的集群上完成。H800是英伟达专供中国市场的出口管制合规型号,其NVLink带宽被降至400GB/s,相较H100的900GB/s有明显缩减。
在推理部署层面,官方建议至少64卡超节点才能部署K3。超节点由64-1024张国产加速卡通过高速互联组成,有媒体分析,Atlas950SuperPoD(1024张昇腾950)为官方推荐首选国产算力,已完成K3全链路适配,但月之暗面官方未披露相关信息。

服务器层面,据产业链消息,浪潮信息为Kimi训练集群核心供应商,推出NF5488A6超节点,支持64张国产加速卡。中科曙光“曙光8000”十万卡超集群适配超大模型训练。
Kimi K3引发的算力危机,客观上成为国产GPU产业链的重要催化剂。摩根士丹利数据显示,中国AI芯片自给率已从2021年的约10%跃升至2026年的41%,预计2030年将进一步达到约86%。
当前国产AI算力芯片形成三条主要技术路线。华为昇腾采用自研达芬奇架构,昇腾910B FP16算力达320TFLOPS,配备64GB HBM2e显存,支持集群扩展至万卡规模。海光信息DCU系列凭借类CUDA的DTK软件栈生态,在金融、云计算领域实现规模化部署。寒武纪思元590依托第五代MLUarch架构,在Transformer模型优化上展现独特优势,其MLU-Link2.0互联协议升级片间通信能力,单卡显存带宽约1.6TB/s。
资本开支数据印证了算力扩容的确定性。2026年,国内四大云厂商合计资本开支约4300-4400亿元,其中字节跳动约1600亿元(同比+40%),阿里巴巴约1500亿元,腾讯约800-900亿元,百度约400-500亿元。运营商方面,中国移动2026年算力网络资本开支预计为378亿元,同比增长62.4%。
在基础设施层面,K3必须部署于高端智算中心,传统IDC机柜密度已无法满足需求。据市场消息,润泽科技为月之暗面长期专属智算机房服务商,机柜上架率直接受益算力扩容;亚康股份负责Kimi服务器上架与集群运维。随着国产大模型与国产芯片的"Day 0适配"成为行业常态,算力扩容已从"替代预期"转向"业绩验证"阶段。
Kimi K3的算力危机与高盛此前的预判形成鲜明张力。高盛合伙人Rich Privorotsky曾警告,"算力扩张时代"或已走向终结,AI估值逻辑面临重塑。然而Kimi的实际经历揭示:即便通过算法效率绕开算力军备竞赛,一旦模型性能真正获得市场认可,算力需求依然会以更猛烈的方式反弹。
低成本模型降低了使用门槛,反而可能在需求端制造更大的算力缺口。此次算力危机不仅验证了K3的市场吸引力,也为国产GPU产业链提供了明确的业绩验证信号。
来源:电子工程专辑