模型发布与核心规格

2026年7月16日,月之暗面正式发布Kimi K3模型。该模型参数规模达2.8万亿,被定义为全球首个万亿级开源大模型。在架构上,Kimi K3采用Stable LatentMoE混合专家架构,拥有896个专家模块,但每次推理仅激活16个,激活比例低于2%。此外,该模型原生支持100万token的上下文窗口。

技术创新与性能表现

Kimi K3在技术层面上实现了三项自研突破:

  • Kimi Delta Attention (KDA):一种混合线性注意力机制,旨在解决超长任务中的性能衰减问题。
  • Attention Residuals (注意力残差):优化了多层网络间的信息传递,使推理效率提升约25%。该技术由苏剑林、张宇及17岁实习生陈广宇共同研究。
  • Stable LatentMoE:配合Moon Clip二阶优化器,在同等性能下使训练成本和算力功耗减半。

在性能方面,官方数据显示K3在长程编码和复杂工程任务上稳定位居全球第三,个别维度登顶。在多项主流测评中,其得分超过了GPT-5.6和Fable 5。美国企业家埃隆·马斯克在第三方评测中评价其为“Impressive(令人印象深刻)”。

用户体验与争议

尽管技术指标领先,但Kimi K3在实际体验中存在短板。部分用户吐槽其生成速度慢,例如在视频剪辑任务中耗时近两个小时,且在面对虚构问题时会出现“硬编答案”的幻觉现象。分析认为,速度问题可能与2.8万亿参数的计算量、默认开启的深度思考模式及基础设施扩容不足有关。

市场影响与定价

Kimi K3的定价策略引发业界讨论。其未缓存输入价格为20元/百万Token,输出为100元/百万Token。根据不同来源数据,其输入价格约为22元/百万Token,输出约为109元/百万Token。高盛在研报中认为这标志着中国模型走向定价权的全新节点。

在资本市场方面,K3发布后,英伟达、谷歌、Meta、英特尔等科技巨头股价走低。港股市场中,智谱单日下跌28.49%,MiniMax下跌15.62%,华创证券研报指出K3的发布是上述股价调整的重要原因。