Kimi K3模型发布及其技术特性

2026年7月16日,月之暗面发布了全球最大开源模型Kimi K3。该模型总参数量达2.8万亿,原生支持视觉理解能力及100万token上下文窗口。在架构上,Kimi K3采用混合专家架构(MoE),在处理每个token时仅激活896个专家中的16个,以提高计算效率。

Kimi K3引入了三大自研核心架构:首先是KDA注意力机制,通过将标准二次注意力替换为线性混合注意力,使解码速度提升6倍,KV缓存内存需求降低75%;其次是注意力残差结构,允许Transformer层选择性检索早期层表征,在额外计算开销不到2%的情况下,将训练效率提升约25%。由于处于芯片受限环境,团队通过工程优化将整体扩展效率比前代K2提升约2.5倍。

性能评测与行业对比

在编程能力方面,Kimi K3在由伯克利团队运营的Arena.ai Frontend Code Arena代码榜中获得1679分,排名第一,分别比Claude Fable 5高48分,比GPT-5.6 Sol高61分。在7个前端子领域中,Kimi K3在其中6个排名第一。此外,在SWE Marathon多步软件工程测试中,Kimi K3得分为42.0,领先于GPT-5.6 Sol和Claude Fable 5。

在综合智能方面,Artificial Analysis的独立评测显示,Kimi K3综合智能评分为57分,位列全球第三,仅次于Claude Fable 5(60分)和GPT-5.6 Sol(59分)。

商业模式与市场影响

在定价方面,Kimi K3的API定价为每百万输入token 3美元、输出token 15美元,约为美国闭源模型的30%-40%。

该模型的发布在行业内引发关注。AI评测平台Arena联合创始人Anastasios Angelopoulos认为这可能是“今年最重要的一次模型发布”。美国AI研究者内森·兰伯特(Nathan Lambert)判断,中美模型差距已从此前普遍认为的6-9个月缩短至3-5个月。他指出,中国AI实验室的资本效率远高于美国,倾向于通过高效追赶策略以更低成本打造竞争力模型。

后续安排与行业动态

Kimi K3定于7月27日正式开源。与此同时,阿里计划开源2.4万亿参数的Qwen3.8-Max,DeepSeek-V4正式版也预计在月底发布。

针对开源趋势,Meta、英伟达、微软等25家美国科技公司于7月24日联名签署公开信,呼吁开放权重AI模型。但在美国内部也存在分歧,OpenAI与Anthropic高管提出了“威胁论”,部分人士向白宫呼吁“封杀”。