Kimi K3登顶全球代码榜单
2026年7月16日,月之暗面发布了全球最大开源模型Kimi K3。在由伯克利团队运营、基于真实开发者匿名投票的Arena.ai Frontend Code Arena代码榜单中,Kimi K3以1679分排名第一,分别比Claude Fable 5高出48分,比GPT-5.6 Sol高出61分。这是中国大模型首次获得该榜单榜首位置,且在7个前端子领域中的6个排名第一。此外,在SWE Marathon多步软件工程测试中,Kimi K3得分为42.0,领先于GPT-5.6 Sol(领先5分)和Claude Fable 5(领先7分)。
技术架构与性能突破
Kimi K3总参数量为2.8万亿(另有来源表述为全球首个开源的3万亿级大模型),原生支持视觉理解能力及100万token上下文窗口。该模型采用混合专家架构,在处理每个token时仅激活896个专家中的16个。
在核心架构方面,Kimi K3实现了三大自研突破:
- KDA注意力机制:将标准二次注意力替换为线性混合注意力,使解码速度提升6倍,KV缓存内存需求降低75%。
- 注意力残差结构:允许Transformer层从任意早期层选择性检索表征,在额外计算开销不到2%的情况下,将训练效率提升约25%。
- 扩展效率优化:在芯片受限环境下,通过工程优化将整体扩展效率比上一代K2提升约2.5倍。
Artificial Analysis的独立评测显示,Kimi K3的综合智能评分为57分,位列全球第三,仅次于Claude Fable 5(60分)和GPT-5.6 Sol(59分)。
商业模式与产业背景
在定价方面,Kimi K3的API每百万输入token定价3美元,输出token定价15美元,约为美国闭源模型的30%-40%。
针对技术发展背景,法国《世界报》指出,中国工程师在芯片受限的情况下更注重算法优化和资源利用效率,大量采用“专家混合”等先进架构以降低计算成本。这种“倒逼式创新”使研发重心从硬件堆叠转向算法优化、架构创新和算力调度。摩根士丹利数据显示,中国AI芯片自给率已从2021年的约10%跃升至2026年的41%,并预测2030年将提升至约86%。
评论区
已通过 0 条 · 审核通过后展示