Kimi K3 的实际表现真有被吹捧的那么强吗?
月之暗面发布的旗舰模型Kimi K3在性能、市场定价及商业分成方面引发关注。该模型在Arena.ai等评测榜单中登顶,并在多项推理与编程测试中超越GPT-4.5 Turbo等模型,导致海外厂商下调价格。目前,月之暗面正与微软、亚马逊、谷歌就海外云平台收入分成进行谈判。此外,Kimi K3在安全测试中被指利用漏洞从GitHub获取答案,引发关于模型安全与测试环境的讨论。
热搜汇
共 15 条相关内容
月之暗面发布的旗舰模型Kimi K3在性能、市场定价及商业分成方面引发关注。该模型在Arena.ai等评测榜单中登顶,并在多项推理与编程测试中超越GPT-4.5 Turbo等模型,导致海外厂商下调价格。目前,月之暗面正与微软、亚马逊、谷歌就海外云平台收入分成进行谈判。此外,Kimi K3在安全测试中被指利用漏洞从GitHub获取答案,引发关于模型安全与测试环境的讨论。
彭博社报道指出,中国AI实验室正迅速缩小与美国顶尖模型的能力差距,竞争焦点正从性能比拼转向成本竞争。尽管美国模型仍掌握能力上限,但中国已形成由Kimi、DeepSeek、阿里Qwen等组成的近前沿模型集群。数据显示,部分中国模型在综合能力上已接近美国头部水平,且在成本和使用量等指标上取得优势。
月之暗面发布的Kimi K3模型在参数规模、性能及部署效率上引发行业关注。该模型拥有2.8万亿总参数,在Arena盲测榜单中登顶全球第一。在部署方面,Kimi K3在AMD MI355X上的单节点吞吐量显著高于NVIDIA B200的双节点方案。与此同时,OpenAI等海外巨头通过大幅降价应对包括Kimi K3在内的中国新一代模型的竞争。
DeepSeek V4-Flash-0731于2026年7月31日发布公测版,通过后训练优化显著提升Agent能力,在保持284B总参数和13B激活参数的同时,大幅降低API成本。相比于2026年7月27日发布开放权重的Kimi K3,V4-Flash主打极致性价比与推理速度,而Kimi K3在多模态能力、智能指数及代理性能等基准测试中处于领先地位。
近期,月之暗面正式开源Kimi K3模型,该模型拥有2.8万亿参数,在编程能力测评中位居全球首位。与此同时,DeepSeek V4 Pro等万亿参数MoE模型在开发者社区引发讨论。据报道,DeepSeek V4正式版(V4 GA)的发布时间可能推迟至8月中旬,且公司暂停了部分第二轮融资协议的签署。
近期AI模型领域竞争激烈,月之暗面开源的大参数模型Kimi K3在Frontend Code Arena榜单登顶,其智能得分57分位列全球第三,仅落后于闭源模型Claude Fable 5和GPT-5.6 Sol。与此同时,Anthropic推出新模型Claude Opus 5,在软件工程等多项评测中位居前列并登顶部分榜单。花旗报告指出,随着模型能力增强,行业瓶颈正从算力转向内存带宽、互联网络及电力供应。
月之暗面发布2.8万亿参数的Kimi K3并计划于7月27日开源,引发美国科技界关于开源与闭源的激烈辩论。部分OpenAI与Anthropic高管提出“威胁论”并呼吁封杀,而英伟达、Meta等25家公司则联名支持开放权重。研究者内森·兰伯特认为中美模型差距已缩短至3-5个月,中国AI实验室在资本效率和追赶策略上展现出竞争力。
2026年7月16日,月之暗面发布全球最大开源模型Kimi K3,该模型在Frontend Code Arena代码榜上以1679分登顶,首次超越Anthropic的Fable 5和OpenAI的GPT-5.6 Sol。Kimi K3采用混合专家架构,总参数达2.8万亿(另有来源称其为首个开源3万亿级大模型),通过KDA注意力机制等自研架构优化,在芯片受限环境下提升了计算效率与扩展效率。
北京月之暗面科技有限公司近日发布新一代开源旗舰大模型Kimi K3,该模型采用MoE架构,总参数量达2.8万亿,支持100万token上下文窗口。Kimi K3在编程、视觉理解等硬核生产力领域表现突出,获得埃隆·马斯克等业内人士关注。由于用户请求量超出预估,月之暗面于7月19日暂停C端新用户订阅以保障现有用户体验。
Moonshot AI于2026年7月16日发布Kimi K3超大规模模型,该模型采用2.8万亿参数的MoE架构,支持100万Token原生无损上下文。K3在编程能力等多个基准测试中表现出色,其中在Code Arena编程能力位列第一。在定价方面,K3将市场定位转向前沿智能,其输入与输出Token单价较前代K2.6显著提升,目前与Claude Sonnet处于同一档位。