Kimi K3开源模型表现与市场定位
月之暗面最新开源的大参数模型Kimi K3在发布后登顶Frontend Code Arena榜单。该模型规模达到2.8万亿级。根据花旗7月24日发布的报告,Kimi K3的智能得分为57分,位列全球第三,仅落后于闭源模型Claude Fable 5(60分)和OpenAI GPT-5.6 Sol(59分)。在开源阵营中,Kimi K3将此前开源最高分从Z.ai GLM-5.2的51分提升至57分。
在实际能力测试方面,AI编程社区通过复刻5款经典3D游戏对Kimi K3与GPT-5.6 Sol进行了对比。测试结果显示,Kimi K3在部分游戏开发中仅实现核心对战,缺乏选关、暂停、星星评价及胜场统计等功能,而GPT-5.6 Sol则包含了这些界面与统计功能。此外,月之暗面官方表示,Kimi K3的整体表现仍落后于Claude Fable 5和GPT-5.6 Sol等最强闭源模型。
行业竞争与基础设施瓶颈
花旗分析指出,AI大模型在能力提升的同时,物理基础设施正面临极限。目前,超大模型运行时的瓶颈已从矩阵运算速度(FLOPs)转向内存带宽、GPU互联和电力供应,大量时间被消耗在跨HBM内存和GPU互联网络搬运权重及KV-cache数据上。
基础设施压力导致相关成本上升:Blackwell GPU租金年初至今上涨27%;以Kimi K3为代表的中国前沿模型定价在单周内跳涨45%。为应对电力短缺,部分实验室开始直接投资发电设备,例如SpaceX于7月15日斥资10亿美元购买1GW移动涡轮机组,并于7月22日与Georgia Power签署服务协议。
其他前沿模型动态
Anthropic于7月25日凌晨推出了新模型Claude Opus 5。该模型在软件工程、商业流程和电脑操作评测中位居前列,在Frontier-Bench v0.1测试中超过所有参测模型,且成绩比Opus 4.8提高一倍以上。Opus 5提供了可调节的思考档位(effort),用户可根据任务难度调整资源投入。其API价格为每百万Token输入5美元、输出25美元,约为Fable 5的一半。
此外,Google在7月21日发布了Gemini 3.6 Flash,并透露Gemini 3.5 Pro仍在测试中,Gemini 4的预训练已经启动。
评论区
已通过 0 条 · 审核通过后展示