如何评价腾讯混元 8 月 28 日发布并开源新一代大语言模型 Hy4 preview?实际体验如何?
8月28日,腾讯发布并开源新一代大语言模型Hy4 preview,该模型总参数770B,激活参数49B,上下文长度突破1M。Hy4 preview定位为“为生产力而生”,在软件工程、办公分析、游戏开发及科学研究等真实生产力任务上取得显著进步。目前该模型已在腾讯云TokenHub、OpenRouter及元宝、ima等产品上线。
热搜汇
共 16 条相关内容
8月28日,腾讯发布并开源新一代大语言模型Hy4 preview,该模型总参数770B,激活参数49B,上下文长度突破1M。Hy4 preview定位为“为生产力而生”,在软件工程、办公分析、游戏开发及科学研究等真实生产力任务上取得显著进步。目前该模型已在腾讯云TokenHub、OpenRouter及元宝、ima等产品上线。
阿里巴巴千问团队于2026年8月开源Qwen3.8-27B原生多模态大模型。该模型基于Qwen3.5架构,在编程、智能体执行及多模态理解方面有显著提升,被业内视为“开源模型的新一代斩杀线”。其支持超长上下文及灵活的思考模式,且兼容vLLM等主流推理框架,可在本地私有化部署以降低Token成本。
阿里巴巴开源多模态AI模型Qwen3.8-27B,该模型拥有约270亿参数,支持图像理解且可在高性能笔记本等本地设备运行。该模型在Hugging Face全球大模型趋势榜登顶,开源两天下载量突破100万次。实测显示其在编程、视觉定位及代码代理方面表现出色,但默认的“深度思考”设置会导致响应速度明显变慢。
当地时间8月11日,英伟达发布首款开源模型Nemotron 3.5 Lightning,该模型主打轻量高效,可在单块GPU上运行,面向AI智能体应用场景并向全球开发者免费开放。此次发布是在CEO黄仁勋公开支持开源模型后推出的。此外,据内部人士消息,英伟达正研发参数量达万亿级别的Nemotron 4开源大模型。
DeepSeek正式发布V4系列模型,包含面向复杂任务的Pro旗舰版和面向高频场景的Flash轻量版。该系列模型全系支持100万token上下文窗口,并在Agent编码、数学推理等维度实现突破。此外,DeepSeek V4正式版引入了国内首创的“峰谷分时计费”机制,显著降低了夜间算力成本,旨在通过低成本与高性能的结合推动AI能力普惠。
7月31日,华为正式开源基于昇腾NPU训练的盘古MoE大模型openPangu-2.0-Pro,涵盖模型权重、基础推理代码及技术报告。该模型总参数规模为5050亿,支持512K上下文长度。华为旨在通过昇腾原生训练与推理技术,为业界提供最佳实践参考,助力打造Agent时代智能底座并加速商业创新。
近期,月之暗面正式开源Kimi K3模型,该模型拥有2.8万亿参数,在编程能力测评中位居全球首位。与此同时,DeepSeek V4 Pro等万亿参数MoE模型在开发者社区引发讨论。据报道,DeepSeek V4正式版(V4 GA)的发布时间可能推迟至8月中旬,且公司暂停了部分第二轮融资协议的签署。
近期中国开源AI模型的快速进步引发美国国内关于是否应封禁此类模型的辩论。月之暗面Kimi K3等模型的发布被认为缩短了中美模型差距。对此,英伟达CEO黄仁勋及Meta、微软等25家科技公司联名呼吁开放权重AI模型,反对过早限制。黄仁勋认为开源模型能扩大市场并增强安全性,且美国公司应被允许使用中国模型。
近期AI模型领域竞争激烈,月之暗面开源的大参数模型Kimi K3在Frontend Code Arena榜单登顶,其智能得分57分位列全球第三,仅落后于闭源模型Claude Fable 5和GPT-5.6 Sol。与此同时,Anthropic推出新模型Claude Opus 5,在软件工程等多项评测中位居前列并登顶部分榜单。花旗报告指出,随着模型能力增强,行业瓶颈正从算力转向内存带宽、互联网络及电力供应。
月之暗面发布2.8万亿参数的Kimi K3并计划于7月27日开源,引发美国科技界关于开源与闭源的激烈辩论。部分OpenAI与Anthropic高管提出“威胁论”并呼吁封杀,而英伟达、Meta等25家公司则联名支持开放权重。研究者内森·兰伯特认为中美模型差距已缩短至3-5个月,中国AI实验室在资本效率和追赶策略上展现出竞争力。