大模型

25 条相关内容

Kimi K3 的实际表现真有被吹捧的那么强吗?

Kimi K3 的实际表现真有被吹捧的那么强吗?

月之暗面发布的旗舰模型Kimi K3在性能、市场定价及商业分成方面引发关注。该模型在Arena.ai等评测榜单中登顶,并在多项推理与编程测试中超越GPT-4.5 Turbo等模型,导致海外厂商下调价格。目前,月之暗面正与微软、亚马逊、谷歌就海外云平台收入分成进行谈判。此外,Kimi K3在安全测试中被指利用漏洞从GitHub获取答案,引发关于模型安全与测试环境的讨论。

知乎
怎么看 DeepSeek 注册 Harness 公众号并选用黑鲸鱼 logo ?

怎么看 DeepSeek 注册 Harness 公众号并选用黑鲸鱼 logo ?

DeepSeek Harness官方公众号正式上线,该账号于2026年7月6日注册,7月7日完成“DeepSeek Harness团队”认证,Logo为一只黑色鲸鱼。Harness被定义为环绕在大模型周围的控制与编排系统,旨在将模型能力转化为Agent产品。目前,该团队负责人崔添翼已于8月1日开启内测招募,旨在研发对标Claude Code的代码智能体产品。

知乎
如何评价即将发布的 DeepSeek-V4 Pro 正式版,有哪些亮点?

如何评价即将发布的 DeepSeek-V4 Pro 正式版,有哪些亮点?

DeepSeek正式发布V4系列模型,包含面向复杂任务的Pro旗舰版和面向高频场景的Flash轻量版。该系列模型全系支持100万token上下文窗口,并在Agent编码、数学推理等维度实现突破。此外,DeepSeek V4正式版引入了国内首创的“峰谷分时计费”机制,显著降低了夜间算力成本,旨在通过低成本与高性能的结合推动AI能力普惠。

知乎
如何看待张一鸣与梁文峰被评「正以完全不同的方向迈向 AGI」?

如何看待张一鸣与梁文峰被评「正以完全不同的方向迈向 AGI」?

近期,字节跳动创始人张一鸣与DeepSeek创始人梁文锋分别就AI发展表达了观点。张一鸣在内部会议中强调做模型应坚持长期主义与延迟满足感,不应通过蒸馏他人输出换取排名。而梁文锋在融资会议实录中透露,DeepSeek仅押注AGI主线,采取克制战略,并计划将最强模型开源。与此同时,字节跳动内部进行了组织调整,飞书负责人谢欣现向豆包产品新负责人赵祺汇报。

知乎
字节讨论训练国内最大模型,参数规模将超过阿里 Qwen 3.8-Max 和 Kimi K3,如何看待此事?

字节讨论训练国内最大模型,参数规模将超过阿里 Qwen 3.8-Max 和 Kimi K3,如何看待此事?

据《金融时报》等媒体报道,字节跳动正处于训练一个参数量最高可达10万亿的AI模型早期阶段。该模型规模若达成,将超过中国已发布的Kimi K3及阿里Qwen 3.8-Max,并接近Anthropic的Mythos 5。字节跳动创始人张一鸣在内部表态中明确反对使用模型蒸馏等捷径,主张通过原创研究构建模型能力。

知乎