大模型

24 条相关内容

如何看待 DeepSeek 8 月 6 日公告称即将大幅度涨价?

如何看待 DeepSeek 8 月 6 日公告称即将大幅度涨价?

8月6日,DeepSeek发布公告称计划近期整体上调API服务定价,且预计涨幅较大。目前该平台采用峰谷定价模式,高峰时段价格翻倍。此次调价背景下,DeepSeek V4 Flash在调用量上表现强劲,单日处理Token量在部分平台极高。创始人梁文锋此前曾表示,API定价基于合理利润模型,且当前用户需求对价格几乎没有弹性。

知乎
为什么大家都说 DeepSeek 已经成为大模型的「斩杀线」?

为什么大家都说 DeepSeek 已经成为大模型的「斩杀线」?

DeepSeek V4 Flash正式版于7月31日上线,凭借高性能与极低定价在性能与价格的平衡点上构建了所谓的“斩杀线”。该模型在OpenRouter平台调用量登顶,导致大量对成本敏感的中小开发者迁移,月度推理成本下降60%至85%。此现象标志着全球大模型定价权由硅谷巨头向多元化转变,无法在性能或价格上匹配该标准的模型面临生存压力。

知乎
如何评价 8 月 3 日上线的阿里 Qwen 3.8 Max 正式版?相比其他模型表现如何?

如何评价 8 月 3 日上线的阿里 Qwen 3.8 Max 正式版?相比其他模型表现如何?

阿里巴巴于2026年8月3日正式发布旗舰大模型Qwen3.8-Max,该模型总参数量达2.4万亿,采用稀疏MoE架构,单次推理仅激活约950亿参数。模型支持最高100万token上下文及原生多模态视觉理解。在多项权威榜单中表现出色,其中OSWorld-Verified得分位居主流模型首位。阿里宣布该模型权重将于下周开源。

知乎
大厂 HR 直接进入高校实验室劝说博士生放弃学位,并开出百万年薪,如何看待这种抢人模式?放弃学位是否值得?

大厂 HR 直接进入高校实验室劝说博士生放弃学位,并开出百万年薪,如何看待这种抢人模式?放弃学位是否值得?

当前AI领域顶尖人才供需严重失衡,头部大厂抢人竞争激烈。据报道,有HR直接进入清华大学实验室劝说博士生放弃学位入职,或在答辩现场送花祝贺。市场薪资出现分化,部分顶尖博士年薪可达数百万甚至千万量级。专家与教师提醒,尽管短期高薪诱人,但系统性的学术训练与学位仍是长期发展的底牌。

知乎
Kimi 员工震惊和 OpenAI  算力的差距,为什么在这么大差距下 Kimi 还能做出来 K3 ?

Kimi 员工震惊和 OpenAI 算力的差距,为什么在这么大差距下 Kimi 还能做出来 K3 ?

月之暗面发布的Kimi K3模型在参数规模、性能及部署效率上引发行业关注。该模型拥有2.8万亿总参数,在Arena盲测榜单中登顶全球第一。在部署方面,Kimi K3在AMD MI355X上的单节点吞吐量显著高于NVIDIA B200的双节点方案。与此同时,OpenAI等海外巨头通过大幅降价应对包括Kimi K3在内的中国新一代模型的竞争。

知乎
为什么豆包没有被 DeepSeek「斩杀」?

为什么豆包没有被 DeepSeek「斩杀」?

2026年国产大模型市场竞争激烈,DeepSeek凭借开源策略与极致性价比快速崛起,在海外编程平台产生高Token消耗量并影响竞品定价。与此同时,豆包依托抖音生态在生活资讯领域具备实时覆盖优势,且在用户规模上保持领先,2025年12月月活用户数达22669万,位居AI原生App榜首。两款产品在应用场景与用户体量上呈现出不同的竞争维度。

知乎
DeepSeek V4 flash 上线,相较 Kimi K3 各有哪些优劣?现版本大模型中你的选择是啥?

DeepSeek V4 flash 上线,相较 Kimi K3 各有哪些优劣?现版本大模型中你的选择是啥?

DeepSeek V4-Flash-0731于2026年7月31日发布公测版,通过后训练优化显著提升Agent能力,在保持284B总参数和13B激活参数的同时,大幅降低API成本。相比于2026年7月27日发布开放权重的Kimi K3,V4-Flash主打极致性价比与推理速度,而Kimi K3在多模态能力、智能指数及代理性能等基准测试中处于领先地位。

知乎