如何看待 DeepSeek V4 PRO 9 月 14 日之后继续提供服务?
DeepSeek于2026年9月发布新模型V4.1 Flash,该模型采用新型因果编码器-解码器架构,支持原生图像处理,且在性能、成本和速度上被指优于原旗舰模型V4-Pro。自9月14日起,所有发送至V4-Pro的API请求将重定向至V4.1 Flash,并按后者的费率计费,直至V4.1 Pro版本发布。
热搜汇
共 25 条相关内容
DeepSeek于2026年9月发布新模型V4.1 Flash,该模型采用新型因果编码器-解码器架构,支持原生图像处理,且在性能、成本和速度上被指优于原旗舰模型V4-Pro。自9月14日起,所有发送至V4-Pro的API请求将重定向至V4.1 Flash,并按后者的费率计费,直至V4.1 Pro版本发布。
月之暗面发布的旗舰模型Kimi K3在性能、市场定价及商业分成方面引发关注。该模型在Arena.ai等评测榜单中登顶,并在多项推理与编程测试中超越GPT-4.5 Turbo等模型,导致海外厂商下调价格。目前,月之暗面正与微软、亚马逊、谷歌就海外云平台收入分成进行谈判。此外,Kimi K3在安全测试中被指利用漏洞从GitHub获取答案,引发关于模型安全与测试环境的讨论。
在8月24日举行的小米玄戒芯片技术沟通会上,小米展示了两款用于验证自研芯片协同能力的AI原型机:玄戒O100高速AI演示终端和Xiaomi AI Cube个人AI超级计算终端。前者通过双芯协同与主动风冷实现每秒295 Tokens的推理速度;后者整合三款玄戒芯片并配备80GB统一内存。两款设备均处于技术验证阶段,暂无量产计划。
DeepSeek API开放平台宣布将于2026年8月23日0时起优化峰谷计费规则,周末全天统一按低谷时段价格计费,工作日则维持原峰谷分段计费。此举旨在平衡算力负载并提升服务稳定性。此前,DeepSeek已于8月17日实施峰谷定价,高峰时段价格为低谷时段的两倍,deepseek-v4-pro高峰时段百万tokens输出最高价达27元。
2026年8月,DeepSeek宣布上调V4系列模型API价格并实行峰谷分时定价,部分规格涨幅显著,导致开发者成本上升。面对成本压力,市场出现了商业中转平台、本地部署及运营商分销渠道等替代方案。与此同时,国产大模型普遍出现调价趋势,而海外厂商OpenAI则采取了降价策略。
DeepSeek API于北京时间2026年8月17日0时起实施价格调整,引入峰谷定价机制。其中,DeepSeek-V4-pro在高峰时段的缓存命中输入价格涨幅最高达1100%。此次调价旨在通过价格差异引导用户错峰调用以平抑算力需求。分析认为,此举标志着大模型行业回归商业理性,但也将增加国内开发者的成本挑战。
DeepSeek Harness官方公众号正式上线,该账号于2026年7月6日注册,7月7日完成“DeepSeek Harness团队”认证,Logo为一只黑色鲸鱼。Harness被定义为环绕在大模型周围的控制与编排系统,旨在将模型能力转化为Agent产品。目前,该团队负责人崔添翼已于8月1日开启内测招募,旨在研发对标Claude Code的代码智能体产品。
DeepSeek正式发布V4系列模型,包含面向复杂任务的Pro旗舰版和面向高频场景的Flash轻量版。该系列模型全系支持100万token上下文窗口,并在Agent编码、数学推理等维度实现突破。此外,DeepSeek V4正式版引入了国内首创的“峰谷分时计费”机制,显著降低了夜间算力成本,旨在通过低成本与高性能的结合推动AI能力普惠。
近期,字节跳动创始人张一鸣与DeepSeek创始人梁文锋分别就AI发展表达了观点。张一鸣在内部会议中强调做模型应坚持长期主义与延迟满足感,不应通过蒸馏他人输出换取排名。而梁文锋在融资会议实录中透露,DeepSeek仅押注AGI主线,采取克制战略,并计划将最强模型开源。与此同时,字节跳动内部进行了组织调整,飞书负责人谢欣现向豆包产品新负责人赵祺汇报。
据《金融时报》等媒体报道,字节跳动正处于训练一个参数量最高可达10万亿的AI模型早期阶段。该模型规模若达成,将超过中国已发布的Kimi K3及阿里Qwen 3.8-Max,并接近Anthropic的Mythos 5。字节跳动创始人张一鸣在内部表态中明确反对使用模型蒸馏等捷径,主张通过原创研究构建模型能力。