OpenRouter

2 条相关内容

怎么看一周 70 万亿 Token 的 GLM 5.3 Flash, 完全运行在国产 AI 芯片集群?

怎么看一周 70 万亿 Token 的 GLM 5.3 Flash, 完全运行在国产 AI 芯片集群?

智谱于2026年8月26日正式开源原生多模态大模型GLM-5.3-Flash。该模型在发布前以匿名身份“Ox-Alpha”在OpenRouter和OpenCode平台测试,刷新了两平台历史纪录,周Token份额近20%。值得关注的是,该模型的所有线上流量均由10万张国产芯片集群承载,实现了国产算力芯片首次大规模集体出海服务全球真实负载。

知乎
为什么大家都说 DeepSeek 已经成为大模型的「斩杀线」?

为什么大家都说 DeepSeek 已经成为大模型的「斩杀线」?

DeepSeek V4 Flash正式版于7月31日上线,凭借高性能与极低定价在性能与价格的平衡点上构建了所谓的“斩杀线”。该模型在OpenRouter平台调用量登顶,导致大量对成本敏感的中小开发者迁移,月度推理成本下降60%至85%。此现象标志着全球大模型定价权由硅谷巨头向多元化转变,无法在性能或价格上匹配该标准的模型面临生存压力。

知乎