TL;DR
- 2026 年 8 月第一周(7/31 - 8/7),国产大模型在一周内密集亮剑:DeepSeek-V4-Flash 正式版 7/31 上线公测 + Qwen3.8-Max 8/3 正式发布 + 智谱 GLM-5.3 8/4 意外曝光——三连击敲响 8 月大战。
- DeepSeek-V4-Flash 正式版 7/31(so.html5.qq.com 7/31 19:41 + 8/2 跑分出炉):模型结构与尺寸和预览版完全一致(总参数 2840 亿 + 激活参数 130 亿),仅重新进行后训练;原生支持 Responses API 格式 + 针对性适配 Codex + Agent 能力大幅增强;OpenCode 平台 8/1 单日处理 token 达 8 万亿(5 万亿免费 + 3 万亿付费)。
- Qwen3.8-Max 8/3 正式发布(太平洋科技 PConline 8/3 + CSDN 8/4 AI 新闻日报):基于 Qwen3.5 架构,总参数 2.4 万亿,综合表现跻身全球第一梯队;编程可独立完成十数日周期完整项目(输入”创建自进化智能体 Harness”模型自主完成 16 天体量代码)+ 办公法务一周审阅压缩至 1 小时 + 200 页财报 / 100 小时长视频深度解析;国内定价 12 元/百万 tokens 输入 + 36 元/M 输出 + 缓存复用 1.5 元起;完整权重下周开源。
- 智谱 GLM-5.3 8/4 意外曝光(TechWeb 8/4):智谱旗下 ZCode 官网 8/3 短暂上线”ZCode for GLM-5.3”页面 + 微软 Bing 收录为”GLM-5.3 Official Harness” + 智谱官方 Java SDK 代码库新增”glm-5.3”模型支持 JSON Schema —— 官方层面”明牌泄露”,业内普遍预期近期正式发布。智谱近期股价压力较大(7/17 单日重挫 28.49% + 自 6 月高点累计回撤 66% + 市值蒸发超 8000 亿港元)。
- DeepSeek 8/6 预告大幅涨价(财联社 8/6):整体上调 API 定价,涨幅较大;延续 6/29 预告的峰谷定价机制(高峰 9:00-12:00 + 14:00-18:00 翻倍),V4-Pro 高峰时段输入缓存命中 0.025 → 0.05 元;V4-Flash 同步上调;行业背景:阿里云 / 腾讯云 / 百度智能云 / 智谱 AI 集体涨价,腾讯云年内两次涨价,智谱年内三次 API 上调;高盛研报判断行业竞争从「激进价格战」回归「理性定价框架」。
- 阿里 8/7 跟进:媒体报道阿里巴巴计划向下一代 Qwen 开源 AI 模型的大型用户收费(so.html5.qq.com 8/7 10:51)。
- 3 步企业落地路径:① 关注业务时段:API 调用集中在 9-12 / 14-18 高峰时段,提前迁移算力调度;② 升级到 Agent 版本:DeepSeek-V4-Flash / Qwen3.8-Max 都在 Agent 能力上大幅增强;③ 缓存复用策略:Qwen3.8 缓存复用 1.5 元/M、DeepSeek 输入缓存命中 0.02 元(平时段),可省 60%+。
- 4 道防御 Checklist:① 预算重新测算:按涨价后峰值定价重做全年 API 预算;② 分时调度:非业务核心任务排到非高峰时段;③ 缓存复用策略:Qwen3.8 / DeepSeek 都已支持,务必启用;④ 国产多模型备份:DeepSeek + Qwen + 智谱三选二互为 fallback,避免单点故障。
一、今日头条:国产大模型「8 月三连击」
2026 年 8 月第一周(7/31 - 8/7),国产大模型在一周内密集亮剑,头部厂商齐发旗舰:
| 时间 | 厂商 | 事件 | 关键数据 |
|---|---|---|---|
| 7/31 19:41 | DeepSeek | V4-Flash 正式版 API 上线公测 | 总参数 2840 亿,激活 130 亿,Agent 增强 |
| 8/1 | DeepSeek | OpenCode 平台单日 token 处理 8 万亿 | 5 万亿免费 + 3 万亿付费 |
| 8/2 | DeepSeek | 正式版跑分出炉 | 多项基准超预览版 |
| 8/3 上午 | 阿里千问 | Qwen3.8-Max 正式发布 | 总参数 2.4 万亿,全球第一梯队 |
| 8/3 | 智谱 | ZCode 官网上线”GLM-5.3”页面 | 短期泄露 1 小时 |
| 8/4 | 智谱 | GLM-5.3 意外曝光 | Bing 收录 + Java SDK 同步 |
| 8/6 12:46 | DeepSeek | 预告整体大幅涨价 | 峰谷定价延续,涨幅较大 |
| 8/7 10:51 | 阿里 | 计划向下一代 Qwen 大型用户收费 | 跟随涨价潮 |
来源:so.html5.qq.com 7/31 19:41 + 8/6 12:46 + PConline 太平洋科技 8/3 + TechWeb 8/4 + new.qq.com 8/6 15:38 + so.html5.qq.com 8/7 10:51 + CSDN 8/4 AI 新闻日报,7 个独立信源交叉验证。
二、4 大旗舰核心数据透视
2.1 DeepSeek-V4-Flash 正式版(7/31)
DeepSeek 7/31 通过官方 API 文档发布日志宣布 DeepSeek-V4-Flash-0731 正式版 API 开启全面公测:
- 模型结构与尺寸和 V4-Flash 预览版完全一致——总参数 2840 亿 + 激活参数 130 亿(来源:so.html5.qq.com 7/31 19:41)
- 仅针对接口调用场景完成了专项后训练优化(so.html5.qq.com 8/1 11:56)
- 三大核心升级:① 原生支持 Responses API 格式;② 针对性适配 Codex(大幅提升代码开发场景下的接口调用流畅度与响应准确率);③ Agent 能力大幅增强(so.html5.qq.com 8/2 跑分出炉,多项基准超预览版)
- 本次更新仅针对 V4-Flash 的 API 接口,V4-Pro API 以及 APP / WEB 端的相关模型均未进行任何改动(so.html5.qq.com 8/1)
- DeepSeek-V4-Pro 正式版也将按计划尽快发布
2.2 Qwen3.8-Max(8/3)
阿里千问 8/3 正式发布旗舰大模型 Qwen3.8-Max:
- 总参数量扩充至 2.4 万亿,基于 Qwen3.5 架构迭代(来源:太平洋科技 PConline 8/3)
- 4 大能力跃迁:① 编程:独立完成十数日周期完整项目(输入”创建自进化智能体 Harness”模型自主完成 16 天体量代码);② 办公:法务团队一周文件审阅压缩至 1 小时;③ 长程任务:数千轮交互不衰减,可用于数字芯片研发设计;④ 多模态:200 页长篇财报 + 100 小时长视频深度解析
- 官方表示综合表现跻身全球大模型第一梯队
- 国内定价阶梯制:输入 12 元/百万 tokens、输出 36 元/百万 tokens、缓存复用 1.5 元起;海外调用定价相较同类头部模型更具成本优势
- 下周开源完整模型权重 + Qwen3.8-27B 轻量化版也将开发
2.3 智谱 GLM-5.3 意外曝光(8/4)
智谱 AI 尚未正式发布的 GLM-5.3 意外泄露,泄露渠道覆盖官方 + 第三方 + 代码库三层:
- 智谱旗下 AI 编程工具 ZCode 官网于 8/3 短暂上线了”ZCode for GLM-5.3”的相关页面(来源:TechWeb 8/4)
- 微软 Bing 搜索引擎将该 ZCode 页面标题收录为”GLM-5.3 Official Harness”——进一步扩大了泄露范围
- 智谱官方 Java SDK 的代码库中,有开发者提交了新增”glm-5.3”模型并支持 JSON Schema 的更新记录
- 市场解读为「精心准备的发布流程中出现的意外脱轨」,但也侧面印证 GLM-5.3 已进入可部署的最终阶段
- 截至发稿,智谱 AI 官方并未就 GLM-5.3 的泄露事件及具体发布时间做出正式回应
智谱股价压力:GLM-5.3 曝光恰逢智谱股价承压之际——7/17 智谱股价曾单日重挫 28.49%、市值蒸发超 2000 亿港元;自 6 月高点以来,其股价已累计回撤 66%,市值累计蒸发超过 8000 亿港元(TechWeb 8/4)。
2.4 月之暗面 Kimi K3(7/22 上,作为参照)
8 月大战前,7 月月之暗面发布了参数高达 2.8 万亿的开源模型 Kimi K3——这是 7 月国产大模型最大事件,加上 8 月三连击,国产大模型头部已从 GLM-5 / Qwen3.5 / DeepSeek-V4 进入”万亿俱乐部 + 双版本”新阶段(so.html5.qq.com 8/4 TechWeb 报道交叉验证)。
三、涨价潮:从「价格屠夫」到「集体涨价」
3.1 DeepSeek 8/6 公告(导火索)
《科创板日报》8/6 报道(财联社转载):DeepSeek 计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大(来源:so.html5.qq.com 8/6 12:46)。
具体涨价方案延续 6/29 预告的峰谷定价机制(高峰时段调用价格直接翻倍):
| 档位 | 时段 | 缓存命中输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|---|
| V4-Pro 平时 | 非高峰 | 0.025 元/M | 3 元/M | 6 元/M |
| V4-Pro 高峰 | 9-12 / 14-18 | 0.05 元/M(翻倍) | 6 元/M(翻倍) | 12 元/M(翻倍) |
| V4-Flash 平时 | 非高峰 | 0.02 元/M | 1 元/M | 2 元/M |
| V4-Flash 高峰 | 9-12 / 14-18 | 0.04 元/M(翻倍) | 2 元/M(翻倍) | 4 元/M(翻倍) |
3.2 历史脉络:从「价格屠夫」到「涨价」
回顾 2026 H1,DeepSeek 一路在「价格屠夫」与「涨价」之间反复切换(来源:new.qq.com 8/6 15:38《DeepSeek 预告涨价:从”价格屠夫”到”涨价”》):
- 4/26 DeepSeek 宣布 V4-Pro API 开启 2.5 折价格特惠——百万 tokens 输入 0.025 元 + 输出 6 元
- 5/22 限时优惠转为”永久定价”——V4-Pro 输出仅 0.87 美元/百万 tokens,比 GPT-5.5 便宜约 34 倍
- 5 月起 小米跟进(MiMo-V2.5 API 最高降价 99%)+ 字节跳动 + 腾讯云被迫跟进(多款主流模型降价幅度突破 90%)
- 6/29 DeepSeek 邮件预告:V4 正式版 7 月中上线 + 峰谷定价机制(工作日高峰时段 API 价格翻倍)
- 7 月中 峰谷定价正式落地(仅高峰时段翻倍)
- 8/6 公告:不仅是高峰时段,平峰时段的基准定价也将全面上浮——DeepSeek 告别「自杀式定价」
3.3 行业集体涨价:腾讯云 / 阿里 / 智谱 / 百度全面跟进
DeepSeek 涨价并非孤例,今年以来阿里云、腾讯云、百度智能云、智谱 AI 等国内头部厂商已集体调价(财联社 8/6):
- 腾讯云:连续两次宣布涨价
- 智谱 AI:年内进行了三次 API 价格上调
- 阿里云 / 百度智能云:跟进涨价
- 阿里 8/7:媒体报道阿里巴巴计划向其下一代 Qwen 开源 AI 模型的大型用户收费(so.html5.qq.com 8/7 10:51)
3.4 高盛研报:行业竞争回归理性定价框架
高盛在研报中认为,DeepSeek 实施高峰时段价格调整,并不意味着需求走弱,反而反映出国内 AI 模型需求持续旺盛、算力资源趋紧,行业竞争正在从早期激进的价格战,逐步回归更理性的定价框架(财联社 8/6)。
四、生态数据:OpenRouter 跑分 + OpenCode 调用
4.1 OpenRouter 8/4 模型调用量全球榜单
全球 AI 模型聚合平台 OpenRouter 8/4 数据显示:
- 今年 4 月更新的 DeepSeek V4 Flash 预览版——已正式登顶过去一周模型调用量的全球榜单
- 几天前刚刚发布的 DeepSeek V4 Flash 正式版——也已上升至第 8 位
来源:so.html5.qq.com 8/6 12:46 引述财联社。
4.2 OpenCode 8/1 单日 8 万亿 Token
海外开发者平台 OpenCode 披露了一组数据:8/1 一天,DeepSeek V4 Flash 在该平台上单日处理 token 总量达 8 万亿——其中 5 万亿来自免费试用额度,3 万亿来自开发者付费调用(财联社 8/6)。
五、3 步企业落地路径
5.1 关注业务时段(峰谷定价应对)
8 月后,DeepSeek V4 系列 API 实施峰谷定价:
- 高峰时段(工作日 9:00-12:00 + 14:00-18:00 北京时间)——价格翻倍
- 非高峰时段——价格不变
企业行动:① 把非业务核心的批处理 / 数据标注 / 离线分析任务排到非高峰;② 把面向用户的实时对话 / 客服 / Agent 任务放在高峰;③ 利用缓存复用策略降低成本。
5.2 升级到 Agent 版本
DeepSeek-V4-Flash 正式版 / Qwen3.8-Max 都重点强化了 Agent 能力(V4-Flash「Agent 能力大幅增强」+ Qwen3.8-Max「真实办公 + 长程任务 + 多模态智能体」),企业应该:
- 优先用 Agent 框架调用,而不是裸 API 调用
- 用 Qwen3.8-Max 处理多文件 / 长程 / 多模态任务(法务审阅、长视频解析)
- 用 DeepSeek-V4-Flash 处理高频 + Agent + Codex 适配任务(代码生成 + 自动化)
5.3 启用缓存复用策略
| 模型 | 缓存命中输入价格 | 节省 |
|---|---|---|
| Qwen3.8-Max | 1.5 元/百万 tokens(起) | 87%+(对比 12 元输入) |
| DeepSeek V4-Flash(平时段) | 0.02 元/百万 tokens | 98%+(对比 1 元输入) |
| DeepSeek V4-Pro(平时段) | 0.025 元/百万 tokens | 99.2%+(对比 3 元输入) |
企业行动:① 启用 prefix caching;② 复用 system prompt + 长文档上下文;③ 估算缓存命中率,优化到 60%+ 可显著降本。
六、4 道防御 Checklist(应对涨价潮)
- 预算重新测算:按涨价后峰值定价(DeepSeek V4-Pro 12 元/M 输出)重做全年 API 预算,留 20%-30% buffer;
- 分时调度:非业务核心任务(批处理 / 离线分析 / 数据标注)排到非高峰时段(周末 / 夜间 22:00-9:00);
- 缓存复用策略:Qwen3.8(1.5 元/M)+ DeepSeek(0.02 元/M)都已支持 prefix caching,务必启用,优化目标命中率 60%+(可省 50%+ 成本);
- 国产多模型 backup:DeepSeek + Qwen + 智谱三选二互为 fallback,避免单点故障;GlM-5.3 正式发布后即可作为备份。
FAQ(高频问题直答)
Q1:DeepSeek-V4-Flash 正式版和预览版有什么区别?
A:模型结构和尺寸完全一致(总参数 2840 亿 + 激活参数 130 亿),仅针对接口调用场景完成了专项后训练优化。三大核心升级:① 原生支持 Responses API 格式;② 针对性适配 Codex(代码开发场景);③ Agent 能力大幅增强。本次更新仅针对 V4-Flash 的 API 接口,V4-Pro API + APP/WEB 端均未变动。
Q2:Qwen3.8-Max 的 2.4 万亿参数相比之前有何优势?
A:① 编程:可独立完成十数日周期完整项目(输入”创建自进化智能体 Harness”,模型自主完成 16 天体量代码);② 办公:法务团队一周文件审阅压缩至 1 小时;③ 长程:数千轮持续交互不衰减;④ 多模态:200 页长篇财报 + 100 小时长视频深度解析 + 视觉贯穿任务规划执行自检全流程。综合表现跻身全球第一梯队。
Q3:GLM-5.3 是怎么泄露的?什么时候正式发布?
A:三层泄露:① 智谱旗下 ZCode 官网 8/3 短暂上线”ZCode for GLM-5.3”页面(对外开放约 1 小时);② 微软 Bing 收录为”GLM-5.3 Official Harness”;③ 智谱官方 Java SDK 代码库新增”glm-5.3”模型 + JSON Schema 支持。官方层面”明牌泄露”,但智谱官方未就事件及具体发布时间正式回应,业内普遍预期近期择机公布。
Q4:DeepSeek 涨价后,API 成本会增加多少?
A:取决于业务时段分布:① 纯高峰时段(9-12 + 14-18):V4-Pro 输出从 6 元 → 12 元,翻倍;② 纯非高峰:价格不变;③ 混合业务(假设 50% 高峰 + 50% 非高峰):V4-Pro 输出平均成本 = 6 × 1.5 = 9 元/M,涨 50%。但通过缓存复用策略,可抵消 30%-50%。
Q5:涨价潮会持续多久?企业应该如何应对?
A:① 持续时间:高盛研报判断行业竞争从「激进价格战」回归「理性定价框架」——涨价是中长期趋势,不是短期波动;② 企业应对:预算重新测算 + 分时调度 + 缓存复用 + 多模型 backup 四管齐下;③ 关注开源:Qwen3.8-Max 完整权重下周开源 + Qwen3.8-27B 轻量化版,自有算力部署可避开涨价。
Q6:为什么 DeepSeek 选在 8 月涨价?是不是需求走弱?
A:不是需求走弱,是算力资源趋紧 + 行业回归理性定价:① DeepSeek-V4-Flash 8/1 单日 8 万亿 token 调用 + 预览版登顶 OpenRouter 全球榜首;② 高峰时段翻倍只是「错峰定价」,平峰时段基准定价上调才是真正的涨价;③ 行业整体(阿里云 / 腾讯云 / 百度智能云 / 智谱 AI)都在跟进。
关键术语(Key Terminology)
- DeepSeek-V4-Flash 正式版:DeepSeek 7/31 通过官方 API 文档发布日志宣布上线的正式版 API,模型结构与 V4-Flash 预览版完全一致,仅重新后训练,原生支持 Responses API + Codex 适配 + Agent 能力大幅增强。
- 峰谷定价(Peak-Valley Pricing):DeepSeek V4 系列 API 的分时段定价机制——高峰时段(工作日 9:00-12:00 + 14:00-18:00)价格翻倍,非高峰时段价格不变,通过价格信号引导用户错峰使用算力。
- Responses API:OpenAI 推出的标准化 API 响应格式,DeepSeek-V4-Flash 正式版原生支持该格式,降低开发者迁移成本。
- Qwen3.8-Max:阿里千问 8/3 发布的旗舰大模型,总参数 2.4 万亿,基于 Qwen3.5 架构迭代,综合表现跻身全球第一梯队,下周开源完整权重。
- GLM-5.3:智谱 AI 尚未正式发布的新一代旗舰模型,因 ZCode 官网 + Bing 收录 + Java SDK 三层泄露而 8/4 意外曝光,业内普遍预期近期正式发布。
- 缓存复用(Prefix Caching):LLM API 的一种成本优化策略——重复使用之前请求的上下文缓存,价格显著低于新输入(Qwen3.8 缓存 1.5 元/M vs 输入 12 元/M,节省 87%+)。
- Agent 能力:大模型自主规划 + 多步骤执行 + 工具调用 + 反馈迭代的能力,DeepSeek-V4-Flash 正式版 + Qwen3.8-Max 都重点强化了这一能力。
- OpenRouter:全球 AI 模型聚合平台,提供多个大模型的统一 API 接入,8/4 数据显示 DeepSeek-V4-Flash 预览版登顶过去一周模型调用量全球榜首。
参考资料
官方文档
- DeepSeek-V4-Flash 正式版 API 公测公告(2026/7/31 + 8/1 + 8/2)
- DeepSeek-V4-Flash 跑分出炉(2026/8/2 19:17)
媒体报道
- 太平洋科技《阿里千问发布全新旗舰大模型 Qwen3.8-Max》(2026/8/3)
- CSDN《AI 新闻日报 2026-08-04:开源权重与具身全身控制同日加速,AI 责任边界成为全球焦点》(2026/8/4 + 8/7 14:36)
- TechWeb《智谱 AI 新一代大模型 GLM-5.3 意外曝光》(2026/8/4 09:58)
- 财联社《DeepSeek 预告将大幅涨价 V4 正式版发布进入倒计时》(2026/8/6 12:46)
- 腾讯新闻《DeepSeek 预告涨价:从”价格屠夫”到”涨价”》(2026/8/6 15:38)
- so.html5.qq.com《阿里计划向下一代 Qwen 大模型收费!国产模型逆势涨价,底气在哪?》(2026/8/7 10:51)
- so.html5.qq.com《DeepSeek V4 正式版上线公测,有重大升级》(2026/7/31 19:41)
- so.html5.qq.com《DeepSeek-V4-Flash 正式版 API 上线公测 原生支持 Responses API 格式》(2026/8/1 11:56)
历史对照
- 7/4 文章《DeepSeek-V4 7 月中上线 + 峰谷定价》(预览版 + 峰谷定价预告)
- 7/14 文章《中国主导发布全球首份大语言模型安全防范能力测评报告》(LLM 安全测评)
本文基于 10 个独立来源交叉验证(DeepSeek 官方 + 太平洋科技 PConline + CSDN AI 新闻日报 + TechWeb + 财联社科创板日报 + 腾讯新闻 + so.html5.qq.com × 4)。所有数据均标注来源;铂傲智能团队整理。
{
"@context": "https://schema.org",
"@type": "BlogPosting",
"headline": "国产大模型「8 月三连击」+ 涨价潮:DeepSeek-V4-Flash 正式版 7/31 公测 + Qwen3.8-Max 8/3 2.4 万亿上线 + 智谱 GLM-5.3 8/4 意外曝光 + DeepSeek 8/6 预告大幅涨价",
"datePublished": "2026-08-10T06:00:00+08:00",
"dateModified": "2026-08-10T06:00:00+08:00",
"author": {
"@type": "Organization",
"name": "铂傲智能",
"url": "https://www.boaoai.cn/"
},
"publisher": {
"@type": "Organization",
"name": "铂傲智能",
"logo": {
"@type": "ImageObject",
"url": "https://www.boaoai.cn/images/logo.png"
}
},
"description": "2026 年 8 月第一周,国产大模型在一周内集中亮剑:DeepSeek-V4-Flash 正式版 7/31 上线公测、Qwen3.8-Max 8/3 上线、智谱 GLM-5.3 8/4 意外曝光、DeepSeek 8/6 预告大幅涨价、阿里 8/7 跟进。",
"keywords": "大语言模型, DeepSeek, Qwen, 智谱, GLM-5.3, Qwen3.8-Max, DeepSeek-V4-Flash, 国产大模型, 涨价潮, 峰谷定价"
}
{
"@context": "https://schema.org",
"@type": "BreadcrumbList",
"itemListElement": [
{
"@type": "ListItem",
"position": 1,
"name": "首页",
"item": "https://www.boaoai.cn/"
},
{
"@type": "ListItem",
"position": 2,
"name": "资讯",
"item": "https://www.boaoai.cn/news/"
},
{
"@type": "ListItem",
"position": 3,
"name": "国产大模型「8 月三连击」+ 涨价潮",
"item": "https://www.boaoai.cn/news/2026-08-10-llm-august-triple-strike-deepseek-qwen-glm-pricing-hike/"
}
]
}
{
"@context": "https://schema.org",
"@type": "FAQPage",
"mainEntity": [
{
"@type": "Question",
"name": "DeepSeek-V4-Flash 正式版和预览版有什么区别?",
"acceptedAnswer": {
"@type": "Answer",
"text": "模型结构和尺寸完全一致(总参数 2840 亿 + 激活参数 130 亿),仅针对接口调用场景完成了专项后训练优化。三大核心升级:① 原生支持 Responses API 格式;② 针对性适配 Codex(代码开发场景);③ Agent 能力大幅增强。本次更新仅针对 V4-Flash 的 API 接口,V4-Pro API + APP/WEB 端均未变动。"
}
},
{
"@type": "Question",
"name": "Qwen3.8-Max 的 2.4 万亿参数相比之前有何优势?",
"acceptedAnswer": {
"@type": "Answer",
"text": "① 编程:可独立完成十数日周期完整项目(输入"创建自进化智能体 Harness",模型自主完成 16 天体量代码);② 办公:法务团队一周文件审阅压缩至 1 小时;③ 长程:数千轮持续交互不衰减;④ 多模态:200 页长篇财报 + 100 小时长视频深度解析 + 视觉贯穿任务规划执行自检全流程。综合表现跻身全球第一梯队。"
}
},
{
"@type": "Question",
"name": "GLM-5.3 是怎么泄露的?什么时候正式发布?",
"acceptedAnswer": {
"@type": "Answer",
"text": "三层泄露:① 智谱旗下 ZCode 官网 8/3 短暂上线"ZCode for GLM-5.3"页面(对外开放约 1 小时);② 微软 Bing 收录为"GLM-5.3 Official Harness";③ 智谱官方 Java SDK 代码库新增"glm-5.3"模型 + JSON Schema 支持。官方层面"明牌泄露",但智谱官方未就事件及具体发布时间正式回应,业内普遍预期近期择机公布。"
}
},
{
"@type": "Question",
"name": "DeepSeek 涨价后,API 成本会增加多少?",
"acceptedAnswer": {
"@type": "Answer",
"text": "取决于业务时段分布:① 纯高峰时段(9-12 + 14-18):V4-Pro 输出从 6 元 → 12 元,翻倍;② 纯非高峰:价格不变;③ 混合业务(假设 50% 高峰 + 50% 非高峰):V4-Pro 输出平均成本 = 6 × 1.5 = 9 元/M,涨 50%。但通过缓存复用策略,可抵消 30%-50%。"
}
},
{
"@type": "Question",
"name": "涨价潮会持续多久?企业应该如何应对?",
"acceptedAnswer": {
"@type": "Answer",
"text": "① 持续时间:高盛研报判断行业竞争从「激进价格战」回归「理性定价框架」——涨价是中长期趋势,不是短期波动;② 企业应对:预算重新测算 + 分时调度 + 缓存复用 + 多模型 backup 四管齐下;③ 关注开源:Qwen3.8-Max 完整权重下周开源 + Qwen3.8-27B 轻量化版,自有算力部署可避开涨价。"
}
},
{
"@type": "Question",
"name": "为什么 DeepSeek 选在 8 月涨价?是不是需求走弱?",
"acceptedAnswer": {
"@type": "Answer",
"text": "不是需求走弱