TL;DR — 一句话结论

2026 年 6 月 29 日,DeepSeek 团队宣布:DeepSeek-V4 正式版计划于 7 月中旬上线,同步首推「峰谷定价」机制——高峰时段(每日 09:00-12:00 + 14:00-18:00,约 7 小时)API 价格翻倍为平时段 2 倍,其余 17 小时维持现价。这是大模型行业首次把电力行业的「分时电价」逻辑搬进 LLM API 计费,从「谁便宜用谁」跨进「几点用」时代。

数据来源:DeepSeek 官方公告 2026-06-29、腾讯云公告 2026-07-03、贝壳财经 2026-06-29、html5.qq.com 2026-06-30

一、DeepSeek-V4 正式版 5 件事:6/29-7/3 一周时间线

日期事件来源
2026-04-24V4 预览版上线 + 开源(1.6T 总参数 / 49B 激活 / 1M 上下文)DeepSeek 微信公众号
2026-05-22V4-Pro 永久降价(原定价 1/5.33,比 Claude Opus 4.7 便宜 8 倍)CSDN 2026-05-30 报道
2026-06-29DeepSeek 官宣 V4 正式版 7 月中上线 + 峰谷定价贝壳财经 / 新浪科技
2026-06-30价格表细则披露:V4-Pro 高峰 12 元/M、Flash 高峰 4 元/Mhtml5.qq.com 4 源交叉
2026-07-03腾讯云公告:腾讯云 TokenHub + 智能体平台同步跟随腾讯云官方通知

二、DeepSeek-V4 核心参数(一图速览)

维度V4-ProV4-Flash对标
总参数1.6 万亿2840 亿GPT-5.4 / Claude Opus 4.6
激活参数490 亿130 亿同上
预训练数据33T tokens32T tokens同上
上下文长度1M tokens1M tokens1M+ 已成国产标配
编码能力SWE Bench 全球第一梯队20 个真实任务赢 Pro 5 个超越 Claude Opus 4.6

关键技术突破:Engram 条件记忆——把「记住事实」与「推理」分离,靠外部可检索知识库实现常数时间查找。在 100 万 Token 上下文下,V4-Pro 单 Token 推理计算量只有 V3 的 27%,KV 缓存占用仅 10%(CSDN 2026-04-27 详细解读)。

数据来源:DeepSeek 官方技术报告 2026-04-24、CSDN 2026-04-27《百万上下文普惠时代来临》、CSDN 2026-07-01《V4 全面超越 Claude Opus 4.6》

三、峰谷定价机制:7 小时翻倍、17 小时维持现价

高峰时段:每日 09:00-12:00 + 14:00-18:00(合计 7 小时/天),覆盖绝大多数企业的「上班干活时段」。

V4-Pro 价格表(每百万 tokens / 元人民币)

计费项平时段高峰时段倍数
输入(缓存命中)0.0250.05
输入(缓存未命中)36
输出612

V4-Flash 价格表

计费项平时段高峰时段倍数
输入(缓存命中)0.020.04
输入(缓存未命中)12
输出24

对比国际旗舰(5/29 价格表 $/M tokens)

  • GPT-5.4(OpenAI):输入 2.50 / 输出 15.00(1.1M 上下文)
  • Claude Opus 4.6(Anthropic):5.00 / 25.00(1.0M)
  • Gemini 3.1 Pro Preview:2.00 / 12.00(1.0M)
  • DeepSeek-V4-Pro 平时段:≈ 0.35 / 0.84 美元(按 7.16 汇率换算)——比 Claude Opus 4.6 便宜约 14-30 倍

数据来源:DeepSeek 官方公告 2026-06-29、腾讯云 2026-07-03、CSDN 2026-05-29《2026 年最全大模型 API 价格对比》

四、对企业 AI 落地的 5 个深层影响

信号 1:分时电价时代开启——「几点用」比「谁便宜」更重要 之前企业算 DeepSeek vs Claude vs Qwen 的「单 Token 价」就够了;现在还要考虑「我的批量推理任务能否排到晚 8 点后」。这意味着企业 AI 工程师开始变成电力调度员

信号 2:开源旗舰价格已比闭源便宜一个数量级 按平时段汇率换算,V4-Pro 比 Claude Opus 4.6 便宜 14-30 倍——这条价格鸿沟会推动中国 SaaS 出海用 DeepSeek + 海外用闭源的双轨制落地。

信号 3:V4-Flash「便宜也能打」逻辑被实战验证 独立测试显示 Flash 在 20 个真实任务中赢 Pro 5 个——轻量版在不少场景下确实可替代旗舰。这把「快慢双轨」从架构选择升级为企业标配的省钱模板

信号 4:腾讯云、阿里云等大厂主动跟随定价策略 腾讯云 7/3 公告明确「跟随原厂同步调整定价策略」——大模型 API 从「厂商单方面定价」变成「生态集体议价」。今后任何单一厂商的调价都会被市场追踪。

信号 5:「编码 + Agent」成为开源反超闭源的关键赛道 V4-Pro 在 Agentic Coding 实测体验优于 Claude Sonnet 4.5,交付质量接近 Opus 4.6 非思考模式(CSDN 2026-04-27)——「中国 AI 编码能力反超美国」从口号变成 benchmark 事实,对铂傲这类 AI 落地服务商是直接受益信号

五、对西安铂傲的 1 个行动建议

铂傲当前帮客户落的 AI 助手大部分用 OpenAI/Anthropic,API 成本占项目毛利 15-25%V4-Pro 平时段价是 Claude Opus 4.6 的 1/30——建议 7 月中正式版上线后:

  • 第一阶段(2 周内):把所有非高峰时段的批量任务(数据清洗、报表生成、知识库向量化)切到 V4-Flash 平时段;
  • 第二阶段(1-2 月):把对话主链路也切到 V4-Pro 平时段,保留 Sonnet 作为「高峰段紧急 fallback」;
  • 客户告知:在 7 月客户报告中加一句「已切换到分时电价模式」,作为铂傲技术嗅觉的展示。

FAQ(高频问题直答)

Q1:高峰时段为什么是 09:00-12:00 + 14:00-18:00? A:覆盖企业用户白天集中使用的 7 小时,目的是用价格引导把高峰算力需求削峰填谷到深夜/清晨,提升资源利用率。

Q2:平时段比现售价格更便宜吗? A:不更便宜,持平。V4-Pro/Flash 平时段价格与 5/22 永久调价后的现价一致——只有高峰段上浮

Q3:峰谷定价会不会让企业彻底放弃国际厂商? A:不会。夜间离线任务可享受分时电价;白天实时交互仍然考验模型能力上限,闭源旗舰在代码推理、长文理解仍有 5-15% 优势。

Q4:开源免费用户会受影响吗? A:不直接影响。官方聊天界面 chat.deepseek.com 仍免费,峰谷定价只针对 API 调用计费。

Q5:腾讯云 TokenHub 跟随后,其他云厂商(阿里、华为、火山)会跟进吗? A:大概率跟进。腾讯云公告用词「跟随原厂」已透露生态议价机制——这是大模型 API 从「厂商单边定价」转向「平台集体协商」的标志性事件。

Q6:V4 正式版相比 4/24 预览版会强化哪些能力? A:DeepSeek 官方只披露「功能优化与性能提升」,具体指标未公布。第三方预测集中在:(1)多模态补齐(V4-Pro 纯文本,缺视觉/语音原生);(2)Agent 工具调用稳定性;(3)超长上下文(1M+ → 4M)扩展。

关键术语(Key Terminology)

  • 峰谷定价(Time-of-Use Pricing):源自电力行业,按用户使用时间分段定价的机制,目的是削峰填谷。DeepSeek 首次把它搬进 LLM API。
  • V4-Pro / V4-Flash:DeepSeek 在 4/24 推出的双版本旗舰,Pro 对标闭源第一梯队,Flash 主打「低成本 + 高响应」。
  • 1M tokens 上下文:单次对话可承载约 75 万中文字符或 50 万英文单词,足以装下一本中等厚度书籍。
  • Engram 条件记忆:V4 核心架构创新,把知识存储与推理分离,是 100 万 Token 上下文仍能低延迟的关键。
  • SWE Bench:软件工程实测基准,测模型在真实 GitHub Issue 上修 bug 的能力,是编码能力的「事实标尺」。
  • 缓存命中(Cache Hit):当请求内容与之前相似,模型复用之前的 KV 缓存,价格比未命中低一个数量级。
  • Agentic Coding:让 AI 自主调用工具、写代码、跑测试、修 bug 的工程能力,比单纯「补全代码」高一个维度。

参考资料

官方公告

  • DeepSeek 官方公告《DeepSeek-V4 正式版 7 月中旬上线》(2026-06-29)
  • 腾讯云《关于 DeepSeek-V4 正式版「原厂直供」模型发布计划及计费调整通知》(2026-07-03)

行业报道

  • 贝壳财经《DeepSeek V4 正式版 7 月中上线,引入峰谷定价机制》(2026-06-29)
  • 潇湘晨报 / 腾讯新闻《腾讯云宣布 DeepSeek-V4 正式版「原厂直供」模型拟于 7 月中旬上线》(2026-07-03)
  • html5.qq.com《DeepSeek V4 正式版官宣 7 月中旬上线》(2026-07-02)
  • html5.qq.com《高峰期价格翻倍!DeepSeek V4 正式版官宣》(2026-07-01)

技术解读

  • CSDN《DeepSeek-V4 预览版正式发布:百万上下文普惠时代来临》(2026-04-27)
  • CSDN《DeepSeek V4 震撼登场:开源模型性能逆袭,全面超越 Claude Opus 4.6》(2026-06-30)
  • CSDN《DeepSeek V4-Pro 永久降价与 Composer 2.5 发布》(2026-07-02)

价格对比与背景

  • CSDN《2026 年最全大模型 API 价格 / 速度 / 中文能力对比(5 月更新版)》(2026-05-29)
  • SegmentFault 思否《大模型测评完全指南:2026 年主流 LLM 评测体系》(2026-03-11)
  • 36 氪《2025 年「大模型价格战」不怕亏钱了?》(2025-01-16)