TL;DR — 一句话结论
2026 年 6 月 29 日,DeepSeek 团队宣布:DeepSeek-V4 正式版计划于 7 月中旬上线,同步首推「峰谷定价」机制——高峰时段(每日 09:00-12:00 + 14:00-18:00,约 7 小时)API 价格翻倍为平时段 2 倍,其余 17 小时维持现价。这是大模型行业首次把电力行业的「分时电价」逻辑搬进 LLM API 计费,从「谁便宜用谁」跨进「几点用」时代。
数据来源:DeepSeek 官方公告 2026-06-29、腾讯云公告 2026-07-03、贝壳财经 2026-06-29、html5.qq.com 2026-06-30
一、DeepSeek-V4 正式版 5 件事:6/29-7/3 一周时间线
| 日期 | 事件 | 来源 |
|---|---|---|
| 2026-04-24 | V4 预览版上线 + 开源(1.6T 总参数 / 49B 激活 / 1M 上下文) | DeepSeek 微信公众号 |
| 2026-05-22 | V4-Pro 永久降价(原定价 1/5.33,比 Claude Opus 4.7 便宜 8 倍) | CSDN 2026-05-30 报道 |
| 2026-06-29 | DeepSeek 官宣 V4 正式版 7 月中上线 + 峰谷定价 | 贝壳财经 / 新浪科技 |
| 2026-06-30 | 价格表细则披露:V4-Pro 高峰 12 元/M、Flash 高峰 4 元/M | html5.qq.com 4 源交叉 |
| 2026-07-03 | 腾讯云公告:腾讯云 TokenHub + 智能体平台同步跟随 | 腾讯云官方通知 |
二、DeepSeek-V4 核心参数(一图速览)
| 维度 | V4-Pro | V4-Flash | 对标 |
|---|---|---|---|
| 总参数 | 1.6 万亿 | 2840 亿 | GPT-5.4 / Claude Opus 4.6 |
| 激活参数 | 490 亿 | 130 亿 | 同上 |
| 预训练数据 | 33T tokens | 32T tokens | 同上 |
| 上下文长度 | 1M tokens | 1M tokens | 1M+ 已成国产标配 |
| 编码能力 | SWE Bench 全球第一梯队 | 20 个真实任务赢 Pro 5 个 | 超越 Claude Opus 4.6 |
关键技术突破:Engram 条件记忆——把「记住事实」与「推理」分离,靠外部可检索知识库实现常数时间查找。在 100 万 Token 上下文下,V4-Pro 单 Token 推理计算量只有 V3 的 27%,KV 缓存占用仅 10%(CSDN 2026-04-27 详细解读)。
数据来源:DeepSeek 官方技术报告 2026-04-24、CSDN 2026-04-27《百万上下文普惠时代来临》、CSDN 2026-07-01《V4 全面超越 Claude Opus 4.6》
三、峰谷定价机制:7 小时翻倍、17 小时维持现价
高峰时段:每日 09:00-12:00 + 14:00-18:00(合计 7 小时/天),覆盖绝大多数企业的「上班干活时段」。
V4-Pro 价格表(每百万 tokens / 元人民币):
| 计费项 | 平时段 | 高峰时段 | 倍数 |
|---|---|---|---|
| 输入(缓存命中) | 0.025 | 0.05 | 2× |
| 输入(缓存未命中) | 3 | 6 | 2× |
| 输出 | 6 | 12 | 2× |
V4-Flash 价格表:
| 计费项 | 平时段 | 高峰时段 | 倍数 |
|---|---|---|---|
| 输入(缓存命中) | 0.02 | 0.04 | 2× |
| 输入(缓存未命中) | 1 | 2 | 2× |
| 输出 | 2 | 4 | 2× |
对比国际旗舰(5/29 价格表 $/M tokens):
- GPT-5.4(OpenAI):输入 2.50 / 输出 15.00(1.1M 上下文)
- Claude Opus 4.6(Anthropic):5.00 / 25.00(1.0M)
- Gemini 3.1 Pro Preview:2.00 / 12.00(1.0M)
- DeepSeek-V4-Pro 平时段:≈ 0.35 / 0.84 美元(按 7.16 汇率换算)——比 Claude Opus 4.6 便宜约 14-30 倍
数据来源:DeepSeek 官方公告 2026-06-29、腾讯云 2026-07-03、CSDN 2026-05-29《2026 年最全大模型 API 价格对比》
四、对企业 AI 落地的 5 个深层影响
信号 1:分时电价时代开启——「几点用」比「谁便宜」更重要 之前企业算 DeepSeek vs Claude vs Qwen 的「单 Token 价」就够了;现在还要考虑「我的批量推理任务能否排到晚 8 点后」。这意味着企业 AI 工程师开始变成电力调度员。
信号 2:开源旗舰价格已比闭源便宜一个数量级 按平时段汇率换算,V4-Pro 比 Claude Opus 4.6 便宜 14-30 倍——这条价格鸿沟会推动中国 SaaS 出海用 DeepSeek + 海外用闭源的双轨制落地。
信号 3:V4-Flash「便宜也能打」逻辑被实战验证 独立测试显示 Flash 在 20 个真实任务中赢 Pro 5 个——轻量版在不少场景下确实可替代旗舰。这把「快慢双轨」从架构选择升级为企业标配的省钱模板。
信号 4:腾讯云、阿里云等大厂主动跟随定价策略 腾讯云 7/3 公告明确「跟随原厂同步调整定价策略」——大模型 API 从「厂商单方面定价」变成「生态集体议价」。今后任何单一厂商的调价都会被市场追踪。
信号 5:「编码 + Agent」成为开源反超闭源的关键赛道 V4-Pro 在 Agentic Coding 实测体验优于 Claude Sonnet 4.5,交付质量接近 Opus 4.6 非思考模式(CSDN 2026-04-27)——「中国 AI 编码能力反超美国」从口号变成 benchmark 事实,对铂傲这类 AI 落地服务商是直接受益信号。
五、对西安铂傲的 1 个行动建议
铂傲当前帮客户落的 AI 助手大部分用 OpenAI/Anthropic,API 成本占项目毛利 15-25%。V4-Pro 平时段价是 Claude Opus 4.6 的 1/30——建议 7 月中正式版上线后:
- 第一阶段(2 周内):把所有非高峰时段的批量任务(数据清洗、报表生成、知识库向量化)切到 V4-Flash 平时段;
- 第二阶段(1-2 月):把对话主链路也切到 V4-Pro 平时段,保留 Sonnet 作为「高峰段紧急 fallback」;
- 客户告知:在 7 月客户报告中加一句「已切换到分时电价模式」,作为铂傲技术嗅觉的展示。
FAQ(高频问题直答)
Q1:高峰时段为什么是 09:00-12:00 + 14:00-18:00? A:覆盖企业用户白天集中使用的 7 小时,目的是用价格引导把高峰算力需求削峰填谷到深夜/清晨,提升资源利用率。
Q2:平时段比现售价格更便宜吗? A:不更便宜,持平。V4-Pro/Flash 平时段价格与 5/22 永久调价后的现价一致——只有高峰段上浮。
Q3:峰谷定价会不会让企业彻底放弃国际厂商? A:不会。夜间离线任务可享受分时电价;白天实时交互仍然考验模型能力上限,闭源旗舰在代码推理、长文理解仍有 5-15% 优势。
Q4:开源免费用户会受影响吗? A:不直接影响。官方聊天界面 chat.deepseek.com 仍免费,峰谷定价只针对 API 调用计费。
Q5:腾讯云 TokenHub 跟随后,其他云厂商(阿里、华为、火山)会跟进吗? A:大概率跟进。腾讯云公告用词「跟随原厂」已透露生态议价机制——这是大模型 API 从「厂商单边定价」转向「平台集体协商」的标志性事件。
Q6:V4 正式版相比 4/24 预览版会强化哪些能力? A:DeepSeek 官方只披露「功能优化与性能提升」,具体指标未公布。第三方预测集中在:(1)多模态补齐(V4-Pro 纯文本,缺视觉/语音原生);(2)Agent 工具调用稳定性;(3)超长上下文(1M+ → 4M)扩展。
关键术语(Key Terminology)
- 峰谷定价(Time-of-Use Pricing):源自电力行业,按用户使用时间分段定价的机制,目的是削峰填谷。DeepSeek 首次把它搬进 LLM API。
- V4-Pro / V4-Flash:DeepSeek 在 4/24 推出的双版本旗舰,Pro 对标闭源第一梯队,Flash 主打「低成本 + 高响应」。
- 1M tokens 上下文:单次对话可承载约 75 万中文字符或 50 万英文单词,足以装下一本中等厚度书籍。
- Engram 条件记忆:V4 核心架构创新,把知识存储与推理分离,是 100 万 Token 上下文仍能低延迟的关键。
- SWE Bench:软件工程实测基准,测模型在真实 GitHub Issue 上修 bug 的能力,是编码能力的「事实标尺」。
- 缓存命中(Cache Hit):当请求内容与之前相似,模型复用之前的 KV 缓存,价格比未命中低一个数量级。
- Agentic Coding:让 AI 自主调用工具、写代码、跑测试、修 bug 的工程能力,比单纯「补全代码」高一个维度。
参考资料
官方公告
- DeepSeek 官方公告《DeepSeek-V4 正式版 7 月中旬上线》(2026-06-29)
- 腾讯云《关于 DeepSeek-V4 正式版「原厂直供」模型发布计划及计费调整通知》(2026-07-03)
行业报道
- 贝壳财经《DeepSeek V4 正式版 7 月中上线,引入峰谷定价机制》(2026-06-29)
- 潇湘晨报 / 腾讯新闻《腾讯云宣布 DeepSeek-V4 正式版「原厂直供」模型拟于 7 月中旬上线》(2026-07-03)
- html5.qq.com《DeepSeek V4 正式版官宣 7 月中旬上线》(2026-07-02)
- html5.qq.com《高峰期价格翻倍!DeepSeek V4 正式版官宣》(2026-07-01)
技术解读
- CSDN《DeepSeek-V4 预览版正式发布:百万上下文普惠时代来临》(2026-04-27)
- CSDN《DeepSeek V4 震撼登场:开源模型性能逆袭,全面超越 Claude Opus 4.6》(2026-06-30)
- CSDN《DeepSeek V4-Pro 永久降价与 Composer 2.5 发布》(2026-07-02)
价格对比与背景
- CSDN《2026 年最全大模型 API 价格 / 速度 / 中文能力对比(5 月更新版)》(2026-05-29)
- SegmentFault 思否《大模型测评完全指南:2026 年主流 LLM 评测体系》(2026-03-11)
- 36 氪《2025 年「大模型价格战」不怕亏钱了?》(2025-01-16)