ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

DeepSeek-V4-Pro 正式版低调上线:百万上下文旗舰模型进入 GA 时代(0813 版数据)

2026/8/14 3:32:24 拓冰建站 浏览量
DeepSeek-V4-Pro 正式版低调上线:百万上下文旗舰模型进入 GA 时代(0813 版数据)

DeepSeek-V4-Pro 正式版低调上线:百万上下文旗舰模型进入 GA 时代(0813 版数据)

摘要:2026 年 8 月 12 日深夜,DeepSeek 将旗舰模型 DeepSeek-V4-Pro 从预览版切换为正式版(构建号 0813),未发布单独的博客公告,仅通过 API 定价页与 OpenRouter 静默更新。本文全部数据截至 2026-08-13,基于官方一手信源与当日权威媒体交叉核实,附与其他主流模型的参数对比,供开发者与技术写作者参考。


一、事件时间线:从预览到正式版

时间事件信源
2026-04-24DeepSeek-V4 系列预览版上线并开源(MIT 协议),Pro 与 Flash 双模型齐发,1M 上下文成为官方标配官方新闻(news260424)
2026-07-31DeepSeek-V4-Flash 正式版 API 上线公测(后端版本 Flash-0731);官方预告"V4-Pro 正式版将尽快发布"官方更新日志(2026-07-31 条目)
2026-08-12 深夜API"模型与价格"页面将deepseek-v4-pro对应版本更新为DeepSeek-V4-Pro-0813;OpenRouter 同步上线deepseek/deepseek-v4-pro-0813并标记为 GA 发布官方定价页(2026-08-12 更新)、OpenRouter
2026-08-13官方群组发布 0813 与 Claude Fable 5 等模型的 Agent 基准对比表;中英文媒体(Yahoo Finance、Unite.AI、DigitalToday、钜亨网等)集中跟进报道多方交叉验证

重要的两点事实澄清(截至 8 月 13 日):

  1. 官方更新日志仍无 8 月条目,最新一条停留在 7 月 31 日的 Flash 版本更新——这是"API 层面静默上线",不是"产品发布公告"。
  2. DeepSeek 官方定价页(2026-08-12 更新)明确注明:“计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用,具体方案以正式通知为准。”当前价格仅为现行价格。

二、正式版核心规格速览(官方定价页 2026-08-12 数据)

项目DeepSeek-V4-Pro-0813DeepSeek-V4-Flash-0731
模型标识deepseek-v4-prodeepseek-v4-flash
总参数量 / 激活参数量1.6T / 49B(MoE)284B / 13B(MoE)
上下文长度1M tokens1M tokens
最大输出长度384K tokens384K tokens
输入价格(缓存未命中)$0.435 / M tokens(3 元)$0.14 / M tokens(1 元)
输入价格(缓存命中)$0.003625 / M tokens(0.025 元)$0.0028 / M tokens(0.02 元)
输出价格$0.87 / M tokens(6 元)$0.28 / M tokens(2 元)
接口兼容OpenAI ChatCompletions、Anthropic API、Responses API、JSON Output、Tool Calls、FIM(仅非思考模式)、对话前缀续写(Beta)同左
并发限制5002500
思考模式非思考 / 思考(默认),reasoning_effort支持 high / max同左

⚠️注意:表中为官方现行价格,官方已预告近期将整体上调(涨幅较大),请以正式调价通知为准。

三、与其他主流模型的参数对比(2026-08-13 数据)

以下是 DeepSeek-V4-Pro 正式版与当前主流模型(截至 2026 年 8 月)的参数与规格横向对比:

模型厂商总参数量激活参数量上下文开源情况输入/输出价格($/M tokens)
DeepSeek-V4-Pro-0813DeepSeek1.6T49B1M预览版权重已开源(MIT);0813 权重未发布0.435 / 0.87
DeepSeek-V4-Flash-0731DeepSeek284B13B1MMIT(预览版权重已开源)0.14 / 0.28
Kimi K2.6月之暗面约 1000B约 32B256K开源权重约 0.60–0.70(参考)
MiniMax M1MiniMax456B45.9B1M开源权重
DeepSeek-V3.2(前代旗舰)DeepSeek约 685B约 37B128K开源0.28 / 0.42(历史价格)
Claude Fable 5Anthropic未公开未公开未公开闭源10 / 50
GPT-5.6 / GPT-5.6 SolOpenAI未公开未公开未公开闭源未公布
Gemini 3.1 ProGoogle未公开未公开1M+闭源未公布
Grok 4.6xAI未公开未公开未公开闭源未公布
Claude Opus 4.8Anthropic未公开未公开未公开闭源未公布

解读:

  1. 开源阵营参数量之最:V4-Pro 的 1.6T 总参数是当前开源权重模型中最大的 MoE 之一(官方对比表同场出现的 Kimi-K3、GLM-5.2 等新一代开源模型尚未公布完整参数)。但其激活参数仅 49B,激活比例约 3%,与 Kimi K2.6(约 3.2%)、MiniMax M1(约 10%)同属"大总量、低激活"的稀疏激活路线——总参数量大不代表推理成本高。
  2. 上下文是最大差异化优势:1M 上下文在开源旗舰中仅 MiniMax M1 同级别;对比前代 V3.2(128K)提升了 8 倍,对比 Kimi K2.6(256K)高出 4 倍。
  3. 闭源旗舰参数一律保密:Fable 5、GPT-5.6、Gemini 3.1 Pro、Grok 4.6 均不公开参数量,只能从基准与价格维度对比(见第五节)。
  4. 价格断层明显:V4-Pro 现行输出价仅为 Claude Fable 5 的1/57($0.87 vs $50),输入价为1/23($0.435 vs $10),缓存命中价差更达1/276;等量输入输出混合估算,综合便宜约46 倍。但注意:官方已预告涨价,这一价差窗口可能收窄。

四、技术架构亮点(依据官方技术报告 arXiv:2606.19348)

  1. 混合注意力架构(CSA + HCA):在 token 维度压缩 KV 缓存,结合压缩稀疏注意力与重度压缩注意力,大幅降低长上下文场景的计算与显存开销。
  2. 流形约束超连接(mHC):升级传统残差连接,增强深层建模能力。
  3. Muon 优化器:加速收敛、提升训练稳定性。
  4. 稀疏注意力(DSA)机制:序列维度压缩,实现全球领先的长上下文效率。
  5. FP4 + FP8 混合精度:MoE 专家权重与 QK 路径采用 FP4 量化感知训练,减少显存与算力消耗。

效率增益:在 1M 上下文场景下,V4-Pro 单 token 推理 FLOPs 仅为 V3.2 的27%,KV 缓存仅为 V3.2 的10%;V4-Flash 更低至 FLOPs 10%、KV 缓存 7%。

五、性能与基准测试:官方 0813 Agent 对比表(8 月 13 日发布)

8 月 13 日,DeepSeek 官方群组发布了 V4-Pro-0813 与 Anthropic Claude Fable 5(with fallback 配置)的 Agent 基准对比表,也是本次升级最受关注的资料:

基准DeepSeek-V4-Pro-0813Claude Fable 5差距
HLE(无工具 / 带工具)42.7 / 60.053.3 / 63.0落后 10.6 / 3.0
Terminal Bench 2.187.988.0落后 0.1
CyberGym83.383.1领先 0.2
DeepSWE62.770.0落后 7.3
Toolathlon-Verified74.177.9落后 3.8
AutomationBench (Public)31.829.1领先 2.7
DSBench-FullStack71.177.2落后 6.1
DSBench-Hard67.268.3落后 1.1

结论:

  • 9 项可比基准中 Fable 5 平均领先约5.3%,但 V4-Pro 在 CyberGym、AutomationBench 两项实现反超,Terminal Bench 2.1 几乎持平(差 0.1);
  • 该对比表为DeepSeek 官方群组披露、厂商自报数据,Fable 5 侧为 fallback 配置,且官方更新日志尚未正式公布 0813 完整基准,分数仍有待独立第三方复测(8 月 13 日 Hacker News 已有真实用户 Codex 实测:V4-Pro-0813 完成同任务耗时更长但成本仅约 1/12);
  • 相比 4 月预览版,官方宣称 0813 后训练带来明显的 Agent 能力跃升,此前的预览版评测数据已不具备参考价值。

六、对开发者与生态的影响

  1. API 调用零迁移成本base_url不变,model="deepseek-v4-pro"即自动指向 0813 正式版:
fromopenaiimportOpenAI client=OpenAI(api_key="your-api-key",base_url="https://api.deepseek.com",)response=client.chat.completions.create(model="deepseek-v4-pro",# 当前自动指向 DeepSeek-V4-Pro-0813messages=[{"role":"user","content":"请分析这段一页纸的协议"}],max_tokens=4096,)print(response.choices[0].message.content)
  1. Agent 能力是本次升级的主线:V4 系列针对 Claude Code、OpenCode、CodeBuddy 等主流 Agent 产品做了专项适配优化;官方建议复杂 Agent 场景使用思考模式并设置reasoning_effort=max
  2. 开源生态待补最后一块拼图:Hugging Face 仓库目前仍无 8 月 commit 或 0813 标签,最新提交停留在 6 月 22 日技术报告更新,0813 权重尚未发布,外部验证需等待官方权重更新。
  3. 旧模型名退役:官方 2026-04-24 公告明确deepseek-chatdeepseek-reasoner将于 2026-07-24 停止使用(此前分别映射deepseek-v4-flash非思考 / 思考模式),存量代码需确认已迁移至新模型名。
  4. 成本提示:官方已预告 API 定价将整体上调且"涨幅较大",建议在调价正式落地前评估用量与预算,或利用当前窗口测试 Agent 工作流成本模型。

七、精选文章规则(信息选择方法论)

本文撰写过程中遵循以下精选文章规则(含本次新增的"数据新鲜度"强化条款),亦可供技术博客作者复用:

  1. 一手信源优先:官方文档(api-docs.deepseek.com)、官方定价页、官方更新日志、官方技术报告(arXiv)为最高优先级;凡官方可核实的事实不引用二手转述。
  2. 交叉验证:对"静默发布"类事件,至少选取 2 家以上独立媒体(Unite.AI、DigitalToday、钜亨网、Yahoo Finance 等)交叉核对版本号、价格、时间等关键事实。
  3. 区分公告与推断:明确标注"官方确认"(定价页版本号、OpenRouter GA)与"媒体推断 / 社群披露"(官方群组基准表、评测剧透)两类信息,不以推断充当事实。
  4. 数据新鲜度校验(强制):仅采用事件前后 48 小时内的数据与公告;对"计划""预告"类信息(如涨价通知、7 月中上线计划)标注状态,不作为已发生事实;官方已更新的数据(如 0813 版本号、现行价格)一律以最新页面为准,删除所有被取代的旧数据(如 4 月预览版评测、7 月旧价格)。
  5. 参数数据溯源:参数量、上下文、价格等硬数据回到厂商官方仓库 / 技术报告 / 定价页;第三方聚合(如 Artificial Analysis)数据仅在官方缺失时使用并注明来源。
  6. 标注引用:正文关键论断均附参考链接(见文末),方便读者回溯验证。

八、原创性说明

  • 本文为原创撰写,所有叙述、归纳、对比表格与代码示例均为独立整理与创作,未复制任何媒体原文段落;
  • 全部数据截至2026-08-13,事实性数据均来自文末所列公开信源并逐项核对;
  • 观点性内容(如"静默上线的意义"“性价比分析”)为作者个人分析,与任何厂商无关;
  • 转载本文请注明出处;引用数据请保留原始信源链接并注意时效。

参考资料(均为 2026-08 最新信源)

  1. DeepSeek 官方"模型与价格"页(2026-08-12 更新,0813 版本号与现行价格、涨价预告):https://api-docs.deepseek.com/zh-cn/quick_start/pricing/
  2. DeepSeek 官方更新日志(最新条目 2026-07-31):https://api-docs.deepseek.com/zh-cn/updates
  3. DeepSeek V4 预览版官方新闻(2026-04-24):https://api-docs.deepseek.com/zh-cn/news/news260424
  4. DeepSeek-V4 技术报告(arXiv 2606.19348):https://arxiv.org/html/2606.19348
  5. Hugging Face 模型仓库:https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro
  6. OpenRouter 0813 GA 模型页:https://openrouter.ai/deepseek/deepseek-v4-pro-0813
  7. Kingy.ai《DeepSeek V4 Pro 0813 vs Fable 5: Fact-Check》(2026-08-12):https://kingy.ai/blog/deepseek-v4-pro-0813-fable-5-price-fact-check/
  8. DigitalToday《DeepSeek releases official V4 Pro model; 46 times cheaper than Claude》(2026-08-13):https://www.digitaltoday.co.kr/en/view/92711/
  9. Unite.AI《DeepSeek Ships V4 Pro as Its Flagship Model Leaves Preview》(2026-08-12):https://www.unite.ai/deepseek-ships-v4-pro-as-its-flagship-model-leaves-preview/
  10. 钜亨网《DeepSeek V4 Pro 突襲上線》(2026-08-13):https://www.cnyes.com/news/id/6574411
  11. Hacker News 讨论帖(开发者实测,2026-08-12):https://news.ycombinator.com/item?id=49274600
  12. Artificial Analysis 模型对比(Kimi K2.6 / V3.2 参数口径):https://artificialanalysis.ai/models/comparisons/kimi-k2-6-vs-deepseek-v3-2
  13. MiniMax M1 官方仓库(456B / 45.9B 参数):https://github.com/minimax-ai/minimax-m1

本文数据截至 2026-08-13;官方更新日志、0813 权重发布或调价落地后相关数据可能变化,请以官方最新页面为准。