ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

【AI】DeepSeek-V4-Flash-0731:更便宜的模型,反超自家旗舰

2026/8/5 19:19:56 拓冰建站 浏览量
【AI】DeepSeek-V4-Flash-0731:更便宜的模型,反超自家旗舰 AI 技术日报 · 2026 年 8 月 3 日聚焦国内大厂的大模型技术动态精选近日重点新闻并整理为中文技术速览。本期主题DeepSeek 掀起新一轮价格与 Agent 能力战、阿里通义千问冲刺 2.4 万亿参数旗舰、字节 Seedance 2.5 把 AI 视频推进「一镜到底」时代。目录一、DeepSeek-V4-Flash-0731更便宜的模型反超自家旗舰二、阿里通义千问 Qwen3.8-Max2.4 万亿参数冲击第一梯队三、字节 Seedance 2.5单次生成 30 秒、音画一体的 AI 视频四、国内大模型格局从「一家独大」到「群雄逐鹿」写在最后一、DeepSeek-V4-Flash-0731更便宜的模型反超自家旗舰7 月 31 日DeepSeek 正式发布DeepSeek-V4-Flash-0731并开启 API 公测。这不是一次简单的版本号更新而是把「低价」和「Agent 能力」两件事同时推到了新高度。核心看点价格几乎贴地百万 token 输入$0.14cache-miss、输出$0.28命中缓存的输入低至$0.0028/百万 token。对于需要反复携带仓库上下文、长时间运行的编码 Agent 来说缓存复用带来的成本下降尤其明显。小模型反超大模型经过重新训练post-training后参数更小的 V4-Flash 在9 项 Agent 基准上反超了自家旗舰 V4-Pro-Preview。其中 Terminal Bench 2.1 从 V4-Pro-Preview 的72.1、Flash-Preview 的61.8提升到82.7DeepSWE 更是从预览版的7.3直接跳到54.4这是一次数量级级别的跃升。工程能力对齐主流生态新版原生支持 Responses API并完整兼容 Codex 类工具链意味着开发者可以近乎「无痛」地把现有 Agent 工作流迁移过来。技术背景DeepSeek V4 系列采用 MoE混合专家架构旗舰版 V4-Pro 为 1.6 万亿总参数 / 49B 激活参数V4-Flash 为 284B 总参数 / 13B 激活参数主打「快、省、够用」。V4-Pro 在 SWE-bench Verified 上的成绩约为80.6%与顶尖闭源模型仅有零点几个百分点的差距而输出价格仅为对方的零头。为什么值得关注这轮发布进一步坐实了业界所说的「AI 能力向零成本竞速race to zero」——最聪明的一批编码模型正在快速变成随取随用的廉价基础设施。对国内开发者而言这直接降低了把 Agent、自动化编码接入生产环境的门槛。二、阿里通义千问 Qwen3.8-Max2.4 万亿参数冲击第一梯队7 月 19 日在上海举行的世界人工智能大会WAIC上阿里通义千问团队预览了新一代旗舰模型Qwen3.8-Max把国内的「万亿参数竞赛」又推高了一档。核心看点2.4 万亿参数、原生多模态Qwen3.8-Max 为稀疏 MoE 架构声称支持文本、图像、视频、文档等多模态输入配备100 万 token 上下文窗口。对标第一梯队阿里官方将其定位为「仅次于 Anthropic Claude Fable 5」的模型是目前通义系列最激进的一次能力宣示。发布节奏极密这次预览紧随 Moonshot AI 的 Kimi K32.8 万亿参数开放权重之后仅 3 天推出。同期通义还密集放出了 Qwen-Audio-3.0-TTS、Qwen-Image-3.0 等多个旗舰级模型。需要冷静看待的地方值得注意的是Qwen3.8-Max 目前仍为Preview预览状态发布时并未公开完整的基准测试数据也未同步开放可下载权重而是先通过阿里的 Token 订阅计划以 API 形式提供。这与通义早期高举「开放权重」旗帜的路线形成了一定反差业界普遍将其解读为国内头部厂商在旗舰模型上「向闭源商业化倾斜」的信号。为什么值得关注参数规模已经不是唯一看点真正的悬念在于 2.4 万亿参数能否兑现「第一梯队」的宣传以及阿里会在多大程度上坚持开放路线。对做应用落地的团队来说先关注其 API 能力、上下文长度与实际推理成本比追逐参数数字更有价值。三、字节 Seedance 2.5单次生成 30 秒、音画一体的 AI 视频7 月 31 日字节跳动 Seed 团队正式发布新一代视频生成模型Seedance 2.5把 AI 视频从「拼接短片段」推进到了「一镜到底」的阶段。核心看点单次生成 30 秒单次生成时长从上一代的 15 秒直接翻倍到30 秒并支持多次续写延长。这打破了业界普遍卡在 10~15 秒的限制。音画一体一次生成视频与音频在同一次推理中联合生成无需事后配音、对轨主打「一镜成片one-take creation」。多模态编辑与灵活引用新增更强的多模态编辑能力和灵活的参考referencing机制面向影视、广告等专业创作场景。产品落地Seedance 2.5 走的是闭源商用路线率先在字节的即梦 AIJimeng和豆包专业版Doubao Pro上线API 服务随后通过火山引擎Volcano EngineArk / 方舟平台开放。作为对照同日 MiniMax 发布的竞品 H3 则选择了开源路线——「开源 vs 闭源」的分野在 AI 视频赛道上同样清晰。为什么值得关注视频时长和音画一体化是 AI 视频能否真正走进专业生产流程的两个关键卡点。Seedance 2.5 在这两点上的突破配合字节「豆包 Seedance 自研芯片」的全栈布局正在把 AI 视频从「玩具级 Demo」推向「可用于商业内容生产」的门槛。四、国内大模型格局从「一家独大」到「群雄逐鹿」把上面几条新闻拉远来看可以清晰感受到 2026 年年中国内大模型格局的一个转变从「一家独大」变成「群雄逐鹿」的多线战场。当前活跃在一线的国产模型至少包括厂商代表模型主要标签阿里巴巴通义千问 Qwen3.8-Max2.4T 参数、多模态、100 万上下文DeepSeekDeepSeek-V4 系列MoE、极致性价比、强 Agent 能力字节跳动豆包 Doubao / Seedance 2.5全栈布局、AI 视频、自研芯片月之暗面Kimi K32.8T 参数、开放权重智谱GLM 系列通用大模型百度文心 ERNIE通用大模型MiniMaxH3开源 AI 视频几个值得关注的行业信号用户规模分化据外媒援引的数据截至 2026 年 3 月字节豆包月活约 3.45 亿明显领先于通义约 1.66 亿和 DeepSeek约 1.27 亿。C 端入口的争夺已经进入白热化。价格战常态化DeepSeek 持续用极低价 API 拉低整个市场的价格锚点「性价比」正在成为国产模型对外竞争的核心武器之一。开源与闭源的路线分野同一天里Seedance 2.5 选择闭源商用、MiniMax H3 选择开源Qwen 旗舰也从早期的开放权重转向 API 优先。开源与闭源并非谁对谁错而是不同厂商基于商业化节奏做出的不同取舍。落地生态扩张苹果 Apple Intelligence 已获批在中国市场落地并与阿里、百度等本土厂商合作适配——这意味着国产大模型正在从「自家 App」走向更广泛的系统级入口。⚠️数据说明文中涉及的月活、估值、部分基准分数来自公开报道整理可能与官方口径存在差异请以各厂商官方发布为准。写在最后回顾这几天的动态一句话总结国内大厂在「更强、更便宜、更全栈」三条线上同时发力。DeepSeek 用价格和 Agent 能力重塑成本曲线阿里用超大参数冲刺能力上限字节用 Seedance 打通 AI 视频的生产闭环。对开发者而言现在是把大模型能力接入实际业务的绝佳窗口期——尤其是编码 Agent 和多模态内容生成两个方向。如果这篇速览对你有帮助欢迎点赞、收藏、关注我会持续跟进国内 AI 技术的重点动态。有想深入了解的具体模型或方向也可以在评论区告诉我。参考来源DeepSeek’s new bargain model accelerates AI’s race to zero — AxiosDeepSeek V4 Flash 0731 Launches Public Beta with Price Held at $0.14 — XenoSpectrumDeepSeek-V4-Flash-0731: Codex Support, $0.14/$0.28 Pricing — explainXDeepSeek V4 Preview Release — DeepSeek 官方 API 文档Qwen 3.8 Max review: Alibaba’s 2.4T flagship, tested (2026) — eesel AIAlibaba unveils Qwen 3.8 Max days after Kimi K3 — The Indian ExpressIntroducing Seedance 2.5 — ByteDance Seed 官方博客ByteDance Releases Seedance 2.5 — the-decoderByteDance pushes full-stack AI: Doubao, Seedance, own chips — AI WeeklyThe Rise of Chinese AI Companies — Future Startup本文由自动化任务于 2026-08-03 整理生成内容基于公开网络报道仅供技术交流参考。