ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

DeepSeek V4 Flash实测!1.6亿Token只花9块钱?

2026/8/3 15:37:33 拓冰建站 浏览量
DeepSeek V4 Flash实测!1.6亿Token只花9块钱? 本文整理自B站「1.6亿Token只花9块DeepSeek V4 Flash实测梁圣还是梁子」通过音视频转图文工具Ai好记转录整理以下为精炼整理后的内容。DeepSeek V4 Flash终于发布了。这次更新不是基础模型的重训而是在V4的基础上做后训练优化大幅提升了Agent能力基准测试分数直接超过了V4 Pro。但有个遗憾——它依然没有多模态能力是个「瞎子」。本期视频博主「神烦老狗」做了详细实测从编程到创意设计消耗1.6亿tokens总花费9块钱左右。V4 Flash的核心变化后训练驱动的Agent能力跃升这次V4 Flash的定位很明确不是全新模型而是基于V4的后训练优化版本。从公布的基准测试来看得分远超V4 Pro说明后训练策略确实有效。不过对比预览版提升幅度并没有想象中那么大。博主原话是「跟之前的预览版相比提升非常多」但实际测试中还是暴露了不少问题。另外有个小插曲GLM-52几乎被V4 Flash全面超越而智谱刚刚对模型进行了涨价时机上有点尴尬。博主调侃说梁文峰是看了帖子之后才决定发布的——「懦弱之举我绝不姑息」。编程实测20种风格个人网站十分钟搞定第一个测试是让V4 Flash开发20种风格迥异的个人网站要求独立设计不能简单换皮。速度确实快十分钟就完成了全部20个。但质量参差不齐极简风和拟态风格表现稳定赛博朋克和日式和风有模有样但部分风格出现了重复跟第二个一模一样还有几个明显是「没活了硬凑」。切换到max思考强度后质量有明显提升。新粗野主义、黑客终端、玻璃拟态、千禧年怀旧、暗黑学院……每个风格的对味程度都比high模式好不少。尤其是瑞士国际主义风格排版确实不错但因为没有视觉能力背景处理上吃了亏。博主对这些设计风格的评价带着明显的个人色彩——「我靠这太千禧年了」「这个味道有点正啊」「神烦我靠真的跟个月饼似的」——这种口语化的评测风格反而让测试结果更有参考价值。游戏开发能跑但小毛病不断经典的超级马里奥游戏测试High模式下角色元素缺失怪和金币都看不到。Max模式下有所改善但画面一直在闪体验只能说勉强及格。CSCounter-Strike的Web版测试更让人头疼——穿模问题反复出现修改了三轮都没解决。摄像机架在奇怪的位置视野被遮挡还有奇怪的「小个子」角色。博主玩了一会儿就放弃了直言「头已经晕得很难受了」。不过地图制作和整体画面结构还是不错的只是细节打磨上明显不够。实战项目无限画布工具20分钟迭代修复博主设计了一个实际项目做一个悬浮窗工具截图后粘贴到无限画布中自动排布方便录屏时展示素材。第一版有三个问题拖动卡片时鼠标会跳到左上角、素材连线需要点菜单栏而不是拖拽、悬浮窗太小。修复耗时将近20分钟最终版解决了连线问题但卡片移动和框选功能还有优化空间。这个测试的价值在于展示了V4 Flash在实际项目中的迭代能力——能理解需求、能发现问题、能修复但速度和精度都不如Claude Codex这类专门的编程Agent。成本分析1.6亿Token9块钱整个测试过程中一共请求了1249次消耗了1.6亿tokens总花费约9块钱。这个价格确实便宜。对比其他模型API的价格V4 Flash的性价比优势很明显。当然博主自己也说了这是按API价格计算的实际使用场景中可能会有所不同。总结有性价比但更期待Pro博主的最终评价很直接「我并不喜欢这次发布的模型因为没有多模态。」他认为梁文峰对C端和多模态的重视程度不够总结起来就是四个字主不在乎。但他也承认V4 Flash是一个不错的模型有性价比能力也更强了。更值得期待的是8月初将发布的Pro版本。至于发布时间——博主调侃说梁文峰的时间观念跟普通人不太一样7月中旬发布的模型拖到了现在也算是「重新定义了一下中旬」。以上内容由Ai好记转录整理。Ai好记 是一款音视频转图文笔记的 AI 学习助手支持 B站、抖音、小宇宙等平台链接及本地音视频文件转入后自动生成精华速览、思维导图和结构化笔记帮助你把几小时的视频内容变成可搜索、可复习的图文笔记。