Skip to content
Original
Chen Dahuang · AI Coding 实录·· 08/05/2026AI score66

DeepSeek V4 Flash 正式版深度体验:便宜、快、1M 上下文、内置搜索

The title and summary in the selected language are awaiting translation.

AI overview

作者深度体验几天 DeepSeek V4 Flash 0731 正式版后总结:便宜到跑批处理、Agent 循环和几十轮对话账单基本无感,速度快到配合 Agent 工具循环每步几秒内完成,1M 上下文可容纳整个仓库和完整对话历史、无需频繁 compact,结合 Cache 打折长上下文成本还能再降。

Full text

The full text in the selected language is awaiting translation. The original is shown for now.

深度体验了几天的 DeepSeek V4 Flash 0731 正式版,总结一下它的优缺点。

优点一:便宜,极度的便宜

便宜到脏活累活可以全都交给它干,没有任何心理负担。用到就是赚到——节省下来的时间价值,都能买更多 Token 了。

有多便宜?我的使用体感是:跑批处理、跑 Agent 循环、跑几十轮对话,账单基本无感。AI 最贵的不是算力,是"不敢用"的心理门槛。V4 Flash 直接把这道门拆了。

优点二:速度快

这是很重要的一点。你也不希望一个任务跑两个小时再回来验收吧?

Flash 模型给我的体感就是快如闪电、言出法随。写代码、改 bug、跑测试、批量处理,反馈是即时的。尤其是配合 Agent 工具循环,每一步都在几秒内完成,交互体验完全不一样。

优点三:上下文长

1M 的上下文,可以容纳大多数复杂的任务,不需要频繁 compact。

以前用短上下文模型,代码库看几眼就满了,得靠各种压缩技巧省空间。现在直接把整个仓库、整批文档、完整对话历史扔进去,它还装得下。结合 Cache 打折,长上下文场景可以做到非常便宜——重复内容命中缓存,价格直接砍半还多。

优点四:官方内置联网搜索

官方 Responses 接口内置了服务端 web-search,不用任何配置,直接享受搜索服务。

对时效性内容、Agent 查资料场景,这是刚需。不用自己对接搜索引擎、不用申请搜索 Key,官方托管整个流程。展开讲见这篇:DeepSeek API 内置联网搜索,Responses API 白嫖官方搜索能力

优点五:开源,不绑定供应商

你可以选择任何一家模型服务商来部署或转售,不用担心供应商绑定。

不用再去祈祷某些闭源厂家可怜的 Reset 施舍。开源意味着生态、意味着选择权、意味着你能把模型嵌入自己的产品而不被卡脖子。

缺点:不支持多模态

读图、看图场景有局限。但这是"便宜"的必要代价——多模态会导致模型参数膨胀,成本就上去了。

解法也很简单:组合使用。需要识图的时候,把图片交给专门的视觉模型处理,文本推理继续用 V4 Flash。我调研了目前性价比最高的识图方案,见这篇:给 DeepSeek 补上多模态:Qwen-3.7-Flash 识图方案

我的结论

V4 Flash 是那种"日常主力"级别的模型:便宜到随便用、快得没脾气、上下文大到不用省、还带搜索。

团队里干活,脏活累活全丢给它;需要视觉的时候,旁边配一个识图模型组合出招。这套组合拳打下来,成本低、体验好、不绑死任何一家。

相关阅读:DeepSeek API 内置联网搜索

Source: Chen Dahuang · AI Coding 实录 · chendahuang.com