大家好,我是蓝戒。本篇我们来聊聊:“DeepSeek V4 Flash (0731)正式版开源”。
AI 圈子里最不缺的就是“性能暴打”的PPT,但真正能让开发者深夜狂欢、让友商会计汗流浃背的,永远是那个把价格杀到骨折还顺手把性能拉满的“卷王”——没错,DeepSeek 又带着它的正式版模型来砸场子了!
7月31日,DeepSeek 官方正式上线了 DeepSeek-V4-Flash-0731 正式版 API,并同步开源了权重。没有虚头八脑的预热,也没有花里胡哨的定级,这个拥有 284B 总参数、13B 激活参数的“小钢炮”,直接用实力和极致性价比给大模型市场上了一课。
1. 154分的飙升:代码与 Agent 能力直接炸场
很多朋友可能会问:此前不是已经有 Preview(预览版)了吗?这次 0731 正式版到底变强在哪里?
答案只有四个字:编程与智能体(Agent)。
在权威的 Frontend Coding Arena 榜单中,DeepSeek V4 Flash 相比此前的预览版本,单次更新直接拉升了 154 分!这个涨幅在顶级竞技场里堪称奇迹。我们来看看它最新的战报:
- 全球综合排名:第 7
- 总得分:1586 分
- 开源模型领域:全球第 3
- 消费级产品领域:全球第 4
- 细分赛道:Data & Analysis、Reference Design、Game 三项分类高居第 6,Brand & Marketing 斩获第 7
除了前端代码强得离谱,官方后训练(Post-training)更是重构了其 Agent 执行链。在带推测解码(DSpark)加持下,它的各项基准直接把上一代甚至更高规格的模型踩在脚下:
基准硬实力对比:
- Terminal Bench 2.1(终端命令行 Agent):得分 82.7(预览版仅 61.8)
- DeepSWE(软件工程代码 Agent):得分 54.4(预览版仅 7.3)
- Toolathlon-Verified(复杂工具调用):得分 70.3(Preview 为 55.9)
更让开发者省心的是,这次正式版原生支持 OpenAI Responses API,并针对 Codex、Claude Code、VS Code 等主流编程助手进行了深度适配。你不需要改一行复杂的适配代码,直接把后端配置换成 DeepSeek,就能享受到媲美闭源顶尖大模型的 Coding 体感。
2. 价格低得“离谱”:友商直接看懵了
如果说能力提升只是“意料之中”,那公布成本价格的那一刻,全网开发者是真的“眼眶一湿”。
有开发者公布了三个模型在执行完全相同任务时的实测成本对比:
| 模型 | 相同任务花费成本 |
| DeepSeek V4 Flash | $0.0005 |
| DeepSeek V4 Pro | $0.0008 |
| GLM 5.2 | $0.0480 |
算一算账就知道,在完成同样的工作量时,GLM 5.2 的成本竟然是 DeepSeek V4 Flash 的近百倍!
这种“白菜价”对于运行复杂 Agent 工作流的开发者来说,无异于降维打击。
- 真实测试 1:有开发者使用 Hermes Agent 驱动 DeepSeek V4 Flash 连续不间断运行了 32 分钟,最后账单结算:仅花 0.07 美元(约合 5 角钱)!这意味着挂着 Agent 全天候帮你干活,一天也就几美元。
- 真实测试 2:另一位开发者实测全套 Agent 密集任务,依靠 DeepSeek 极其优秀的上下文缓存机制,Cache 命中率高达 99.5%,完成整套复杂任务仅耗费了 0.78 元人民币!
对于每天频繁调用 API、反复刷 Context 的开发者而言,这不仅仅是降本,更是直接把“Token 焦虑”彻底抹平了。
3. 社区反馈:48小时消耗8万亿 Tokens,圈子炸了
如此极致的性价比加持下,社区的狂欢程度可想而知。
根据开源社区 OSCHINA 的数据,V4 Flash 0731 发布后不到 48 小时,仅 OpenCode 一家的单日消耗量就狂飙到了 8T Tokens!全网开发者都在抓紧时间把原本昂贵的闭源模型后端替换为 DeepSeek V4 Flash。
有海外开发者在 X(原 Twitter)上调侃:“以前我用顶级闭源模型跑 Agent,每按一次 Enter 键心里都在滴血;现在换上 DeepSeek V4 Flash,我感觉自己像开了无限 Token 挂的超级大户。”
当然,中肯地说,V4 Flash 在面对非常复杂的上下文场景(如大型游戏引擎全量代码解构)时,偶尔仍会出现 Prompt 爆满的情况,但在常规全栈开发、前端生成、自动化工具调用以及Sub-Agent调度等绝大多数场景下,它的综合表现已经完全匹配甚至超越了许多昂贵的闭源模型。
4. 零门槛体验:手把手教你爽一把
如果你迫不及待想体验一下,目前主要有两种接入方式:
方式一:直接调用官方 API
官方 API 接口无缝升级,调用方法与此前完全一致,只需将模型名称指定为 deepseek-v4-flash 即可自动享受 0731 正式版的性能增强。
方式二:白嫖 Hugging Face 免费公共 Endpoint
如果你暂时不想绑定信用卡申请 API Key,有热心开发者已经在 Hugging Face Inference Endpoints 上部署了免费公共服务:
- 特点:完全免费、无需注册 Token、完全兼容 OpenAI API 标准格式
- 试用地址:
[https://huggingface.co/spaces/victor/DeepSeek-V4-Flash-0731-free-endpoint](https://huggingface.co/spaces/victor/DeepSeek-V4-Flash-0731-free-endpoint)
提示:公共服务资源由社区共享,可能会遇到轻度限流,生产环境建议还是直连官方 API 或者自建部署哦!
总结
DeepSeek V4 Flash 0731 正式版的开源发布,再次向业界证明了:大模型的高性能与低成本完全可以兼得。对于绝大多数开发者和中小企业来说,这绝对是当下搭建 AI Coding 助手和 Agent 工作流综合性价比最高的方案,没有之一。
文章评论