DeepSeek-V4-Flash 正式版发布:官方适配 Codex,Agent 能力大升级
发生了什么
7 月 31 日,DeepSeek 更新官方日志:DeepSeek-V4-Flash 正式版 API 上线公测。距离预览版亮相只过了几周,这次转正的重点非常明确——Agent 能力。
和大模型发版喜欢先讲参数规模的惯例不同,V4-Flash 正式版(版本号 0731)与预览版采用完全相同的模型结构和尺寸,官方明确表示这轮提升主要来自重新后训练。换句话说,模型没有变大,只是被调教得更会干活了。
跑分说话
官方公布了多项 Coding Agent 基准测试成绩,正式版全面超过了此前的 V4-Pro-Preview:
| 基准测试 | V4-Flash 正式版得分 |
|---|---|
| Terminal Bench 2.1 | 82.7 |
| Cybergym | 76.7 |
| Toolathlon Verified | 70.3 |
| DSBench-FullStack(内部全栈开发测试) | 68.7 |
| DSBench-Hard(内部高难度 Agent 测试) | 59.6 |
有一个细节值得玩味:Flash 是 DeepSeek 产品线里的轻量档位,用轻量模型跑赢自家旗舰的预览版,这才是这份成绩单真正有意思的地方。
官方适配 Codex,配置一次到处能用
这次更新的另一件大事,是 V4-Flash 原生支持 Responses API 格式,并且官方直接做了 Codex 适配。配置一次之后,就能在 Codex CLI、ChatGPT 桌面端和 VS Code 的 Codex 插件里调用 DeepSeek 模型。
DeepSeek 还提供了一键配置脚本:
运行脚本前有一个前提:本机已经安装过 Codex CLI 或 ChatGPT 桌面版,并且至少启动过一次(也就是 ~/.codex 目录已存在)。
目前仅 V4-Flash 支持接入 Codex,V4-Pro 预计 8 月初跟进,V4-Pro 正式版也在路上。
普通用户暂时无感
需要说明的是,这次升级只针对 API:更新范围仅覆盖 V4-Flash API,DeepSeek 网页版、App 以及 V4-Pro API 的模型都没有变化。如果你只在网页上和 DeepSeek 聊天,暂时感受不到这轮进步。
同一天的 AI 圈有多卷
把镜头拉远一点,这次发布所处的行业背景更有意思。几乎在同一个新闻周期里:
大模型的迭代节奏已经不是按月,而是按天。卷模型、卷 Agent、卷生态、卷价格,对开发者来说都是好消息——竞争越激烈,API 价格越有可能继续往下走。