返回教程列表

DeepSeek-V4-Flash 正式版 API 上线公测:Agent 能力大幅增强,峰谷定价来袭

AI瑶·2026-08-13DeepSeek

DeepSeek-V4-Flash 正式版 API 上线公测:Agent 能力大幅增强,峰谷定价来袭

来源:DeepSeek 官方 API 文档更新日志(2026-07-31)

新闻概要

7 月 31 日下午,DeepSeek 通过官方 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版(V4-Flash-0731)API 上线公测。与此前「Pro 强、Flash 弱」的分层逻辑不同,这次正式版在多项 Agent 与代码基准上的表现,已经逼近甚至超越了三个月前 V4-Pro 预览版的水平

官方说明:V4-Flash-0731 的模型结构、尺寸与 V4-Flash-preview 保持一致,仅重新进行了后训练,重点加大了智能体(Agent)与工具使用方向的训练力度。

关键数据

- 2Repo 54.2 分、Cybergym 76.7 分、Toolathlon verified 70.3 分(对比 V4-Pro 预览版 Terminal Bench 67.9 分) - DeepSWE 基准:与 Pro 预览版分差高达 41.6 分 - ALE 基准:与全球顶级的 Claude Opus 4.8 仅差 半分

  • Agent 基准全面反超:九项智能体与代码基准得分全部超过自家 V4-Pro 预览版
  • 格式支持:原生支持 Responses API 格式,并针对性适配 Codex
  • 峰谷定价:API 定价首次引入峰谷机制,百万 tokens 输入(缓存命中)从预览版 1 元降至正式版 平时 0.025 元 / 高峰 0.05 元
  • Harness:自研工具 DeepSeek Harness 即将公布,正式版基准即采用其极简模式跑分

对开发者的意义

  1. 性价比显著提升:V4-Flash 系列一直主打高并发、轻量化任务(日常对话、内容创作、基础 RAG、批量文案),正式版在 Agent 场景大幅增强后,覆盖范围更广。
  2. Agent 工程化更顺手:原生支持 Responses API + 适配 Codex,接入主流 Agent 框架成本更低。
  3. 成本可预期:峰谷定价让批量任务的成本规划更灵活,缓存命中价格低至 0.025 元/百万 tokens。

如何使用

  • 模型 ID:deepseek-v4-flash-0731
  • 公测范围:目前仅 API 开放公测,App / Web 端模型暂未更改(免费账号在官网/App 选择「深度思考」模式可体验 V4-Flash 能力)
  • 官方预告:DeepSeek-V4-Pro 正式版将尽快发布

参考链接

  • DeepSeek API 文档更新日志:https://api-docs.deepseek.com
  • IT之家报道:https://www.ithome.com/0/984/116.htm
  • 36氪报道:https://m.36kr.com/p/3919224296451461