各厂语言模型

DeepSeek V4 Pro 0813 正式版 API 上线:Agent能力提升25分,100万上下文+384K输出

2026年8月13日3 次阅读
DeepSeek V4 Pro 正式版上线:100万上下文+384K输出,Agent能力较预览版提升25分

DeepSeek V4 Pro 正式版上线:100万上下文+384K输出,Agent能力较预览版提升25分

8月13日,DeepSeek 将 V4 Pro 模型更新至 0813 正式版,开发者无需修改任何代码,继续调用 deepseek-v4-pro 即可使用最新版本。这是 V4 Pro 从预览版走向正式版的关键一步,升级重点直指 Agent 场景——在九项智能体测试中,正式版平均比预览版高出约 25.7 分。

Agent 能力是这次升级的核心

V4 Pro 0813 最大的变化不在参数规模(仍然是 MoE 架构,总参数约 1.6 万亿,每次推理激活约 490 亿),而在"能不能真正干活"。此前预览版在长流程代码任务上表现薄弱,正式版专门强化了模型在真实代码库中规划任务、调用工具、修改代码、运行测试和处理失败的能力。

HLE 测试的结果最能说明问题:不使用工具时,V4 Pro 0813 得分 42.7,落后于 Kimi-K3、Opus 4.8 和 Fable 5;但接入工具后,分数跳到 60.0,仅次于 Fable 5 的 63.0,提升幅度达 17.3 分,是所有参测模型中工具增益最大的。这意味着 V4 Pro 0813 的竞争力很大程度上体现在"模型 + 工具"的完整系统中——通过搜索、代码执行、工具调用和结果整合组成的 Agent 工作流,它能把自身能力发挥到最大。

规格一览

  • 上下文窗口:100 万 Token,单次最大输出 38.4 万 Token
  • 思考模式:默认开启,也支持关闭(非思考模式)
  • 工具调用:支持 Tool Calls、JSON 结构化输出、Responses API
  • API 兼容:同时支持 OpenAI API 和 Anthropic API 格式,可直接接入 Claude Code、GitHub Copilot 等工具
  • 补全功能:Chat Prefix Completion 和 FIM 补全

100 万 Token 的上下文窗口意味着你可以把整个大型代码库或超长文档一次性塞进去,384K 的输出上限则让模型在长流程 Agent 任务中有足够空间完成复杂操作。

价格:暂时没涨,但预告要涨

当前 V4 Pro API 定价:

| 项目 | 价格 |

|------|------|

| 缓存命中输入 | $0.003625 / 百万 Token |

| 缓存未命中输入 | $0.435 / 百万 Token |

| 输出 | $0.87 / 百万 Token |

| 并发上限 | 500 |

有开发者算过一笔账:在 Agent 编程场景下,V4 Pro 每次请求成本约 $0.000875,而同等能力的 Claude Opus 约 $0.052,成本差距约 60 倍。不过 DeepSeek 已在价格页面明确提示,近期计划整体上调 API 价格,预计涨幅较大,当前定价可能是过渡期优惠。

Pro 还是 Flash?

V4 Flash(0731 版本)并发上限 2500,价格约为 Pro 的三分之一,适合高并发、成本敏感的普通任务。有开发者反馈,Flash 在代码审查等场景中更容易犯初始错误,输出量经常是 Pro 的 5 倍以上,虽然最终也能得到正确结果,但过程更曲折。

实际部署建议:普通任务用 Flash,失败或高难度任务再交给 Pro。这种分层策略在成本和效果之间能取得不错的平衡。

---

基于 DeepSeek 官方 API 文档、AIHub 及 InfoQ 等多家媒体信息整理。

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...