大语言模型

DeepSeek V4.1 Flash 官宣:V4 Pro 被静默替代,价格跌至 1/3

2026年9月10日1 次阅读
大语言模型动态 · 2026年9月9日 · DeepSeekAPI自动升级
一句话结论:北京时间 9月10日中午 12:00 起,DeepSeek 的 deepseek-v4-pro 接口会被静默替换为 V4.1 Flash。不用改代码,价格直接按更便宜的 Flash 档计费。对于已经在用 V4 Pro 的开发者,这是一次不请自来的"强制升级"。

发生了什么?

9月9日,DeepSeek 在其官方用户社区群发布通知,随后向付费客户发送了详细邮件。核心内容:

  • 计划于 9月10日 12:00(北京时间) 正式上线 V4.1 Flash 模型
  • 在 V4.1 Pro 发布前,所有 deepseek-v4-pro 请求会自动路由到 V4.1 Flash
  • 计费按 V4.1 Flash 的 Flash 档价格执行——相当于降价约 2/3
  • 不提供 "拒绝升级" 的选项

IT 之家、每日经济新闻网、cnBeta 在当天 15:16–16:22 之间同步转发了这条消息。但截至发稿时,DeepSeek 官方 API 文档页仍只显示三个模型,未出现 V4.1 条目。

V4.1 Flash 快多少?便宜多少?

7x
吞吐量提升
77%
延迟降低
1/3
成本降至
指标V4 ProV4.1 Flash
吞吐量63 tok/s355–427 tok/s
首次响应延迟766ms178ms
1500 token 代码生成约 24s约 4.4s
输入缓存命中价格$0.90/M$0.003/M
输入缓存未命中$0.60/M$0.15/M
输出价格$2.00/M$0.60/M

多模态升级:一个模型代替两个

之前的 V4-Flash-Vision-Exp(8月21日发布)是把视觉能力"外挂"到文本模型上的方案,需要分别调用两个模型。V4.1 Flash 则是原生多模态——文本、图像、语音处理集成在同一套模型权重里。

💡 对于正在跑"文本 + 图像分析"双调用的开发者,现在可以直接换成单个模型调用,减少延迟也降低成本。
📋 V4.1 Flash 新价格表(9月10日生效)
Token 类型低谷时段高峰时段
缓存命中输入$0.003 / 百万$0.006 / 百万
缓存未命中输入$0.15 / 百万$0.30 / 百万
输出$0.60 / 百万$1.20 / 百万

高峰时段:工作日 09:00–12:00、14:00–18:00 北京时间。其余时间为低谷。

为什么这样做?

DeepSeek 的官方说法非常直白:"继续使用更弱、更贵的 V4 Pro 已不再合适。"

这句话背后的意思是:V4.1 Flash 在性能、成本、速度等所有维度上都已经全面超越 V4 Pro,继续维持一个"又慢又贵"的老模型反而是在浪费用户预算。

需要注意什么

⚠️ 风险提醒:这不是完全透明的升级,生产环境用户需谨慎。
  1. 没有 opt-out 通道:官方没有提供"拒绝自动升级"的选项,V4 Pro 请求会无条件路由到 V4.1 Flash
  2. 无公开参数文档:V4.1 Flash 的具体系统提示词、温度范围等参数尚未在官方文档中披露
  3. 行为差异风险:虽然基准测试显示 V4.1 Flash 全面领先,但语言模型在不同任务上的表现可能不一致。如果你对 V4 Pro 的输出有严格的格式要求或校验逻辑,建议在切换前做一轮回归测试
  4. V4.1 Pro 还没来:通知只说 V4.1 Flash 先上,V4.1 Pro 的发布时间"待定"
💡 本文基于多家媒体转述整理。核心信息来自 DeepSeek 官方社区群通知和客户邮件,由 IT 之家、每日经济新闻网、cnBeta、TechNode 等媒体于 2026年9月9日同步报道。基准数据来自 Hacker News 讨论帖与第三方测试汇总。
参考来源:

本文由 AI 编程助手自动整理发布

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...