2026 年 8 月 13 日,AI 行业发生了可能是中国大模型历史上最具戏剧性的一次发布。

当夜 23:30,DeepSeek 静悄悄地把 V4-Pro 正式版(deepseek-v4-pro-0813) 推上了 API 服务器和 Chat 前端。官方放出的基准数据里,HLE(无工具/有工具)42.7/60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7、Toolathlon-Verified 74.1,这套数字直逼 Anthropic 的 Claude Fable 5,在 SWE-Bench 序列上的提升比此前的 Preview 版近乎翻倍——如果属实,V4-Pro 0813 是 2026 年中国大模型对海外顶级闭源旗舰最接近的一次正面对齐

然后是 16 个小时后的事:官网横幅、开放平台公告被悄然撤下,只剩模型与价格页里那个 deepseek-v4-pro-0813 的版本号孤零零地留着。原定同期发布的 DeepSeek Harness 配套框架也一起按下暂停键。

这是中国大模型第一次在旗舰 GA 当天就遭遇 24 小时撤回的案例。

但在我们急着下结论之前,先把这件事放回 2026 年中的行业坐标系里看——DeepSeek 在过去半年为整个大模型生态做了什么,V4-Pro 这条线究竟走到了哪里,这次的撤回又到底意味着什么。


一、先把 DeepSeek 放在 2026 年的功劳簿上看

1. 价格颠覆者:把"前沿模型"的门槛打到了 1/20

如果你 2025 年在生产环境用过大模型,会对 DeepSeek 的定价印象深刻。Ewo 2026 年 6 月的横评里给出了一张表:Claude Sonnet 4.6 输入价 $3.00/百万 tokens,而 DeepSeek V4-Flash 输入价 $0.14、输出价 $0.28——约为 Sonnet 4.6 输入价的 1/20。这意味着一个中等规模创业团队,如果他们 90% 的任务是分类、清洗、客服草稿生成这种"高频、低复杂度"工作,把工作流从 Claude 切到 DeepSeek V4-Flash,API 账单可以直接砍到原来的 5%

这件事的意义远不止"便宜"。它让一批原本"用不起旗舰闭源模型"的中小团队、独立开发者、初创公司的产品第一次变得经济上可行。从这个角度看,DeepSeek 在 2025-2026 年单凭价格战一条,就把"前沿模型"从大厂玩具变成了大众工具——这是 GPT-3 降价之后,LLaMA 开源之外的第二条大众化路径。

2. 基准跃迁:V4-Flash 做到了"Pro 该做的事"

2026 年 7 月 31 日,DeepSeek-V4-Flash-0731 GA。如果只看定价($0.14/$0.28),你会以为这是个蒸馏小模型——但官方放出的数字让所有人重新审视:Flesh 在 Terminal Bench 2.1 上拿到 82.7、DeepSWE 54.4、Toolathlon 70.3,明确"超过 V4-Pro-Preview"

一个 Flash 档位的模型在 Agent 基准上反超 Pro Preview——这件事在中国大模型史上没有先例。它的潜台词是:DeepSeek 的训练体系在过去半年里完成了一次代际升级,让小模型也能继承大模型的能力,而这件事 V4-Pro Preview 当时还没做到。

3. Harness 开源:把 Agent 工具调用协议做成了"插件"

同一天(8-13)DeepSeek 还应该发布 Harness(Agent 框架),后者和 V4-Pro 一同被按下暂停键。但 Hacker News 和 GitHub 上已经有大量讨论:Harness 把"一切都是插件"的设计哲学推到了极致——任何工具调用、任何 Agent 框架、任何 MCP server 都可以作为 Harness 插件挂载。在 OpenAI Responses API、Anthropic MCP 之外,这是中国厂商第一次以开源形式向 Agent 协议层发起正面提案

单凭这三条——价格打到底、Flash 越级做 Pro 的事、Harness 提出新协议——DeepSeek 在 2026 年的中国大模型生态里就是绕不开的存在。它不是最强的(那是 Claude Opus 4.8 和 Fable 5 的战场),但它是最会"重写规则"的。

带着这个背景,我们再看 V4-Pro 0813 这次 24 小时的过山车。


二、完整时间线:从低调发布到 24 小时撤回

时间(2026-08-13) 事件
00:31 快科技发文,确认 V4-Pro-0813 已上线 API 和 Chat,基准直追 Fable 5,价格为 V4-Flash 的 3 倍
00:31 - 11:30 全网开发者抓 API 实测,部分用户在 X(原 Twitter)上反馈"输出质量与 Flash 几乎一致",引发猜测
11:30 DeepSeek 在首页正式更新 V4-Pro GA 通知(快科技:DeepSeek-V4-Pro-0813 于"前一日夜间 11 点半低调发布")
11:30 - 15:00 DeepSeek 官方公告涨价方案(peak/off-peak pricing),HN 上出现标题党"DeepSeek up to 1000% price hike is live"
15:00 - 16:00 用户持续对比,实测数据与官方跑分差距明显;B 站、知乎、贴吧开始出现"是不是传错模型"的讨论
16:00 - 16:30 DeepSeek 官网相关发布横幅、开放平台公告被悄然撤下,仅模型与价格页面保留版本号 deepseek-v4-pro-0813
16:26 快科技发"突遭撤回:不到 24 小时口碑大逆转"一文
16:30 后 原定同期发布的 DeepSeek Harness 也被延期,GitHub 上讨论帖被锁定
当日晚些时段 51allai 等媒体观察到"DeepSeek-V4-Pro-0813 重新出现在首页与开放平台",撤回呈"短暂消失—恢复"特征

需要特别强调的是:这次撤回不是把模型从 API 下架——deepseek-v4-pro 这个调用名今天仍然能跑通,价格页仍标注 0813 版本号。被撤的只是"首页横幅"和"开放平台的发布通知"这两块"营销位"。


三、为什么会撤回?目前三种合理推测

推测 1:实测跑分与官方基准差距过大

快科技撤回稿的核心理由是:"V4-Pro-0813 的实际表现没有比 V4-Flash 好多少"

官方基准与实测基准的脱节,在大模型行业不是新鲜事——很多模型在自家 Harness 上能跑出 87.9,放到第三方独立复现里就掉到 70 出头。但通常这种脱节在 preview 阶段就被发现,不至于到 GA 才暴露。如果真是这种情况,说明 DeepSeek 内部的 Eval 流程和真实生产场景的差距比他们以为的更大

推测 2:部署出错,生产环境跑的还是 Flash 模型

B 站上"传错模型"的猜测是有技术依据的:V4-Pro 和 V4-Flash 的 API endpoint 在路由层只差一个 model name,如果模型权重在生产环境没有正确加载或指向了错的 bucket,API 调用看似返回 V4-Pro 实际上是 Flash 在跑——这种情况下,跑分对不上,价格又标成 Pro 的 3 倍,几乎必然要撤回。

如果是这种,这是操作事故,不是模型本身的问题——模型可能在内部评估里确实达标了,只是没成功推到线上。撤回是止损的正确做法。

推测 3:同期事件叠加导致"集中刹车"

8-13 这天 DeepSeek 同时在做三件大事:V4-Pro GA、peak/off-peak 涨价公告、Harness 框架发布。任何一件单独拿出来都有翻车风险,叠加在一起几乎一定会出事。最可能的剧本是:V4-Pro 实测反馈不及预期 → 内部讨论要不要撤回 → Harness 同期要发 → 索性一并暂停 → 营销位先撤、技术层和价格层先稳住。

如果这个推测成立,这次撤回其实是一次"集中刹车"——DeepSeek 选择了短期口碑而不是强行推。这不是坏事。


四、不应该被这一夜遮住的两件事

1. V4-Flash-0731 仍然是 2026 年中最被低估的模型

Flash 在 7-31 GA 时已经证明:Agent 基准超过 V4-Pro Preview、定价是 Claude Sonnet 4.6 的 1/20、API 完整支持 OpenAI Responses API。在 V4-Pro 撤回风波里,真正受益最大的可能是 V4-Flash 的存在感——它本来就是答案,只是之前没人愿意承认"Flash 已经够用"

2. 价格革命已经回不去了

无论 V4-Pro 这次结果如何,DeepSeek 已经把"前沿模型"的价格战打到 Anthropic 和 OpenAI 没办法不跟牌的程度。涨价公告里提到的 peak/off-peak pricing 是 DeepSeek 的第一次提价尝试——即使是 10 倍涨幅的峰时价,$1.4/$2.8 在 Sonnet 4.6($3/$15)面前依然是白菜价。

这件事回不去了。即使 DeepSeek 自己回撤涨价,Anthropic 和 OpenAI 也已经被迫把"性价比"当成了一线竞争维度——这本身就是 DeepSeek 的胜利。


五、对开发者和团队的实操建议

如果今晚你正在生产环境用 deepseek-v4-pro:

  1. 立即切回 deepseek-v4-pro(去掉 -0813 后缀)或切到 V4-Flash。两者的 API endpoint 都在,模型都能调,只是不要相信 V4-Pro-0813 的官方跑分。
  2. 关注 8-14 / 8-15 两天。如果 DeepSeek 在 48 小时内重新发布 V4-Pro GA,大概率会带一个明确说明:是模型本身问题、部署问题、还是其他。
  3. 不要急着切走。如果你的工作流对成本敏感,DeepSeek 仍然是 2026 年最理性的选择——这次的 24 小时撤回只是 V4-Pro 这条线的波动,不是 V4-Flash / Harness / 价格体系的崩溃

如果你是 DeepSeek 投资人或观察者:

  1. 这次撤回不会改变 DeepSeek 的基本面——价格战打下来了、Agent 协议做起来了、模型版本号透明了。
  2. 真正值得担忧的是"内部 Eval 流程"。一家敢在 GA 当天撤回的厂商,反而比"明知有问题还硬上"的厂商更值得长期看好。撤回本身是一种纪律

六、写在最后

写完这篇稿子的时间是 2026-08-13 23:50,撤回发生 7 小时之后。

我们不知道 V4-Pro-0813 究竟是模型问题、部署问题,还是内部协调问题。但有一件事是确定的:DeepSeek 在 2026 年为中国大模型行业做出的贡献——把前沿模型的价格打到 1/20、把 Agent 协议做成开源、把 Flash 做成 Pro 该有的样子——这些事不会被一次 24 小时的撤回抹掉

就像 Claude 3.5 Sonnect 在 2024 年 10 月那次"号称世界第一,实测被质疑"的事件最终被 Fable 5 接棒一样,中国大模型行业也需要一次"发布当晚就撤回"的纪律演练。这次 DeepSeek 给全行业上了一课:有时候,撤回比硬撑更体面

我们继续看 48 小时后 DeepSeek 怎么说。


参考资料

[1] DeepSeek 官方更新日志,2026-08-13, https://api-docs.deepseek.com/updates/
[2] 快科技,"DeepSeek V4-Pro-0813 正式版深夜核弹",2026-08-13, https://news.mydrivers.com/1/1143/1143328.htm
[3] 快科技,"DeepSeek V4 Pro 正式版突遭撤回:不到 24 小时口碑大逆转",2026-08-13, https://news.mydrivers.com/1/1143/1143495.htm
[4] Ewo,"2026 大模型终极对比",2026-06-10, https://ewo.so/blog/llm-comparison-2026/
[5] HN Algolia,"DeepSeek V4 Pro 0813 基准与价格相关讨论",2026-08-13, https://hn.algolia.com/?q=DeepSeek+V4-Pro