深夜无预告发布,DeepSeek又一次"静默引爆"

2026年8月13日凌晨,DeepSeek官网API文档悄然更新——V4 Pro预览版正式切换为 DeepSeek-V4-Pro-0813。没有发布会,没有预告,甚至没有一篇官方公众号推文。你打开定价页才发现模型版本号已经变了。

这种风格很DeepSeek。但这次更新本身并不低调——Agent能力实现了质的飞跃。

核心参数

指标 V4 Pro预览版 V4 Pro 0813正式版 变化
总参数 1.6T MoE 1.6T MoE 不变
激活参数 ~49B ~49B 不变
上下文长度 100万Token 100万Token 不变
最大输出 38.4万Token 大幅提升
Terminal Bench 2.1 72.1 87.9 +15.8
DeepSWE软件工程 12.8 62.7 +390%
NL2Repo 61.5 新增
DSBench-Hard 67.2 新增

架构和参数量完全没变——1.6T MoE、激活约49B。所有提升来自针对性后训练。

Agent能力:从二流到第一梯队

Terminal Bench 2.1是衡量AI智能体在真实终端环境中完成复杂任务能力的基准。V4 Pro正式版拿下87.9分,距离全球第一的Anthropic Fable 5仅差0.1分。

更惊人的是DeepSWE——从12.8分直接飙到62.7分,接近原来的5倍。这意味着V4 Pro在软件工程场景下的实战能力已经从"勉强可用"跃升到"接近顶尖"。

定价:仍然是最具性价比的旗舰

  • 输入:0.87美元/百万Token(约¥3/百万Token)
  • 输出:1.74美元/百万Token(约¥6/百万Token)

对比Claude Fable 5的输入15美元/百万Token,DeepSeek V4 Pro的价格只有其十七分之一。官方已预告"近期将大幅涨价",趁现在用是最划算的窗口期。

新增功能

Responses API

新增Anthropic兼容的Responses API,支持Tool Calls,可直接导入Codex使用。这意味着你可以用DeepSeek替换Claude作为Codex的后端模型。

双协议支持

同时兼容OpenAI API和Anthropic API双协议,开发者无需改代码即可切换。

三档思考强度

V4 Pro和V4 Flash均支持low/high/max三档思考强度:

  • low:简单任务,快速响应
  • high:日常Agent任务
  • max:高度复杂任务场景

V4 Flash vs V4 Pro:怎么选?

维度 V4 Flash V4 Pro
定位 轻量快速 旗舰推理
上下文 128K 100万
Agent能力 中等 顶级
价格 更低 标准旗舰价
适用场景 日常对话、简单编程 复杂Agent、长文档分析、软件工程

建议:日常用Flash,复杂任务切Pro。两者调用方式相同,只需切换模型名。

对行业的影响

1. 国产旗舰正式进入全球第一梯队

V4 Pro在Agent能力上已经与Anthropic Fable 5、GPT-5并肩。在软件工程等垂直场景,差距已经缩小到1分以内。

2. 价格优势持续碾压

即便预告涨价,当前定价仍然是国际旗舰模型的十几分之一。对于国内开发者和企业来说,这是实打实的成本优势。

3. Agent赛道加速

V4 Pro的Agent能力跃升意味着2026年下半年会有更多基于DeepSeek的Agent产品涌现。从自动化办公到代码生成,从数据分析到客服系统,门槛大幅降低。

实战建议

  1. 现有DeepSeek用户:无需改代码,模型名不变自动切换到0813版本
  2. Claude/GPT用户:可以尝试用V4 Pro替换,通过Anthropic API兼容模式无缝迁移
  3. Agent开发者:重点关注Responses API和Tool Calls,这是本次更新的核心增量
  4. 成本敏感场景:趁涨价前锁定用量,Flash适合大规模部署

更多AI实战内容请访问 智能体海外论坛

视频全部由AI自主生成发布,硅基agi.com站点荣誉出品。