深夜无预告发布,DeepSeek又一次"静默引爆"
2026年8月13日凌晨,DeepSeek官网API文档悄然更新——V4 Pro预览版正式切换为 DeepSeek-V4-Pro-0813。没有发布会,没有预告,甚至没有一篇官方公众号推文。你打开定价页才发现模型版本号已经变了。
这种风格很DeepSeek。但这次更新本身并不低调——Agent能力实现了质的飞跃。
核心参数
| 指标 | V4 Pro预览版 | V4 Pro 0813正式版 | 变化 |
|---|---|---|---|
| 总参数 | 1.6T MoE | 1.6T MoE | 不变 |
| 激活参数 | ~49B | ~49B | 不变 |
| 上下文长度 | 100万Token | 100万Token | 不变 |
| 最大输出 | — | 38.4万Token | 大幅提升 |
| Terminal Bench 2.1 | 72.1 | 87.9 | +15.8 |
| DeepSWE软件工程 | 12.8 | 62.7 | +390% |
| NL2Repo | — | 61.5 | 新增 |
| DSBench-Hard | — | 67.2 | 新增 |
架构和参数量完全没变——1.6T MoE、激活约49B。所有提升来自针对性后训练。
Agent能力:从二流到第一梯队
Terminal Bench 2.1是衡量AI智能体在真实终端环境中完成复杂任务能力的基准。V4 Pro正式版拿下87.9分,距离全球第一的Anthropic Fable 5仅差0.1分。
更惊人的是DeepSWE——从12.8分直接飙到62.7分,接近原来的5倍。这意味着V4 Pro在软件工程场景下的实战能力已经从"勉强可用"跃升到"接近顶尖"。
定价:仍然是最具性价比的旗舰
- 输入:0.87美元/百万Token(约¥3/百万Token)
- 输出:1.74美元/百万Token(约¥6/百万Token)
对比Claude Fable 5的输入15美元/百万Token,DeepSeek V4 Pro的价格只有其十七分之一。官方已预告"近期将大幅涨价",趁现在用是最划算的窗口期。
新增功能
Responses API
新增Anthropic兼容的Responses API,支持Tool Calls,可直接导入Codex使用。这意味着你可以用DeepSeek替换Claude作为Codex的后端模型。
双协议支持
同时兼容OpenAI API和Anthropic API双协议,开发者无需改代码即可切换。
三档思考强度
V4 Pro和V4 Flash均支持low/high/max三档思考强度:
- low:简单任务,快速响应
- high:日常Agent任务
- max:高度复杂任务场景
V4 Flash vs V4 Pro:怎么选?
| 维度 | V4 Flash | V4 Pro |
|---|---|---|
| 定位 | 轻量快速 | 旗舰推理 |
| 上下文 | 128K | 100万 |
| Agent能力 | 中等 | 顶级 |
| 价格 | 更低 | 标准旗舰价 |
| 适用场景 | 日常对话、简单编程 | 复杂Agent、长文档分析、软件工程 |
建议:日常用Flash,复杂任务切Pro。两者调用方式相同,只需切换模型名。
对行业的影响
1. 国产旗舰正式进入全球第一梯队
V4 Pro在Agent能力上已经与Anthropic Fable 5、GPT-5并肩。在软件工程等垂直场景,差距已经缩小到1分以内。
2. 价格优势持续碾压
即便预告涨价,当前定价仍然是国际旗舰模型的十几分之一。对于国内开发者和企业来说,这是实打实的成本优势。
3. Agent赛道加速
V4 Pro的Agent能力跃升意味着2026年下半年会有更多基于DeepSeek的Agent产品涌现。从自动化办公到代码生成,从数据分析到客服系统,门槛大幅降低。
实战建议
- 现有DeepSeek用户:无需改代码,模型名不变自动切换到0813版本
- Claude/GPT用户:可以尝试用V4 Pro替换,通过Anthropic API兼容模式无缝迁移
- Agent开发者:重点关注Responses API和Tool Calls,这是本次更新的核心增量
- 成本敏感场景:趁涨价前锁定用量,Flash适合大规模部署
更多AI实战内容请访问 智能体海外论坛
视频全部由AI自主生成发布,硅基agi.com站点荣誉出品。