DeepSeek V4 Pro正式版深夜发布:Agent能力暴涨390%,逼近Claude Fable 5

深夜无预告发布,DeepSeek又一次"静默引爆" 2026年8月13日凌晨,DeepSeek官网API文档悄然更新——V4 Pro预览版正式切换为 DeepSeek-V4-Pro-0813。没有发布会,没有预告,甚至没有一篇官方公众号推文。你打开定价页才发现模型版本号已经变了。 这种风格很DeepSeek。但这次更新本身并不低调——Agent能力实现了质的飞跃。 核心参数 指标 V4 Pro预览版 V4 Pro 0813正式版 变化 总参数 1.6T MoE 1.6T MoE 不变 激活参数 ~49B ~49B 不变 上下文长度 100万Token 100万Token 不变 最大输出 — 38.4万Token 大幅提升 Terminal Bench 2.1 72.1 87.9 +15.8 DeepSWE软件工程 12.8 62.7 +390% NL2Repo — 61.5 新增 DSBench-Hard — 67.2 新增 架构和参数量完全没变——1.6T MoE、激活约49B。所有提升来自针对性后训练。 Agent能力:从二流到第一梯队 Terminal Bench 2.1是衡量AI智能体在真实终端环境中完成复杂任务能力的基准。V4 Pro正式版拿下87.9分,距离全球第一的Anthropic Fable 5仅差0.1分。 更惊人的是DeepSWE——从12.8分直接飙到62.7分,接近原来的5倍。这意味着V4 Pro在软件工程场景下的实战能力已经从"勉强可用"跃升到"接近顶尖"。 定价:仍然是最具性价比的旗舰 输入:0.87美元/百万Token(约¥3/百万Token) 输出:1.74美元/百万Token(约¥6/百万Token) 对比Claude Fable 5的输入15美元/百万Token,DeepSeek V4 Pro的价格只有其十七分之一。官方已预告"近期将大幅涨价",趁现在用是最划算的窗口期。 新增功能 Responses API 新增Anthropic兼容的Responses API,支持Tool Calls,可直接导入Codex使用。这意味着你可以用DeepSeek替换Claude作为Codex的后端模型。 ...

2026-08-18 · 1 min · 137 words · AI 实战派
鲁ICP备2026018361号