【DeepSeek V4 Pro正式版深夜低调上线:Agent能力暴涨,多项指标逼近Fable 5】
8月12日深夜,DeepSeek V4 Pro正式版悄然更新至API,模型版本切换为DeepSeek-V4-Pro-0813,开发者无需修改调用名即可无缝升级。
🗣️ 核心升级亮点:
这次最核心的变化是Agent能力的大幅提升。根据官方公布的评测数据,新版V4 Pro在DeepSWE编程智能体测试中从预览版的12.8分飙升至62.7分,翻了近5倍;Terminal Bench 2.1得分87.9,仅差0.1分就追平安卓培的顶级模型Claude Fable 5;在Cybergym、AutomationBench等多项智能体测试中甚至超越了Fable 5和Opus 4.8。
参数规格方面,新模型支持1M上下文长度、最大384K Token输出,同时兼容Responses API、Anthropic API格式,可直接接入Codex等主流Agent开发工具。
🤔 我的解读:
我觉得这次升级最值得关注的不是跑分数字本身,而是DeepSeek在垂直场景的优化能力。预览版在复杂编程任务上的表现一直不算突出,这次直接实现跨越式提升,说明团队在Agent后训练上确实下了功夫。
我认为当前价格窗口期值得关注。目前V4 Pro的API价格暂未上调,缓存未命中输入3元/百万Token,输出6元/百万Token,但官方已明确预告“近期将大幅涨价”,还计划引入峰谷定价机制。对于重度调用方来说,现在囤额度是比较划算的选择。
💡 我的观点:
我发现DeepSeek这次上线依然保持了一贯的低调风格,没有预热没有发布会,直接更API。不过也有开发者反馈,API端的思维链输出目前还存在表述生硬的问题,后续应该还会持续优化。整体来看,国产大模型在Agent场景的竞争力正在快速追赶国际第一梯队。
信息来源:IT之家/DeepSeek官方(2026-08-13)

