一、深夜突袭:DeepSeek V4 Pro正式版”静默上线”
2026年8月12日晚间,DeepSeek官网API文档的”模型与价格”页面悄然更新,新增了一个版本号——DeepSeek-V4-Pro-0813。没有发布会,没有预热海报,没有官方公告,但全球AI开发者社区瞬间沸腾了:V4 Pro正式版,终于来了。
这款模型自2026年4月发布预览版以来,一直处于”即将转正”的状态。官方曾承诺正式版会尽快发布,但经历了两次延期打磨后,最终在8月13日凌晨完成全面上线。调用模型名称保持不变,老用户无需改动任何代码即可自动升级至正式版,API与Chat端同步完成更新。
对于关注国产大模型发展的观察者而言,这次”静默更新”的分量,丝毫不亚于一场盛大的发布会。
二、硬核参数:百万Token上下文,Agent能力质的飞跃
V4 Pro正式版的核心参数在国产模型中处于绝对领先地位:
- 上下文长度:1M(100万Token),处于国产模型第一梯队
- 最大输出长度:384K Token,单次调用可吞吐一整套大型代码仓库或长篇技术文档
- 双模式推理:支持思考模式(Thinking)与非思考模式,默认开启思考模式,可通过
reasoning_effort参数调节推理强度 - 并发限制:500(V4 Flash为2500)
但真正让开发者兴奋的,是Agent能力的质变。从公开评测数据来看,V4 Pro正式版相比预览版堪称”脱胎换骨”:
| 评测基准 | V4 Pro预览版 | V4 Pro正式版 | Fable 5(对比) |
|---|---|---|---|
| Terminal Bench 2.1 | 72.1 | 87.9 | 88.0 |
| CyberGym | — | 83.3 | 83.1 |
| DeepSWE | 12.8 | 62.7 | — |
| DSBench-Hard | 31.1 | 67.2 | — |
| HLE(带工具) | 48.2 | 60.0 | 63.0 |
DeepSWE从12.8飙升至62.7,翻了近5倍——这是最令人震撼的数据。DeepSWE评测的是模型在真实软件工程场景中完成复杂任务的能力,包括多文件编辑、代码库理解、工具链协作等。这一跃升意味着V4 Pro正式版在”复杂任务的精度上限”维度完成了质的突破。
在Terminal Bench上,V4 Pro以87.9分仅差Fable 5的88.0分0.1分;在CyberGym(AI安全智能体评测)上,甚至以83.3分反超了Fable 5的83.1分。多项测试显示,V4 Pro正式版已接近甚至局部超越了Anthropic的顶级闭源模型。
三、接口全面打通:兼容OpenAI与Anthropic,零成本切换
V4 Pro正式版在API兼容性上迈出了历史性的一步——一口气打通了四大主流接入通道:
- OpenAI兼容接口:调用方式不变,
base_url保持原有地址,只需将model参数改为deepseek-v4-pro即可直接调用 - Anthropic API兼容:支持通过
api.deepseek.com/anthropic端点接入,可直接导入Codex、Claude Code等生态工具 - Responses API原生支持:为多步骤Agent工作流提供标准化的状态管理与工具调用机制
- Tool Calls与JSON Output:完整支持工具调用和结构化JSON输出
这意味着,此前使用Claude搭建Agent技术栈的团队,切换到DeepSeek几乎零迁移成本;基于OpenAI SDK开发的应用,一行配置改动即可完成切换。DeepSeek成为目前市面上API兼容性最完整的国产大模型之一。
四、定价体系:白菜价”窗口期”,官方预告即将大涨
V4 Pro正式版的定价,在当前市场环境下堪称”价格屠夫”:
| 计费项 | V4 Pro价格 | V4 Flash价格 | Fable 5(参考) |
|---|---|---|---|
| 缓存命中输入 | 0.025元/百万Token | 0.02元 | — |
| 缓存未命中输入 | 3元/百万Token | 1元 | 约70元 |
| 输出 | 6元/百万Token | 2元 | 约350元 |
V4 Pro的输出价格折合约0.87美元/百万Token,而Fable 5的输出价格高达约50美元/百万Token——相差近60倍。这意味着,开发者以不到海外模型十分之一的成本,即可获得其80%以上的Agent能力。
但值得注意的是,DeepSeek此前已发布公告,计划近期整体上调API服务定价,预计涨幅较大。根据此前预告的峰谷定价机制,高峰时段(每日9:00-12:00和14:00-18:00)价格将翻倍。这意味着,当前价格极大概率是”窗口期定价”,后续调价方案将以官方正式通知为准。
对于重度调用开发者而言,此刻或许是”囤额度”的最后时机。
五、V4 Pro vs V4 Flash:双轨制下的选型策略
随着V4 Pro正式版上线,DeepSeek的V4产品线形成了清晰的”双轨制”格局:
- V4 Flash:定位高频跑量与轻量任务,并发上限2500,输出2元/百万Token,适合聊天、轻量编程、日常问答、批量处理等成本敏感型业务
- V4 Pro:定位高难度推理、长上下文编码与Agent工作流,并发上限500,但拥有百万Token上下文和顶级的Agent能力,适合大仓库跨文件改动、长链路Coding Agent、深度研究、复杂工具链调用
简单的选择逻辑是:如果任务需要”深思考、长上下文、复杂工具调用”,选Pro;如果只是”高频对话、内容生成、批量处理”,Flash的性价比更高。
六、国产算力适配:华为昇腾全系列已打通
V4 Pro正式版已适配华为昇腾全系列国产算力,实现了从CUDA到CANN框架的迁移。这意味着,对于有信创要求的政企客户,DeepSeek提供了一条”性能接近国际顶尖、硬件全国产化”的可选路径。
这一适配的行业意义不容忽视。在AI算力国产化的大背景下,DeepSeek V4 Pro成为首个在国产硬件上实现与国际顶尖模型性能对标的大模型,为国内AI基础设施的自主可控提供了重要参考。
七、软盟观:国产大模型的分水岭时刻
DeepSeek V4 Pro正式版的发布,标志着国产大模型在Agent能力与商业化落地之间,迈出了实质性的一步。
从产品层面看,百万Token上下文、384K输出、Responses API支持、Anthropic兼容、国产算力适配——这些能力的集齐,使V4 Pro成为目前国产大模型Agent基础设施完整度最高的产品之一。
从产业层面看,当一款模型在多个核心基准上逼近Fable 5,而价格仅为后者的几十分之一时,原本流向Anthropic、OpenAI的开发者预算将面临重新分配。国产大模型第一次在”能力+价格”的双重维度上,对国际头部模型形成了实质性竞争压力。
不过,也需要客观看待:跑分接近Fable 5,并不代表在所有任务维度上都能平起平坐;API可用不等于权重已开源,若企业需要私有化部署,仍需等待官方进一步动作;官方涨价幅度、权重开源计划以及实际业务场景中的稳定性表现,仍需持续观察。
但无论如何,DeepSeek V4 Pro正式版已经证明:国产大模型从”追平”到”逼近”,用了不到一年时间。下一步,就看涨价之后,这个”逼近”能走多远。
本文由软盟资讯编辑原创,转载须注明出处。
关于文章版权的声明:
https://news.softunis.com/68280.html 文章来自软盟资讯
若非本站原创的文章,特别作如下声明:
本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用,不代表任何监管机构的立场和观点。不承担任何由于内容的合法性及真实性所引起的争议和法律责任。
凡注明为其他媒体来源的信息,均为转载,版权归版权所有人所有。
如有未注明作者及出处的文章和资料等素材,请版权所有者联系我们,我们将及时补上或者删除,共同建设自媒体信息平台,感谢你的支持!

