2026年8月12日晚,DeepSeek宣布上线DeepSeek V4 Pro正式版。此次更新重点增强了智能体能力,API模型版本同步更新为DeepSeek-V4-Pro-0813,上下文长度提升至100万Tokens,最大输出长度达到384K。
与此前的预览版本相比,V4 Pro更强调复杂任务处理、工具调用和长流程执行能力。对于开发者和企业用户来说,新模型能否稳定完成代码开发、数据处理、自动化操作等实际任务,将成为比单项考试成绩更值得关注的指标。
一、DeepSeek V4 Pro重点增强Agent能力
DeepSeek此次没有同步发布完整的技术报告或模型博客,现阶段公开信息主要包括上线公告、评测图和API参数更新。
从官方发布的评测图来看,DeepSeek V4 Pro正式版的智能体性能较预览版有所提升。在图中列出的多个对比模型中,V4 Pro与Fable 5、Opus-4.8等模型处于相近水平。
其中,V4 Pro在AutomationBench和CyberGym两项评测中的成绩较为突出。
1、AutomationBench
AutomationBench主要用于评估AI智能体执行自动化任务的能力。它关注的不是模型能否回答问题,而是模型能否理解目标、调用工具、完成多个操作步骤,并在执行过程中处理异常情况。
这类能力适用于以下场景:
- 自动处理文件和表格
- 调用浏览器或业务系统
- 编写并运行代码
- 执行数据整理和分析任务
- 完成长流程办公自动化
- 根据执行结果调整后续步骤
对于Agent产品而言,模型能否持续、准确地完成任务,通常比单轮问答能力更加重要。
2、CyberGym
CyberGym用于评估模型在网络安全环境中的实际任务能力,涉及漏洞分析、环境判断、工具使用和攻防操作等内容。
需要注意的是,评测成绩不等于生产环境中的实际表现。不同Agent框架、工具权限、提示词、运行环境和安全限制,都可能影响模型最终完成任务的效果。
二、上下文长度提升至100万Tokens
DeepSeek API模型与价格页面显示,V4 Pro对应的模型版本已经更新为DeepSeek-V4-Pro-0813。
新版本主要参数如下:
| 项目 | DeepSeek V4 Pro |
|---|---|
| API模型名称 | deepseek-v4-pro |
| 当前模型版本 | DeepSeek-V4-Pro-0813 |
| 上下文长度 | 1M Tokens |
| 最大输出长度 | 384K Tokens |
| 非思考模式 | 支持 |
| 思考模式 | 支持 |
100万Tokens上下文意味着模型可以在单次任务中处理更多代码、文档、日志和历史信息。对于大型代码库分析、长文档整理、多文件审查及复杂Agent任务,这项提升具有较高的实用价值。
384K最大输出长度则为长代码生成、报告编写和多文件内容输出提供了更大空间。不过,API是否允许一次请求直接使用全部长度,还会受到账户配置、接口限制、超时设置和实际调用环境影响。
三、同时支持思考与非思考模式
DeepSeek V4 Pro支持非思考模式和思考模式,开发者可以根据任务类型进行选择。
非思考模式更适合以下任务:
- 普通问答
- 信息提取
- 文本分类
- 内容改写
- 简单代码生成
- 对响应速度要求较高的应用
思考模式更适合以下任务:
- 复杂代码调试
- 多步骤逻辑分析
- 数学与推理问题
- Agent任务规划
- 多工具协同调用
- 需要检查和修正的长流程任务
思考模式通常会使用更多输出Tokens,响应时间和API成本也可能随之增加。实际部署时,可以先判断任务复杂度,再决定是否开启思考模式。
四、DeepSeek V4 Pro API价格
目前公开的API价格显示,DeepSeek V4 Pro按输入缓存命中、输入缓存未命中和输出Tokens分别计费。
| 模型 | 输入缓存命中 | 输入缓存未命中 | 输出 |
|---|---|---|---|
| DeepSeek V4 Pro | 0.025元/百万Tokens | 3元/百万Tokens | 6元/百万Tokens |
| DeepSeek V4 Flash | 0.02元/百万Tokens | 1元/百万Tokens | 2元/百万Tokens |
从当前价格看,V4 Pro缓存未命中的输入价格和输出价格均为V4 Flash的三倍。
V4 Flash更适合请求量大、任务相对简单且重视调用成本的业务,例如文本分类、信息提取和普通问答。V4 Pro则更适合复杂推理、代码开发、工具调用及Agent自动化任务。
需要注意的是,DeepSeek API页面此前已出现服务价格调整提示。正式接入前,开发者仍应以API控制台和模型价格页面显示的信息为准,并设置调用额度、并发限制和费用告警。
五、DeepSeek Harness受到关注
除V4 Pro模型外,DeepSeek Harness也是近期受到关注的产品方向。
“Harness”通常指模型之外用于支持Agent运行的一整套基础设施,包括任务规划、工具调用、代码执行、上下文管理、权限控制、结果检查和运行状态记录等能力。
简单来说,大模型负责理解和推理,Harness负责让模型真正调用工具、操作文件并完成任务。
此前公开招聘信息显示,DeepSeek正在招募Agent Harness研发工程师和产品经理,相关岗位涉及技术架构、产品路线规划以及Agent运行能力建设。
近期出现的“DeepSeek Harness团队”认证账号,主体信息指向北京深度求索人工智能基础技术研究有限公司。不过,该账号目前尚未发布产品介绍或上线时间,不能仅凭账号注册判断产品已经完成或即将公开发布。
如果DeepSeek后续推出独立Harness产品,其定位可能不只是提供模型API,还可能覆盖代码开发、自动化执行和通用Agent运行环境。
常见问题
1、DeepSeek V4 Pro的API模型名称是什么?
API模型名称为deepseek-v4-pro,当前页面显示的模型版本为DeepSeek-V4-Pro-0813。
2、DeepSeek V4 Pro支持多长的上下文?
当前公开参数显示,其上下文长度为100万Tokens,最大输出长度为384K Tokens。
3、V4 Pro和V4 Flash有什么区别?
V4 Pro面向复杂推理、代码开发和Agent任务,调用价格相对较高;V4 Flash更注重速度和成本,适合高频、相对简单的请求。
4、DeepSeek Harness已经发布了吗?
目前尚未看到Harness产品正式发布。认证账号和招聘信息可以证明相关方向正在推进,但具体产品形态与上线时间仍应等待正式公告。
5、V4 Pro适合直接接入生产系统吗?
建议先在测试环境验证模型效果、调用成本和工具执行稳定性,再逐步接入生产系统。涉及文件、数据库和命令操作时,应配置最小权限、人工确认和回滚机制。
相关阅读:
《DeepSeek-V4-Flash正式版上线:130亿激活参数主攻Agent应用》
-
广告合作
-
QQ群号:4114653





