首页站长新闻DeepSeek V4 Pro正式上线!Agent能力、上下文长度及API价格一览

DeepSeek V4 Pro正式上线!Agent能力、上下文长度及API价格一览

2026-08-13 995

2026年8月12日晚,DeepSeek宣布上线DeepSeek V4 Pro正式版。此次更新重点增强了智能体能力,API模型版本同步更新为DeepSeek-V4-Pro-0813,上下文长度提升至100万Tokens,最大输出长度达到384K。

与此前的预览版本相比,V4 Pro更强调复杂任务处理、工具调用和长流程执行能力。对于开发者和企业用户来说,新模型能否稳定完成代码开发、数据处理、自动化操作等实际任务,将成为比单项考试成绩更值得关注的指标。

一、DeepSeek V4 Pro重点增强Agent能力

DeepSeek此次没有同步发布完整的技术报告或模型博客,现阶段公开信息主要包括上线公告、评测图和API参数更新。

从官方发布的评测图来看,DeepSeek V4 Pro正式版的智能体性能较预览版有所提升。在图中列出的多个对比模型中,V4 Pro与Fable 5、Opus-4.8等模型处于相近水平。

其中,V4 Pro在AutomationBench和CyberGym两项评测中的成绩较为突出。

1、AutomationBench

AutomationBench主要用于评估AI智能体执行自动化任务的能力。它关注的不是模型能否回答问题,而是模型能否理解目标、调用工具、完成多个操作步骤,并在执行过程中处理异常情况。

这类能力适用于以下场景:

  • 自动处理文件和表格
  • 调用浏览器或业务系统
  • 编写并运行代码
  • 执行数据整理和分析任务
  • 完成长流程办公自动化
  • 根据执行结果调整后续步骤

对于Agent产品而言,模型能否持续、准确地完成任务,通常比单轮问答能力更加重要。

2、CyberGym

CyberGym用于评估模型在网络安全环境中的实际任务能力,涉及漏洞分析、环境判断、工具使用和攻防操作等内容。

需要注意的是,评测成绩不等于生产环境中的实际表现。不同Agent框架、工具权限、提示词、运行环境和安全限制,都可能影响模型最终完成任务的效果。

DeepSeek V4 Pro正式上线!Agent能力、上下文长度及API价格一览

二、上下文长度提升至100万Tokens

DeepSeek API模型与价格页面显示,V4 Pro对应的模型版本已经更新为DeepSeek-V4-Pro-0813

新版本主要参数如下:

项目 DeepSeek V4 Pro
API模型名称 deepseek-v4-pro
当前模型版本 DeepSeek-V4-Pro-0813
上下文长度 1M Tokens
最大输出长度 384K Tokens
非思考模式 支持
思考模式 支持

100万Tokens上下文意味着模型可以在单次任务中处理更多代码、文档、日志和历史信息。对于大型代码库分析、长文档整理、多文件审查及复杂Agent任务,这项提升具有较高的实用价值。

384K最大输出长度则为长代码生成、报告编写和多文件内容输出提供了更大空间。不过,API是否允许一次请求直接使用全部长度,还会受到账户配置、接口限制、超时设置和实际调用环境影响。

三、同时支持思考与非思考模式

DeepSeek V4 Pro支持非思考模式和思考模式,开发者可以根据任务类型进行选择。

非思考模式更适合以下任务:

  • 普通问答
  • 信息提取
  • 文本分类
  • 内容改写
  • 简单代码生成
  • 对响应速度要求较高的应用

思考模式更适合以下任务:

  • 复杂代码调试
  • 多步骤逻辑分析
  • 数学与推理问题
  • Agent任务规划
  • 多工具协同调用
  • 需要检查和修正的长流程任务

思考模式通常会使用更多输出Tokens,响应时间和API成本也可能随之增加。实际部署时,可以先判断任务复杂度,再决定是否开启思考模式。

四、DeepSeek V4 Pro API价格

目前公开的API价格显示,DeepSeek V4 Pro按输入缓存命中、输入缓存未命中和输出Tokens分别计费。

模型 输入缓存命中 输入缓存未命中 输出
DeepSeek V4 Pro 0.025元/百万Tokens 3元/百万Tokens 6元/百万Tokens
DeepSeek V4 Flash 0.02元/百万Tokens 1元/百万Tokens 2元/百万Tokens

从当前价格看,V4 Pro缓存未命中的输入价格和输出价格均为V4 Flash的三倍。

V4 Flash更适合请求量大、任务相对简单且重视调用成本的业务,例如文本分类、信息提取和普通问答。V4 Pro则更适合复杂推理、代码开发、工具调用及Agent自动化任务。

需要注意的是,DeepSeek API页面此前已出现服务价格调整提示。正式接入前,开发者仍应以API控制台和模型价格页面显示的信息为准,并设置调用额度、并发限制和费用告警。

DeepSeek V4 Pro正式上线!Agent能力、上下文长度及API价格一览

五、DeepSeek Harness受到关注

除V4 Pro模型外,DeepSeek Harness也是近期受到关注的产品方向。

“Harness”通常指模型之外用于支持Agent运行的一整套基础设施,包括任务规划、工具调用、代码执行、上下文管理、权限控制、结果检查和运行状态记录等能力。

简单来说,大模型负责理解和推理,Harness负责让模型真正调用工具、操作文件并完成任务。

此前公开招聘信息显示,DeepSeek正在招募Agent Harness研发工程师和产品经理,相关岗位涉及技术架构、产品路线规划以及Agent运行能力建设。

近期出现的“DeepSeek Harness团队”认证账号,主体信息指向北京深度求索人工智能基础技术研究有限公司。不过,该账号目前尚未发布产品介绍或上线时间,不能仅凭账号注册判断产品已经完成或即将公开发布。

如果DeepSeek后续推出独立Harness产品,其定位可能不只是提供模型API,还可能覆盖代码开发、自动化执行和通用Agent运行环境。

常见问题

1、DeepSeek V4 Pro的API模型名称是什么?

API模型名称为deepseek-v4-pro,当前页面显示的模型版本为DeepSeek-V4-Pro-0813

2、DeepSeek V4 Pro支持多长的上下文?

当前公开参数显示,其上下文长度为100万Tokens,最大输出长度为384K Tokens。

3、V4 Pro和V4 Flash有什么区别?

V4 Pro面向复杂推理、代码开发和Agent任务,调用价格相对较高;V4 Flash更注重速度和成本,适合高频、相对简单的请求。

4、DeepSeek Harness已经发布了吗?

目前尚未看到Harness产品正式发布。认证账号和招聘信息可以证明相关方向正在推进,但具体产品形态与上线时间仍应等待正式公告。

5、V4 Pro适合直接接入生产系统吗?

建议先在测试环境验证模型效果、调用成本和工具执行稳定性,再逐步接入生产系统。涉及文件、数据库和命令操作时,应配置最小权限、人工确认和回滚机制。

相关阅读:

DeepSeek-V4-Flash正式版上线:130亿激活参数主攻Agent应用

DeepSeek宣布将上调API服务价格

  • 广告合作

  • QQ群号:4114653

温馨提示:
1、本网站发布的内容(图片、视频和文字)以原创、转载和分享网络内容为主,如果涉及侵权请尽快告知,我们将会在第一时间删除。邮箱:2942802716#qq.com(#改为@)。 2、本站原创内容未经允许不得转裁,转载请注明出处“站长百科”和原文地址。

相关文章