首页站长新闻DeepSeek-V4-Flash正式版上线:130亿激活参数主攻Agent应用

DeepSeek-V4-Flash正式版上线:130亿激活参数主攻Agent应用

2026-08-03 237

7月31日,DeepSeek-V4-Flash正式版API上线公测。这次更新的重点并不只是模型性能提升,而是将目标进一步对准Agent应用市场。

以往大模型产品普遍采用“Pro性能更强、Flash速度更快”的分层方式,但从DeepSeek公布的测试结果来看,V4-Flash正式版在部分Agent任务中的表现,已经接近甚至超过三个月前发布的V4-Pro预览版。

官方数据显示,DeepSeek-V4-Flash正式版在Terminal Bench 2.1测试中取得82.7分,CyberGym为76.7分,Toolathlon Verified为70.3分。

从模型规模来看,V4-Flash总参数量为2840亿,但每次推理仅激活130亿参数;V4-Pro的激活参数则为490亿。DeepSeek表示,这次升级没有调整模型结构,仅重新进行了后训练。这也意味着,V4-Flash的性能提升主要来自训练方法和数据质量优化。

DeepSeek Harness首次正式亮相

除了模型本身,本次更新还带来了DeepSeek自研Agent框架——DeepSeek Harness。

该框架主要用于处理工具调用、任务执行和多步骤工作流。V4-Flash同时原生支持Responses API格式,并针对Codex类编程场景进行了适配。原本基于OpenAI接口开发的Agent应用,可以减少接口改造工作,更方便地迁移到DeepSeek平台。

对开发者来说,这项变化比单纯提高基准测试成绩更有实际意义。Agent应用通常需要连续调用搜索、代码执行、文件处理和其他外部工具,接口兼容性会直接影响迁移成本。

轻量模型更适合Agent高频调用

Agent任务往往不是一次问答就结束,而是需要模型反复推理和调用工具。如果每一步都使用高价旗舰模型,随着调用次数增加,API成本也会迅速上涨。

V4-Flash只激活130亿参数,在保持较低推理成本和较快响应速度的同时,仍能覆盖代码执行、终端操作和工具调用等任务。对于需要大量API请求的编程助手、自动化工作流和企业Agent应用来说,这种轻量化路线更容易控制成本。

从这次更新可以看出,DeepSeek正在尝试用V4-Flash承接高频、成本敏感的Agent任务,再由后续的V4-Pro处理复杂度更高的推理场景。

DeepSeek加快商业化布局

V4-Flash正式版发布距离DeepSeek完成首轮融资不足两个月。公开信息显示,其首轮融资规模超过500亿元,公司估值约为710亿美元。

获得资本支持后,DeepSeek正在加快API、Agent框架和开发者生态建设。随着V4-Pro正式版临近,DeepSeek后续可能会形成Flash与Pro两条产品线:前者侧重速度、成本和高频工具调用,后者则面向更复杂的推理和专业任务。

对开发者而言,V4-Flash是否值得接入,还要结合正式API价格、上下文长度、并发限制、稳定性和实际任务效果判断。不过从目前公布的数据来看,轻量模型与Agent框架的组合,已经成为DeepSeek接下来重点投入的方向。

  • 广告合作

  • QQ群号:4114653

温馨提示:
1、本网站发布的内容(图片、视频和文字)以原创、转载和分享网络内容为主,如果涉及侵权请尽快告知,我们将会在第一时间删除。邮箱:2942802716#qq.com(#改为@)。 2、本站原创内容未经允许不得转裁,转载请注明出处“站长百科”和原文地址。

相关文章