返回新闻列表
2026-08-01 10:11

DeepSeek-V4-Flash正式版上线,130亿激活参数撬动Agent战场

文本核心速览
  1. Flash正式版上线7月31日,DeepSeek-V4-Flash正式版API开启公测,总参数2840亿、激活参数仅130亿,较V4-Pro的490亿激活参数低一个数量级。
  2. Agent性能逼近Pro在Terminal Bench 2.1获82.7分、Cybergym获76.7分、Toolathlon verified获70.3分,多基准接近V4-Pro预览版;本次仅重做后训练,结构不变。
  3. Harness框架首亮相自研Agent框架DeepSeek Harness正式命名亮相,原生支持OpenAI Responses API并适配Codex,帮助开发者低成本迁移OpenAI生态Agent应用。
  4. 估值710亿美元加速商业化公司完成超500亿元首轮融资后估值约710亿美元,正从“不融资不上市”转向商业化冲刺,瞄准Agent应用市场的高性价比需求。

DeepSeek-V4-Flash正式版上线:轻量模型如何撬动Agent战场?

7月31日,DeepSeek-V4-Flash正式版API悄然上线公测,标志着这家国产大模型公司在Agent赛道上迈出关键一步。与以往“Pro强、Flash弱”的分层逻辑不同,此次更新后,Flash正式版在多项Agent基准测试中的表现已逼近甚至超越三个月前的V4-Pro预览版。

性能数据:逼近旗舰的轻量选手

官方数据显示,V4-Flash正式版在以下基准测试中取得了亮眼成绩:

  • Terminal Bench 2.1:82.7分
  • Cybergym:76.7分
  • Toolathlon verified:70.3分

值得注意的是,该模型总参数达到2840亿,但激活参数仅130亿,与V4-Pro(激活490亿)相差近一个数量级。DeepSeek明确表示,此次更新仅重新进行了后训练,模型结构完全不变。这意味着,通过训练方法和数据质量的优化,轻量模型在特定任务上正逐步缩小与旗舰模型的差距。

核心亮点:用更少的激活参数,实现接近旗舰模型的Agent能力。

DeepSeek Harness:自研Agent框架首次亮相

此次升级的另一大看点,是自研Agent框架DeepSeek Harness以正式命名首次亮相。同时,V4-Flash原生支持OpenAI力推的Responses API格式,并针对性适配Codex,开发者可低成本将OpenAI生态的Agent应用迁移至DeepSeek平台。

这一举措的战略意图十分清晰:用高性价比的轻量模型切入Agent应用市场。Agent场景对推理速度和成本极度敏感,Flash的低价优势在反复调用工具的多轮任务中将形成显著竞争力。

商业化加速:资本加持下的冲刺

此次发布距离DeepSeek完成超500亿元首轮融资不足两月,公司估值已攀升至约710亿美元。在资本加持下,DeepSeek正加速从“不融资不上市”转向商业化冲刺。

随着Pro正式版即将到来,Agent战争的大幕已然拉开。DeepSeek能否凭借轻量模型的性价比策略,在竞争激烈的AI市场中占据一席之地?我们将持续关注。


参考来源:DeepSeek官方发布

来源: aibase阅读原文

其他新闻

查看全部