AI++
产业观察·2026-07-31·4 分钟阅读·AI++ 编辑部

DeepSeek-V4-Flash正式版公测 Agent能力全线大幅提升

2026年7月,DeepSeek低调上线DeepSeek-V4-Flash正式版API公测,未发布官方公告,相关信息通过API更新日志被开发者发现。本次升级未调整模型架构与尺寸,仅通过后训练强化Agent执行、工具调用与长任务处理能力,9项Agent基准测试数据全线大涨,性价比优势进一步凸显。

DeepSeek于2026年7月31日低调上线DeepSeek-V4-Flash正式版API公测,相关信息通过API更新日志被开发者发现,官方未发布公开公告。本次升级未调整模型结构与尺寸,仍保持284B总参数、13B激活参数的配置,仅通过后训练强化Agent执行、工具调用与长任务处理能力。

本次升级的性能提升幅度显著,对比DeepSeek-V4-Flash Preview版本,9项Agent基准测试数据全线上涨:DeepSWE从7.3升至54.4,增幅达47.1分;CyberGym增幅38分;DSBench-Hard增幅33.8分;DSBench-FullStack增幅31.7分;Terminal-Bench 2.1从61.8升至82.7,增幅20.9分。

对比DeepSeek-V4-Pro Preview版本,DeepSeek-V4-Flash 0731在9项测试中全部领先,其中DeepSWE高41.6分,CyberGym高24分,DSBench-Hard高28.5分,Terminal-Bench 2.1高10.6分,以激活参数仅13B的轻量模型实现了对自家Pro Preview版本的性能反超。

DeepSeek-V4-Flash正式版API上线公测的通知及DeepSeek品牌标识

在行业横向对比中,DeepSeek-V4-Flash 0731已进入Agent模型第一梯队,但未超越GPT-5.6 Sol、Claude Opus 5、Kimi K3等头部模型。在Toolathlon-Verified测试中,其70.3分的成绩超过GLM-5.2,与Kimi K3仅差6.2分;在Terminal-Bench 2.1、DeepSWE等测试中,仍与头部模型存在5至18.6分的差距。

价格方面,DeepSeek-V4-Flash 0731的定价保持稳定,每百万token常规价格为缓存未命中输入0.14美元、缓存命中输入0.0028美元、输出0.28美元,较GPT-5.6 Luna的对应价格分别低30%、86%、近77%,性价比优势突出。

DeepSeek-V4-Flash 0731版本与其他模型的9项Agent基准测试数据对比表格

DeepSeek-V4-Flash 0731版本与Flash Preview、V4-Pro Preview的9项Agent基准测试数据对比条形图,体现性能全线提

2026年7月Agent模型横向对比,五项重合度最高公开基准的性能数据,DeepSeek V4-Flash 0731已进入第一梯队,但未超越最强模型

截至2026年7月31日的AI模型单价对比,V4-Flash 0731、V4-Flash Preview的价格一致,低于GPT-5.6 Luna,正式版价格与P

来源

DeepSeekAI模型Agent能力API模型评测