行业研报IT服务Ⅱ有原文

计算机行业点评报告:DeepSeek-V4-Flash超高性价比重塑Agent竞争格局

查看原始报告

这篇研报讲什么?

摘要原文摘录

模型沿用V4系列MoE架构与2840亿总参数、130亿激活参数的基础规格,仅通过重新后训练便实现Agent能力跨越式提升,Terminal Bench2.1得分从预览版的61.8跃升至82.7,Toolathlon Verified达70.3分,在终端操作、代码仓库生成、网络安全攻防等九项智能体基准测试中全面反超自家V4-Pro预览版,验证了后训练优化在执…

研究对象IT服务Ⅱ
发布机构开源证券
分析师张越,叶进新
发布日期2026-08-04
原始报告提供原始报告入口

机构观点归属开源证券,研报雷达仅作摘要整理与机构观点聚合。以下为研报摘要原文摘录,内容以原始报告为准。

研究对象IT服务Ⅱ
股票代码不适用
公司共识评级样本不足近 180 天暂无有效评级
一致目标价样本不足近 180 天暂无有效目标价

研报摘要

摘要原文以原始报告为准

后训练驱动Agent能力跃迁,轻量模型突破执行能力边界

模型沿用V4系列MoE架构与2840亿总参数、130亿激活参数的基础规格,仅通过重新后训练便实现Agent能力跨越式提升,Terminal Bench2.1得分从预览版的61.8跃升至82.7,Toolathlon Verified达70.3分,在终端操作、代码仓库生成、网络安全攻防等九项智能体基准测试中全面反超自家V4-Pro预览版,验证了后训练优化在执行类任务上的杠杆效应远超参数堆叠。底座延续混合注意力机制设计,原生支持100万超长上下文与38.4万最大输出。三档推理模式灵活适配不同难度任务,Think Max档位在代码生成、数学推理等深度任务上已接近旗舰模型水平,在运维自动化、编程助手、安全审计等执行场景具备实用级落地能力。

构建超高性价比定价体系,重构Agent应用单位经济模型

产品维持预览版定价不变,采用缓存分级计费模式:缓存未命中输入1元/百万tokens、命中缓存输入低至0.02元/百万tokens、输出2元/百万tokens,综合成本显著低于海外闭源旗舰模型。单账号并发上限达2500,为V4-Pro的五倍,更适配高并发Agent应用场景。缓存定价策略针对性解决长链路Agent的成本痛点,多轮交互的边际调用成本大幅下降,配合DSpark推理优化带来的算力效率提升,同等硬件投入下有效产出大幅增长。对于自动化运维、代码审查、数据处理等重度依赖长序列生成的Agent场景,推理效率的提升有助于改善其成本结构,DeepSeek-V4-Flash的推出推进了企业级智能体部署的经济可行性。

全栈生态布局切入开发者腹地,加速Agent产业规模化落地

模型原生支持OpenAI Responses API格式,并针对性适配Codex客户端,覆盖命令行工具、桌面端及VS Code插件,提供一键配置迁移脚本,大幅降低OpenAI生态开发者的切换成本,直接切入代码智能体主流入口。自研DeepSeek Harness框架首次在官方测试中亮相,承载Agent运行时与持续学习能力,标志着DeepSeek从模型厂商向智能体全栈基础设施厂商演进。发布仅两日即登陆国家超算互联网,为政企信创场景提供合规部署路径。MIT开源协议兜底消除厂商锁定顾虑,配合高并发、低价格、强Agent能力的产品组合,正在重塑开发者对智能体底座的选型标准,推动Agent应用从原型验证阶段走向规模化商用落地。

受益标的

国产算力:寒武纪、海光信息、天数智芯、禾盛新材、沐曦股份、摩尔线程、中国长城、龙芯中科、芯原股份、品高股份、锐捷网络等、浪潮信息、工业富联、紫光股份、中科曙光、华勤技术等。

算力租赁:行云科技、宏景科技、利通电子、杰创智能、协创数据、航锦科技、润泽科技、东阳光、华策影视、亿田智能、平治信息、盛视科技、盈峰环境、熙菱信息等。

风险提示

AI模型竞争风险、AI应用竞争风险、AI模型发展不及预期风险等。

同公司研报

继续比较不同机构对同一公司的判断。

进入公司页

同行业近期研报

从单家公司继续回到行业研究。

进入行业专题