行业研报计算机有原文

软件与服务行业AI产业跟踪:通义首个深度研究Agent开源,看好AIAgent迭代及其商业化落地加速250921

查看原始报告

这篇研报讲什么?

摘要原文摘录

事件描述2025 年 9 月 17 日,通义首个深度研究 Agent 模型 DeepResearch 正式发布,以 30B-A3B 的轻量级在多个权威评测集上取得 SOTA 成绩,当前模型、框架和方案均已全面开源。事件评论

研究对象计算机
发布机构长江证券
分析师宗建树
发布日期2025-09-21
原始报告提供原始报告入口

机构观点归属长江证券,研报雷达仅作摘要整理与机构观点聚合。以下为研报摘要原文摘录,内容以原始报告为准。

研究对象计算机
股票代码不适用
公司共识评级样本不足近 180 天暂无有效评级
一致目标价样本不足近 180 天暂无有效目标价

研报摘要

摘要原文以原始报告为准

事件描述2025 年 9 月 17 日,通义首个深度研究 Agent 模型 DeepResearch 正式发布,以 30B-A3B 的轻量级在多个权威评测集上取得 SOTA 成绩,当前模型、框架和方案均已全面开源。事件评论

能力跃迁,从“能聊天”到产出有引用、可复现的调研报告与决策建议。以 30B-A3B 轻量级,实现性能比肩基于多个海外旗舰模型的 ReAct Agent。通义 DeepResearch 在 HLE(32.9)、BrowseComp-ZH(46.7)、GAIA(70.9)、xbench-Deepsearch(75.0)、WebWalkerQA(72.2)、Frames(90.6)和 SimpleQA(98.6)等权威 Agent 评测集中取得 SOTA(括号内为模型得分)。推理范式:(1)原生 ReAct 模式(思考-行动-观察):128k 上下文,支持多次迭代解决问题,实现与环境交互的可扩展性。(2)深度模式:用于处理极端复杂的多步研究任务,旨在将 Agent 的能力发挥到极致,实现高质量长程推理。我们认为轻量化、高性能、开源或将成为未来行业竞争聚焦要素。

引领 Agent model 范式革新,建立了从增量预训练到强化学习的端到端方案。(1)数据策略:构建了一套以合成数据驱动的完整训练链路,实现大规模生成高质量训练数据。该链路以 Qwen3-30B-A3B 模型为基座进行优化,引入增量预训练形成一套系统化、可扩展的数据合成方案,与后训练形成数据飞轮。(2)推理架构:基于全新的 IterResearch 范式,将复杂任务解构为多个"研究轮次",每轮仅使用最重要的输出重建精简工作空间,保持“认知焦点”,解决了深度研究过往“单窗口、线性累加”的信息处理模式在处理长周期任务时推理能力降低的问题,提升长程推理与实际交付能力。(3)基于 On-Policy 策略的 RL:创新性设计了覆盖真实环境与虚拟环境的 RL 算法验证与真实训练模块,并结合高效异步强化学习算法及自动化数据策展(Data Curation)流程,显著提升了模型的迭代速度和泛化能力,通义 DeepSearch 打通预训练与后训练,以“Agentic CPT→Agentic SFT→Agentic RL”的链路形成无缝端到端循环,同时摆脱了对昂贵人工标注的依赖,有望引领 Agent 训练新范式并进一步降本,推动应用规模化落地加速。

从技术 Demo 到产业应用,商业化落地加速推进。当前 DeepResearch 已经在阿里系部分应用中验证:(1)高德出行 Agent:地图导航+本地生活的复杂查询体验;(2)通义法睿:权威类案检索、法条匹配与专业观点融合。伴随模型交付能力增强,未来有望在企业战略、科研综述、法律合规、投研分析、电商选品、教育培训等多个场景落地。

关注通义后续发布及应用落地情况。今年以来,通义团队精准布局,持续补全其开源产品矩阵,建立行业技术标准,有望重塑竞争格局。在基础模型能力逐渐收敛的背景下, Agent投资核心逻辑不断强化。伴随国内模型能力加速迭代、AI 应用货币化开启,持续看好 Agent商业化及投资机遇,建议关注:1)AI Infra:伴随 AI 应用加速落地,AI Infra 有望核心收益,重点推荐阿里巴巴;2)AI Agent 相关厂商;3)中国推理算力产业链;4)CSP 厂商方面关注推理需求带来的推动;5)IDC,重点关注与阿里等大厂合作的 IDC。风险提示1、AI 技术发展不及预期;2、下游应用需求不及预期。

同公司研报

继续比较不同机构对同一公司的判断。

进入公司页

同行业近期研报

从单家公司继续回到行业研究。

进入行业专题