行业研报计算机有原文

计算机行业:国产AI,核心主线250824

查看原始报告

这篇研报讲什么?

摘要原文摘录

DeepSeek-V3.1 架构创新实现系统性突破。DeepSeek-V3.1 是新一代旗舰大模型,凭借架构创新实现能力突破。其采用 6850 亿参数与混合专家架构(MoE),支持 128K 超长上下文窗口,预训练阶段新增 840B tokens数据(含大量 Agent 场景数据),强化工具调用能力。技术上,通过思维链压缩训练减少冗余、MoE 稀疏激活机制…

研究对象计算机
发布机构财通证券
分析师杨烨
发布日期2025-08-24
原始报告提供原始报告入口

机构观点归属财通证券,研报雷达仅作摘要整理与机构观点聚合。以下为研报摘要原文摘录,内容以原始报告为准。

研究对象计算机
股票代码不适用
公司共识评级样本不足近 180 天暂无有效评级
一致目标价样本不足近 180 天暂无有效目标价

研报摘要

摘要原文以原始报告为准

DeepSeek-V3.1 架构创新实现系统性突破。DeepSeek-V3.1 是新一代旗舰大模型,凭借架构创新实现能力突破。其采用 6850 亿参数与混合专家架构(MoE),支持 128K 超长上下文窗口,预训练阶段新增 840B tokens数据(含大量 Agent 场景数据),强化工具调用能力。技术上,通过思维链压缩训练减少冗余、MoE 稀疏激活机制(单次推理仅用约 160 亿参数)降计算开销。还升级混合推理架构,提升思考效率与 Agent 能力,编程、搜索智能体支持增强。测试中,其 SWE-bench、Terminal-Bench、Browsecomp等成绩大幅提升,输出 tokens 减少 20%-50%仍保性能,实现效率与成本平衡。

UE8M0 FP8 Scale:DeepSeek 助力国产芯片对齐国际标准。UE8M0 是 OCP 2023 年发布的 MX 规范中,为 AI 运算设计的 8 位指数、无尾数编码方式,作低精度数据块级缩放因子,可避免训练中数值溢出/下溢,保障稳定性。MX 规范将张量分块,块内低精度存储,块外配 UE8M0 编码缩放因子。英伟达 Blackwell 架构首现 MX 原生支持,降开销且 MXFP8 吞吐率较 BF16 提升约 2 倍。DeepSeek-V3.1 采用“UE8M0 FP8 Scale”,既对齐标准适配 Blackwell,又通过工程封装兼容国产硬件,还为国产算力兼容提供技术缓冲。

H20 vs. 国产芯片:国产化崛起的终极博弈。2025 年 4 月,美对英伟达 H20 芯片对华出口实施管制,冻结其销售,该芯片曾是英伟达对华特供款,2024 年贡献 120-150 亿美元收入,禁令致企业停单、英伟达库存滞销。此背景下,中国加速国产 AI 芯片替代:政策支持使 2025Q2 国产芯片市占率达 38.7%;DeepSeek-V3.1 的 UE8M0FP8 技术适配华为昇腾、昆仑芯等10 家厂商;摩尔线程、沐曦等国产 GPU 企业冲刺 IPO,获国家大基金 680亿元及产业资本支持。目前中国 AI 加速卡市场国产份额超 40%,产业链形成“融资—研发—落地”正向循环,走独立可持续路径。

投资建议

见正文。

风险提示

技术迭代不及预期的风险;商业化落地不及预期的风险;政策支持不及预期风险;全球宏观经济风险。

同公司研报

继续比较不同机构对同一公司的判断。

进入公司页

同行业近期研报

从单家公司继续回到行业研究。

进入行业专题