行业研报计算机有原文

软件与服务行业AI产业跟踪:DeepSeek-R1-0528更新,国产大模型持续演进250603

查看原始报告

这篇研报讲什么?

摘要原文摘录

事件描述5 月 28 日,DeepSeek R1 模型宣布完成小版本升级,当前版本为 DeepSeek-R1-0528。用户通过官方网站、App 或小程序进入对话界面后,开启“深度思考”功能即可体验最新版本。API 也已同步更新,调用方式不变。事件评论l 思维深度与推理能力显著提升,整体性能接近其他国际顶尖模型。DeepSeek-R1-0528 使用 De…

研究对象计算机
发布机构长江证券
分析师宗建树
发布日期2025-06-03
原始报告提供原始报告入口

机构观点归属长江证券,研报雷达仅作摘要整理与机构观点聚合。以下为研报摘要原文摘录,内容以原始报告为准。

研究对象计算机
股票代码不适用
公司共识评级样本不足近 180 天暂无有效评级
一致目标价样本不足近 180 天暂无有效目标价

研报摘要

摘要原文以原始报告为准

事件描述5 月 28 日,DeepSeek R1 模型宣布完成小版本升级,当前版本为 DeepSeek-R1-0528。用户通过官方网站、App 或小程序进入对话界面后,开启“深度思考”功能即可体验最新版本。API 也已同步更新,调用方式不变。事件评论l 思维深度与推理能力显著提升,整体性能接近其他国际顶尖模型。DeepSeek-R1-0528 使用 DeepSeek V3 Base 模型作为基座,并在后训练过程中投入了更多算力,显著提升了模型的思维深度与推理能力。在 AIME 2025 测试中,新版模型准确率由旧版的 70%提升至 87.5%。这一进步得益于模型在推理过程中的思维深度增强:在 AIME 2025 测试集上,旧版模型平均每题使用 12K tokens,而新版模型平均每题使用 23K tokens,表明其在解题过程中进行了更为详尽和深入的思考,整体表现上已接近 o3 与 Gemini-2.5-Pro 等其他国际顶尖模型水平。l 其他能力同步更新,模型可用性持续提升。除深度思考能力强化外,此次 DeepSeek-R1-0528 在幻觉改善、创意写作、工具调用、前端代码生成、角色扮演等领域的能力均有更新和提升。其中 DeepSeek-R1-0528 针对“幻觉”问题进行了优化,使其在改写润色、总结摘要、阅读理解等场景中,幻觉率降低了 45~50% 左右,能够有效地提供更为准确、可靠的结果。我们认为这些更新大幅提升了 DeepSeek-R1-0528 的可用性,为DeepSeek 的更广泛应用奠定了基础。l DeepSeek 持续开源,推动我国大模型性能达世界领先水平。DeepSeek 此次继续公布了DeepSeek-R1-0528 的模型权重,其开源仓库(包括模型权重)仍然统一采用 MIT License,并允许用户利用模型输出、通过模型蒸馏等方式训练其他模型,与旧版本的DeepSeek-R1 保持一致。在开源模式下,DeepSeek 持续吸引开发者参与合作开发,推动我国大模型性能持续演进。此前,英伟达 CEO 黄仁勋表示 DeepSeek 和阿里巴巴的通义千问(Qwen)是“当前表现最优的开源 AI 模型之一”。我国开源大模型已经达到世界领先水平。l DeepSeek R1 持续更新,关注 AI 产业投资机遇。当前时点,以 DeepSeek 和阿里千问为代表的国产大模型持续演进,模型的思维深度和推理能力进一步提升,并提升了幻觉改善、创意写作、工具调用、前端代码生成、角色扮演等领域的能力,比肩世界领先水平,有望推动国产大模型加速产业落地,带动全产业链受益。建议关注 1)国产大模型领军企业;2)国产算力产业链;3)算力基础设施;4)AI Agent 相关厂商。风险提示1、AI 技术发展不及预期;2、下游应用需求不及预期。

同公司研报

继续比较不同机构对同一公司的判断。

进入公司页

同行业近期研报

从单家公司继续回到行业研究。

进入行业专题