行业研报传媒有原文

媒体行业:可灵AI“全能灵感周”连续上新,Gemini 3 Deep Think推理能力再进阶-AI系列跟踪(84)251211

查看原始报告

这篇研报讲什么?

摘要原文摘录

事件描述12 月 1 日-5 日,可灵 AI 连续 5 天上新,发布视频 O1 模型、图片 O1 模型、音画同出模型可灵 2.6、可灵数字人 2.0,以及可灵 O1“主体库”、“对比模版”功能。12 月 5 日,Gemini 3 Deep Think 正式上线。事件评论

研究对象传媒
发布机构长江证券
分析师高超
发布日期2025-12-11
原始报告提供原始报告入口

机构观点归属长江证券,研报雷达仅作摘要整理与机构观点聚合。以下为研报摘要原文摘录,内容以原始报告为准。

研究对象传媒
股票代码不适用
公司共识评级样本不足近 180 天暂无有效评级
一致目标价样本不足近 180 天暂无有效目标价

研报摘要

摘要原文以原始报告为准

事件描述12 月 1 日-5 日,可灵 AI 连续 5 天上新,发布视频 O1 模型、图片 O1 模型、音画同出模型可灵 2.6、可灵数字人 2.0,以及可灵 O1“主体库”、“对比模版”功能。12 月 5 日,Gemini 3 Deep Think 正式上线。事件评论

可灵发布图片 O1 模型,赋能全场景创意落地。图片 O1 模型以“自然语言+图像”的多模态描述作为交互入口,具备以下核心优势:1)特征高度保持:支持多达 10 张参考图的特征提取,通过多维视觉解析技术,不论是否跨图均能保持主体轮廓、核心元素与色调基调等特征的高度统一,在很大程度上降低创作者的创作时间成本,可灵图片 O1 模型在多图参考任务上表现出色,与 Nano Banana/即梦 4.0 的效果胜负比分别为 174%/123%;2)精准响应修改:创作者不需要掌握专业修图技能,通过文字指令输入即可实现对特定人物、物品、元素的精准新增、删除及优化;3)统一风格调性:图片 O1 模型能够深度理解参考图的风格调性,实现画面风格的高度统一,适用于品牌视觉统一、分镜设计等多元场景。

可灵 2.6 作为首个音画同出模型,首次实现“所见即所闻”。从创作流程来说,可灵 2.6 模型有别于传统 AI 视频模型“先生成画面、后配音剪辑”的割裂流程,能直接生成包含语音、音效、环境音的完整视频。目前主要包括两种创作路径:一是文生音画,创作者输入文本即可生成视频;二是图生音画,适用于已有图像的进一步拓展。目前可灵 2.6 模型支持生成 5s/10s 视频,支持的音频类型包括对话叙述、对白、唱歌、Rap、环境音效、物体/动作音效、混合音效等。价格方面,在高品质模式下,使用视频 2.6 模型生成 10s 非音画同步/音画同步视频,分别对应 50/100 灵感值。

谷歌上线 Gemini 3 Deep Think 模式,复杂推理能力显著加强。Gemini 3 Deep Think 模型采用“并行推理”机制,能够探索多种假设、进行多轮迭代思考,因此更加擅长处理复杂问题。Gemini 3 Deep Think 主要专注于解决复杂数学、科学推理与逻辑问题,在 ARCAGI-1 测试(基础抽象推理能力测试)中以 87.5%的成绩超越 GPT-5、Claude Opus 4.5等先进模型,在 ARC-AGI-2 测试(“类人智慧”高阶推理能力测试)中以 45.1%的成绩大幅领先于 GPT-5 Pro 18.3%的成绩。目前 Gemini 3 Deep Think 已在 Gemini App 向Google AI Ultra 的订阅用户开放。

建议关注以下 AI 细分赛道:1)优质 IP 或受益于 AI 技术演进带来的创作效率和变现价值提升,看好受益于多模态加速的 AI 漫剧赛道,关注工具型实力领先且 AI 能力持续迭代升级的快手等;2)大厂具备流量分发、模型、数据等优势,聚焦 to C AI Agent 打造商业闭环,关注腾讯控股等;3)海外已跑通商业模式,国内有望复制的广告、电商、教育等垂直赛道;4)AI+游戏陆续落地,关注 AI 布局积极的巨人网络、恺英网络等游戏厂商。风险提示1、AI 技术发展及应用落地不及预期风险;2、内容监管风险。

同公司研报

继续比较不同机构对同一公司的判断。

进入公司页

同行业近期研报

从单家公司继续回到行业研究。

进入行业专题