2026 年 9 月 17 日至 19 日,第十一届华为全联接大会在上海世博展览馆及世博中心举办。生数科技携多模态大模型体系与场景化应用成果亮相大会,重点展示 Vidu 实时视频生成技术,围绕视频流式生成、智能体内容生产、实时交互、产业服务四大方向,探索 AI 视频技术面向行业业务场景的落地路径。

当前 AIGC 产业的关注重心,已从高清画面生成能力,转向业务场景的实际落地成效。当 AI 视频生成应用于广告营销、短剧创作、互动娱乐等领域时,普遍面临生产链路割裂、成片品质不稳定、行业生产经验难以复用等现实痛点。生数科技 Vidu 体系依托 Q 系列、S 系列模型,针对性破解内容产业落地过程中的各类难题。
行业模型矩阵,构筑从成片到实时交互的能力底座
为满足各垂直领域差异化的内容生产诉求,Vidu 对模型开展精细化行业适配,构建起两套模型能力体系:Q3 系列行业模型赋能垂直领域专业内容创作,S2 系列模型聚焦流式实时交互场景。

Vidu Q3 Drama:面向短剧、漫剧等精品剧生产场景推出的深度优化模型,模型针对影视剧场景进行有监督定向专项训练,让模型充分学习短剧镜头语言、人物表演、剧情叙事逻辑,天然适配精品短漫剧生产需求。
Vidu Q3 AD:面向广告电商业务场景打造的垂类模型,针对营销场景进行专项调优,强化画面表现力、视觉设计与商品卖点呈现,可覆盖电商投流、品牌宣传、剧情类广告等高频业务,高效产出表现力突出的商业营销素材。
Vidu S2:全球领先的实时交互与实时编辑模型。Vidu S2作为最新发布的系列, 包含两大子模型:Vidu S2-Avatar,面向持续交互的数字角色生成;Vidu S2-Editing,面向输入视频流的实时编辑,支持实时换风格,换服装,换角色,换背景。现已在游戏、直播、AI 陪伴、影视等领域实现商业化落地。
整套垂类模型矩阵的背后,依托生数科技长期沉淀的原创多模态技术底座。生数科技成立于 2023 年 3 月,由清华大学 Bosch AI 教授、人工智能研究院副院长朱军担任创始人兼首席科学家。团队采用原生多模态架构,实现文本、图像、视频的统一范式训练,而非简单拼接各类单模态模型。
此外,团队率先提出 U‑ViT 网络架构,自研的 DPM‑Solver 采样算法被 Stable Diffusion 采用,无训练推理框架 Analytic‑DPM 被 DALL・E 2 采用,多项技术成果已经成为扩散模型领域重要的公共技术基础。
深化华为云生态协同,共推 AIGC 生产力落地
生数科技与华为云围绕算力底座、模型服务、产业生态三大维度构建协同体系。依托华为云算力底座能力,结合生数科技在行业多模态、实时交互模型领域的技术积累,双方共同推动Q3 垂类模型、S2 实时生成模型在短剧、广告、直播、文旅等行业落地应用,降低企业使用多模态 AI 技术的应用门槛。

面向未来,生数科技将持续打磨面向行业的模型能力,联合生态伙伴落地业务场景验证,构筑内容产业稳定可靠的生产力基础设施。
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。
责任编辑:kj015