2026 世界人工智能大会落下帷幕,生数科技通过专题论坛与线下展区完整展示通用世界模型全系列产品,形成 Vidu 内容生成、Vidu 实时交互、Motubrain 机器人动作三大产品线,同步联合产业链发起 AI 影视出海联盟,完成从虚拟数字内容到实体具身智能的完整技术落地闭环。
一、联合论坛发布产业共识,搭建 AI 影视出海生态
生数科技携手万兴科技承办「世界模型驱动 AI 影视生产力」专题论坛,创始人朱军发表主题演讲,明确通用世界模型是连接虚实的新一代 AI 基础设施,区别于单纯图文视频模型,核心是建模时空、因果、物理规律,实现感知 - 预测 - 行动一体化。
论坛上,万兴科技、阿里云等企业分别从产业变革、算力支撑分享观点,圆桌环节围绕模型协同、内容出海展开研讨。现场生数联合多家头部机构签约成立万剧出海共创联盟,覆盖底层模型、IP 内容、创作者、全球发行、产业资本全链路,依托通用世界模型底座助力国产短剧、影视、虚拟内容规模化出海,打造全球化 AI 内容产业协同体系。
二、数字内容双产品线:Vidu/Vidu S1 覆盖离线创作与实时交互
1. Vidu 系列离线内容生成模型
作为数字世界生成底座,支持文生图 / 视频、参考素材生成,优势是画面物理逻辑、人物动作高度统一,不再只生成单一片段,可完整推演空间关系与动态变化。对外开放 SaaS、API、智能体多种服务形态,广泛用于广告、短剧、电商短视频批量生产,大幅降低内容制作周期。
2. Vidu S1 实时交互模型
突破传统静态视频局限,主打实时数字人互动,输入人物形象、音色即可生成可对话虚拟角色,支持 540P 最高 42FPS 连续输出。可实时同步表情、手势、身体动作,适配虚拟直播、互动游戏、在线教育、数字客服等场景,实现不限时长持续人机对话。
三、Motubrain:MoT 架构通用机器人大脑,具身智能赛道领跑
Motubrain 是生数面向物理世界的核心动作模型,采用自研 MoT 统一 Transformer 架构,将环境感知、状态预测、动作生成整合在同一底座,摒弃多模型拼接带来的数据损耗。
核心三大优势:
一是多机器人通用,一套模型适配轮式、多关节等不同设备;
二是长程任务自主规划,动态环境实时调整动作;
三是行业榜单领跑,RoboTwin、WorldArena 两大权威评测均拿下综合第一,在家庭服务、工业产线场景稳定完成复杂连续作业,解决传统机器人动作单一、环境适应差的痛点。
四、产业价值:通用世界模型成为跨场景统一 AI 基座
行业 AI 发展重心从单纯素材生成转向理解、预判、自主执行,而生数三条产品线构成完整虚实技术路径:Vidu 负责静态批量内容产出,Vidu S1 负责实时人机交互,Motubrain 落地实体机器人操作。
整套通用世界模型不再局限单一赛道,一端赋能影视、电商、虚拟人文创产业,另一端支撑工业、家用具身智能规模化落地,搭配阿里云全栈算力底座与出海产业联盟,形成 “技术 - 工具 - 产业 - 全球化” 完整闭环,为下一代物理 AGI 提供可商用落地的基础设施。