2026 年 7 月,多模态 AI 企业智象未来完成 15 亿元 C 轮融资,叠加前两轮募资,近三月累计融资总额突破 21 亿元,企业估值超 10 亿美元,正式成为国内 AI 独角兽。
本轮汇聚社保基金、各大银行资本、多地国资及华策、上影等影视产业资本,多元资金集体押注原生全模态世界模型路线,也标志视觉生成赛道迎来资本集中爆发期。
一、行业拐点:LLM 估值红利消退,多模态视觉成资本新主线
此前市场资本重心集中在大语言模型,靠参数规模、跑分成绩获取估值溢价。但随着开源文本模型大量涌现,单纯堆叠参数的天花板显现,资本预期持续降温。
反观 AI 视觉赛道,2026 全年融资规模逼近 300 亿元,多模态、世界模型成为确定性最高的 AI 商业化赛道。不同于缝合式多模态方案,智象未来原生像素出发的全模态路线,契合行业下一代物理智能发展方向,因此吸引国资、产业、市场化 VC 三类资金同步入场。
社保基金、工银资本首次布局多模态企业,合肥地方产投持续加码,延续当地扶持硬核科技的投资思路。
二、底层核心壁垒:UiT 统一架构,告别模态拼接短板
行业主流多模态方案多以 LLM 为主干,外挂图文视频独立模块,模态转换过程持续损耗信息。智象 UiT 原生全模态架构实现技术革新:像素、文本、音频、动作、空间信号共用一套 Transformer 网络,统一分词编码,无需中间转换介质,文生图、长视频、3D 叙事、多模态编辑全部原生支持。
落地验证层面,开源 8B 模型 HiDream-O1-Peanut 登顶海外文生图开源榜单,商用版本位列全球前三,在光影、中英文字渲染、复杂构图等指标具备明显优势,是国内少数获得第三方权威评测认可的视觉大模型。
三、三级商业化体系,Vivago 视频智能体实现规模化落地
智象搭建 “底座 - 中台 - 垂直产品” 完整落地体系,解决多数 AI 企业重技术轻商用痛点:
- 底层 HiDream 全模态大模型,提供原生多模态算力与推理能力;
- 中层 HiHarness 企业中台,输出标准化模型能力,支持企业定制开发;
- 顶层 Vivago R1 多模态创作智能体,主打无限长视频生成,先整体规划镜头脚本再分段生成,单任务局部失败独立重试,商用有效生成率达 85%。 该产品海外版本覆盖百余个国家,累计用户超 5000 万,登顶 Product Hunt 榜单,被海外行业对标视频领域的 Claude Code。实测可精准复刻复古小众影视质感,精准区分画面质感、叙事逻辑,解决市面上 AI 视频人设错乱、镜头跳变等行业通病。
四、多元资本的统一长期叙事
不同资金看中企业差异化价值:国家级国资布局下一代世界模型底层基础设施;华策、上影等影视产业资本卡位 AI 影视制片、全链路内容生产;各地地方国资依托项目完善本地 AI 产业集群;市场化 VC 看重架构差异化与全球商业化潜力。
合肥持续押注前沿硬科技,继长鑫、京东方后,智象未来成为当地 AI 标志性项目。当下 AI 行业正从文本符号智能转向物理空间智能,原生全模态世界模型是核心竞争赛道,21 亿融资将进一步加速技术迭代与全球产业落地。