
7 月 18 日,在 2026 世界人工智能大会(WAIC)现场,智象未来(HiDream.ai)的一场发布会引发行业关注,全球首个无限时长内容创作多模态智能体 vivago R1 正式亮相。在 AI 视频生成赛道普遍停留在 15 至 30 秒短镜头生成的当下,这一产品的发布意味着内容创作领域的一次重要转折:AI 正从辅助生成单点素材的工具,进化为能够自主规划、调度并完成长链路创作任务的智能搭子。
7 月 18 日,在 2026 世界人工智能大会(WAIC)现场,智象未来(HiDream.ai)的一场发布会引发行业关注,全球首个无限时长内容创作多模态智能体 vivago R1 正式亮相。在 AI 视频生成赛道普遍停留在 15 至 30 秒短镜头生成的当下,这一产品的发布意味着内容创作领域的一次重要转折:AI 正从辅助生成单点素材的工具,进化为能够自主规划、调度并完成长链路创作任务的智能搭子。
三个痛点与三把钥匙
智象未来创始人兼 CEO 梅涛在大会期间指出,当前 AI 视频行业长期受困于三大痛点:时长受限、逻辑混乱、效果不稳。vivago R1 的「长、长、稳」三大特质,正是对这三大痛点的精准回应。

行业主流产品仅支持 15 至 30 秒的短镜头生成,这一限制使得 AI 视频长期被排除在短剧、专题片、品牌宣传片等长周期商业创作之外。vivago R1 支持任意时长视频的连续、连贯生成,全面适配从短视频 vlog 到影视成片的全品类创作场景。
长视频创作远非短镜头的机械拼接,一段 15 秒的短视频可以靠单点创意支撑,但一部 10 分钟、30 分钟甚至更长的作品,需要完整的叙事逻辑、统一的画面风格和稳定的人物设定。vivago R1 具备长任务思考能力,可自主完成精细化逻辑构思、镜头排布与风格校准,有效解决 AI 生成视频常见的画面跳变、人设崩塌、叙事断层、风格割裂等行业难题。
传统大模型存在概率性输出偏差,成片可用率低,企业需要投入大量人力进行反复调试和修改。依托 HD-AgentOS 智能体操作系统的全流程调度与治理能力,vivago R1 将内容有效可用成功率提升至 85%,远高于行业平均水平。这意味着生成内容可直接应用于商业制作、品牌传播与市场化交付,极大降低了反复修改调试的时间与人力成本。
HD-AgentOS:藏在产品背后的「隐形操盘手」
vivago R1 的能力并非凭空而来,支撑其稳定运行的是智象未来自研的 HD-AgentOS 智能体操作系统。
这套系统搭建了资源层、系统层、能力层三层耦合架构,资源层提供智能体可调用的模型、工具、数据等底层能力;系统层负责智能体调度、多单元协同与全流程安全治理;能力层则将模型能力封装为面向影视、营销等领域的标准化技能。

这三层的价值在于形成了一个从「能力供给」到「任务调度」再到「技能输出」的完整闭环。在多智能体协作场景中,这一架构确保了不同智能体之间的有序分工与高效协同,有的负责理解任务与构思故事线,有的负责创作分镜脚本,有的负责生成核心素材,有的负责将片段串联成超长视频。这种类似专业团队的分工模式,正是 vivago R1 能够完成长链路创作任务的技术保障。
从数字世界走向物理世界
在 WAIC 中国信通院论坛的主旨演讲中,梅涛系统阐述了大模型与智能体双向并进、走向世界模型的发展态势。在他看来,人工智能的终极演进方向是通过智能体落地产业,从数字世界走向物理世界的深度融合。
这一判断与智象未来的技术路线一脉相承。智象未来长期押注原生全模态架构,其 HiDream 系列大模型是全球首批原生全模态架构大模型。梅涛曾指出,一个真正的世界模型需要同时满足多个条件:理解世界、推理世界,重构世界。从这一标准来看,vivago R1 在「长时间跨度的因果推理」和「全模态交互」两个维度上已迈出了关键一步,它不仅能生成长视频,还能理解叙事逻辑、保持风格统一、维持角色一致性。
产业协同:从单点突破到系统作战
在 WAIC 2026 期间,智象未来同步推进了两项生态布局。一是联合飞捷科思等机构发起「物理智能创新联合体」倡议,聚合产学研力量推进原生全模态世界模型的技术协同研发。二是与中科类脑等机构签约组建「一带一路」Token 出海联盟,推动中国 AI 能力走向全球。
这两项布局与 vivago R1 的产品发布形成了技术+生态的双轮驱动,产品解决的是「能做什么」的问题,生态解决的是「能做多大」的问题。
有行业人士指出,AI 视频生成正处在一个关键的转折点。过往的模型参数竞赛逐步让位于「基础模型+智能体系统」的生态竞争。智象未来提出的「1+1+3」商业模式,即一个 HiDream 系列大模型底座、一个 Token Hub 平台、商业营销、影视创作、内容创作三大垂直场景智能体,正是对这一趋势的回应。
vivago R1 的发布,至少在三个维度上为行业树立了新的参照系,时长的天花板被打破、叙事逻辑的连贯性得到系统性解决、商业可用率提升到了可规模化交付的水平。这三个维度合在一起,或许意味着 AI 视频创作正在从玩具走向工具,从实验品走向生产力。
来源:互联网



