雷锋网 21小时前
智象未来 vivago R1 全球上线,国内版本「够搭」全新升级发布:从 15 秒到5 分钟,AI 视频创作进入单反级交付时代
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

2026 年 9 月 8 日,智象未来(HiDream.ai)旗下内容创作智能体 vivago R1 全球上线,国内版本 「够搭」 全新升级发布。(雷峰网 ( 公众号:雷峰网 ) )

今年 7 月,vivago R1 于 WAIC 2026 首次亮相。作为全球首个无限时长内容创作智能体,R1 引起 AI 视频领域广泛关注。今天,R1 正式面向全球用户开放。

vivago R1 的核心突破,在于实现了从一句成片时代的 " 生成片段 " 到 " 完全交付作品 " 的范式跃迁。它依托智象 " 基础模型 + 智能体 " 双轮驱动技术战略,让创作者以自然语言对话的方式,即可完成从创意表达到高质量成片交付的完整创作流程。

R1 的上线,标志着 AI 视频创作进入 " 单反级交付时代 "。每一位普通创作者,都能独立完成专业团队级的品质大片。

01 从 Sora 的 15 秒,到 R1 的五分钟

Sora 用 15 秒视频惊艳世界,成为 AI 视频生成的重要转折点。但时至今日,15-30 秒的片段式生成依然是行业主流。R1 的突破在于,能够一次性稳定输出 5 分钟高质量视频,并支持无限次多轮延长。

长视频的难点,不只是把时长拉长,而是让故事在多镜头、多角色、多场景之间持续成立。R1 通过 Agent 系统对长任务进行规划与调度:主 Agent 拆解创意,子 Agent 协同完成脚本、分镜、角色、场景与音效,确保角色形象、场景风格和叙事节奏在多段落中保持一致。

同时,依托智象自研 HD-AgentOS 的全流程调度与治理能力,R1 内容有效可用成功率提升至 85%,显著降低 " 抽卡 " 概率,让视频创作更具确定性。R1 还优化了跨镜头角色一致性和场景过渡自然度,弱化 AI 视频常见的 " 塑料感 " 和 " 瞬移感 ",实现更自然的运镜衔接与音画对齐,让长视频更接近实拍质感。

02 Chat-First (对话优先):让创作回到表达本身

好的创作工具,应当顺应人的表达本能。对于视频创作而言,起点不应是节点、画布和参数,而应是创作者想要表达的内容。

R1 因此选择 Chat-First (对话优先)路线。因为对话是人类最自然的表达方式,也是 AI 最友好的创作入口。

当前 AI 视频工具大致有两条路线:一类是画布式、节点式工作流,将模型、工具和参数交给用户自行连接和调试,自由度高,但门槛也高;另一类是 R1 的对话式路线,用户只需用自然语言描述需求,R1 即可自动生成视频,并支持在对话中持续调整和迭代。

这种体验背后,是 " 做后 " 与 " 做厚 " 两条原则。" 做后 ",是把专业创作者的判断、审美和经验编码进 Agent 编排能力,形成强大的中后台;" 做厚 ",是构建 SkillHub,将抽象 AI 能力转译为产品广告、角色视频、故事短片、品牌内容等真实创作场景,让用户更容易理解能做什么、如何开始。

在完整流程中,用户只需表达目标,Agent 负责拆解和执行,SkillHub 则作为翻译层,自动匹配并编排所需 Skill 组合,将用户意图转化为可执行任务序列。

R1 的对话式创作,不是把复杂消灭,而是把复杂藏在简单背后。它让创作从 " 灵感闪现 " 到 " 进入执行 ",缩短到只剩一句话。

03 原生全模态基础架构,让 AI 创作走向项目制

视频生成的另一大挑战,是一致性:同一个角色、同一种声音,如何在数十个镜头、多次生成转换中始终如一。智象未来的解法,是以基础模型与智能体系统双轮驱动,共同支撑复杂视频创作。

一方面,智象自研的原生全模态世界模型技术理念,为 R1 提供多模态理解与生成基础能力。它能将文本、图片、视频、参考资产、文档说明和历史创作结果纳入同一任务语境,让 Agent 理解 " 任务全貌 ",而非单点指令。

另一方面,智能体系统负责将模型能力组织为可持续推进的创作流程,在脚本、分镜、角色、场景、镜头和音效之间进行规划与调度,确保复杂叙事中的角色形象、声音特征和风格前后一致。

这让创作不再是一次次孤立生成,而是围绕同一项目持续推进。用户可以 " 说不清的直接给 ",R1 则在统一上下文中理解、组织、执行并持续迭代。

同时,R1 推出资产库功能,沉淀用户生成、筛选并认可的内容,并可在后续创作中复用。一次创作不再只是一次性输出,而会成为下一次创作的素材基础。

基础模型决定能力上限,智能体系统负责把能力转化为稳定、可控、可复用的作品交付。

04 全球创作者用作品说话:R1 让表达成为生产力

在今天举办的 vivago R1「够搭」沉浸式工作坊活动上,来自全球不同领域的创作者们,采用线上和线下的方式,分享 R1 的使用心得,并展示他们制作的作品。

近期,AI 版《西游记》上线后引发热议。活动现场,一位创作者也用 R1 尝试了这一经典题材的再创作,并生成近 5 分钟西游题材作品。从角色造型、场景氛围到东方奇幻质感,R1 对经典文本的视觉转译能力得到直观呈现。

在真人质感上,R1 同样表现出色。另一位创作者带来一支励志短片,讲述体育老师周岚从迟疑到重新出发的过程。画面中,奔跑时的肌肉震颤、汗水光泽,以及脚步压过塑胶跑道的颗粒质感都被细腻还原,让人物情绪更具真实感。

提示词:

体育老师周岚在训练与接力比赛中面对自己的迟疑。来到第二道弯,她一度想停下,却继续迈步,坚持跑向终点。次日清晨,她主动再次接过接力棒。影片将人物转变放进呼吸、步伐与交接棒等具体动作,以持续奔跑呈现重新出发的过程。

提交提示词后,R1 会自动理解人物关系、情绪转折与动作节奏,生成对应角色、场景与关键画面。创作者无需复杂操作,只需通过对话补充想法,即可推进内容生成。

在商业广告片制作上,R1 也展现出较强适配能力。现场一位 AI 创作者分享了红色折叠手机广告案例。R1 根据提示词理解产品、人物与场景关系,生成手机多视图、女设计师造型、工作室与户外生活场景,以及包袋、色卡、草图等视觉资产,呈现从创作、出行到回归设计的日常灵感流动。

一位年轻女设计师在一天中穿梭工作室、城市街道、咖啡馆和海边,用红色折叠手机记录色彩、构图与生活中的灵感,再将所见带回工作台。影片围绕手机开合、拍照和查看素材的使用动作,串联从创作到出行、再回到设计的日常。

现场之外,多位海外创作者也通过线上连线分享创作体验。一位创作者表示:" 视频创作的终点,就是一次表达。" 这也道出了许多体验 R1 用户的共同感受:当复杂流程被隐藏在对话之后,创作者可以更专注于表达本身。

05 开创视频 Agent 新标准:CHATS ™

R1 的实践充分表明,当产品真正进入专业场景,行业需要的就不再是零散的能力清单,而是一套可衡量、可依赖的交付标准。智象提炼出一套面向视频 Agent 的评估框架—— CHATS ™,用于衡量一个视频 Agent 是否具备真正的作品交付能力:

C(Consistency)一致性:角色、场景、风格在多镜头中保持稳定;

H(Human Intent)意图理解:准确理解用户创意,并能在多轮对话中持续推进;

A(Audio & Visual)视听完整度:不仅生成画面,也能组织声音、节奏与整体视听体验;

T(Timeline & Tale)时间线与叙事:让故事在多个镜头、多个段落中持续成立;

S(Stability)稳定交付:降低反复生成和返工成本,提高内容可用率。

这五个维度,不是实验室里的理想指标,而是 R1 在真实创作内测场景中被众多内测用户反复验证过的能力边界。智象希望通过构建一个用户视角的标准,推动 AI Agent 产品的更好发展。

2024 年 5 月,vivago.ai 上线,成为全球最早一批公开可用的 AI 视频生成产品;今年 5 月,vivago.ai 登顶 Product Hunt 日榜第一;今天,vivago.ai 全球用户突破 7000 万。两年时间,智象从 " 第一个可用 " 走到第一个 " 单反级交付 "。

这就是 vivago R1 中 "R" 所承载的意义:一面是 Reasoning,用深度推理把灵感变成作品;一面是 Rock,致敬 "The Show Must Go On" 的创作精神——无论如何,创作终将继续。

在 AI 视频时代,vivago R1 希望让创作从一次生成,变成持续对话:The CHATS must go on。只要对话继续,故事就不会停下。

立即体验

vivago.ai

够搭 goudaai.com

够搭,你的 AI 创意好搭子。

雷峰网原创文章,未经授权禁止转载。详情见转载须知

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 单反
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论