智东西 20小时前
我,用美图Agent,一句话拍出AI短剧
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

AI 应用风向标(公众号:ZhidxcomAI)

作者|毕伟豪

编辑|漠影

2026 年,AI 视频生成工具,究竟能把一个创作者的能力推到哪一步?

智东西 8 月 7 日报道,近日,美图旗下 AI 短剧创作工具 RoboNeo 迎来了全新升级,在人像肤质以及视频生成可控性方面做了重点优化。就在刚刚,RoboNeo 还接入了 Seedance 2.5 模型,在 PC 端限时 5 折优惠。

先来看一个小片段:

这是我在 RoboNeo 中生成的一段视频。从人物素材、镜头设计到最终成片,我没有使用传统剪辑软件,而是在 RoboNeo 的画布中,通过手动调试与 AI 结合的方式完成了整个制作流程。

这只是一次镜头实验,事实上,近期完成升级的 RoboNeo,正在尝试把 AI 视频生成从 " 输入提示词、等待结果 ",推进到更完整的创作流程。

近期,RoboNeo 新增了人像肤质提升、4K/2K 影视级超清、Skills 风格库以及画线标注等能力。除了优化 Agent 创作流程,RoboNeo 还提供多 Agent 协作、导演台和多节点工作流,让用户可以在故事构思、镜头规划、生成修改等环节持续参与。

深入使用 RoboNeo 两天后,我们发现它增加了更多用户可干预环节,对于视频生成的可控性有很大助益," 抽卡率 " 的确降低了不少。

价格方面,标准会员是 70 元 / 月,有 2000" 算力萝卜 ",MiniMax H3 模型限时 5 折,大概可以生成一分钟左右的视频。

值得注意的是,这些模型只能在画布区域手动创作时使用,Agent 全自动模式无法选择特定模型。

接下来,智东西将会从 Agent 全自动、半自动、AI 生成手动调优三个角度来体验这款产品。

一、不给脚本,只给一句话,AI 自己完成整集短剧

既然 RoboNeo 的定位是面向短剧创作者的 AI 创作工具,第一个测试,我选择站在普通创作者的视角,体验它的 Agent 模式,看看如果用户只提供一个故事方向,AI 能否自主完成从剧本、分镜到成片的一整套流程。

RoboNeo 内置了短剧创作 Skills 和多种短剧提示词模板。我参考其中的模板进行了调整,输入了一段职场逆袭题材的提示词:

创作一集 1 分钟的 AI 短剧试播集,要求如下:【项目目标】单集 1 分钟试播,竖屏 9:16,画风写实,面向短剧平台的爆款节奏。先完成这一集,满意后再规划连载。【品类】职场打脸【主角设定】公司裁员,裁到了最不该裁的人头上。被裁的员工看起来是普通工位上的小透明,实际上公司最核心的技术系统是他一个人写的,连老板都要看他脸色。

我的要求很简单:制作一集 1 分钟左右的 AI 短剧试播集,采用竖屏 9:16 比例,整体风格偏写实,按照短剧平台常见节奏推进。收到需求后,RoboNeo 先将任务拆解,然后划归到了 AI 影视创作工作室协作的范围。

首先,编剧 Agent 开始分析故事设定,并生成完整剧本;随后分镜导演 Agent 进一步拆解镜头,将剧情转化为具体的镜头语言,包括场景、人物动作和画面设计。

整个过程中,我没有对剧本和分镜进行修改,直接进入了下一阶段。

随后,艺术总监 Agent 开始生成视觉资产,包括角色、场景和道具。此次任务共生成 4 个角色、3 个场景、2 个道具,并进一步拆解成 25 个镜头。

在确认这些素材后,RoboNeo 开始进入视频生成阶段。整个流程并不是一次性输出完整视频,而是先分别生成多个视频,再通过剪辑组合成最终短剧。

最终成片如下:

从生成效果来看,Agent 模式已经能够完成短剧创作中大量前期工作。生成的剧本具备完整的冲突结构,人物设定和剧情推进符合短剧常见节奏;在画面表现上,人物肤质和整体视觉风格较为稳定。不过,部分画面衔接、字幕以及复杂场景下的人物表现,仍然会出现一些问题。

二、肤质、打光、站位任意调节,视频生成更可控,但人物细节尚有不足

一直以来,AI 视频生成有两个绕不开的问题:人物不像真人,以及生成过程不可控。

前者体现在人物皮肤质感、表情变化、光影细节上;后者则源自 " 一句话生成视频 " 的黑盒模式,用户知道自己想要什么,却不能操控 AI 具体应该怎么实现。

很多时候,一次生成失败,并不是模型完全无法理解需求,而是人物站位、镜头关系、光线变化等细节没有被控制好,最终导致画面失真。

RoboNeo 尝试解决的,就是让创作者在 AI 生成之外,拥有更多人工干预空间。

比如下面这个霓虹街头视频,第一次用 Agent 直接生成时,人物之间的位置关系并不稳定,甚至出现背景中突然多出人物的情况。于是我没有继续依赖 Agent 自动生成,而是转入导演台进行调整。

通过 3D 导演台,我重新规划了分镜中的人物站位,让不同镜头中的人物保持统一关系;随后让 Agent 基于调整后的设定重新生成角色素材。之后,我手动创建了视频节点,选择素材、模型、生成时长,并调整镜头运动。

RoboNeo 提供了一些预设运镜模板,例如推进、环绕、拉远等,降低了普通用户理解摄影语言的门槛。

最终生成的视频并非完全由 AI 自动完成,而是 AI 生成和人工调整共同作用的结果,但至少在人物位置、镜头关系和整体节奏上,已经更接近我最初设想的画面。

RoboNeo 还有很多细致的修改功能,比如修改人物打光、画线标注、调整相机角度等,比如开篇那个海边女孩的视频。

这个视频我反复修改了很多次,最开始给的女生形象提示词是这样的:

一个 20 岁左右的中国女孩,蹲在海边的浅水区玩水,侧身微微回头看向镜头,露出灿烂又自然的笑容,眼睛弯成月牙,眼神清澈明亮。黑色长发自然垂落,几缕发丝被海风吹起,贴在脸颊和肩头。她穿一件浅色吊带连衣裙,裙摆被海水打湿了一点。皮肤是健康自然的肤色,细腻有光泽,像真实阳光下透亮的质感,没有磨皮感。背景是夏天的海边,远处是碧蓝的海水和泛白的浪花,天空晴朗,午后柔和的光线洒在她身上,发丝边缘有一层淡淡的光晕。画面清新治愈,真实摄影质感,电影感色调。

但第一版效果并不理想,人物皮肤质感偏普通,整体光线也比较暗。我尝试调整人物光照方向,让自然光从正面照射人物,同时开启人像肤质提升功能。

调整之后,人物面部细节和光影层次明显改善,画面距离真人摄影效果更近。

之后,我进一步测试了人物运动控制。这一次没有使用 Agent 自动规划,而是完全手动操作:通过导演台中的人物位置调整画面关系,再利用画线功能标注人物运动路线。最终生成的海边奔跑镜头,在人物运动方向和镜头节奏上符合预期。

当然,这类控制能力也意味着更高的学习成本,但如果用简单的语言概括这类工具的操作模式,那就是节点左侧是输入,右侧是输出,也即你需要引用某个节点,就把这个节点右侧的加号引线拉到生成节点的左侧加号上。

此外,单独修改任意节点不会对其他关联节点产生影响,如果要更改下游节点,就得重新搭配工作流。

事实上,RoboNeo 并不是一个 " 输入一句话,等待奇迹发生 " 的工具。如果想获得更稳定的结果,用户需要理解一些基础的视频创作逻辑,比如镜头语言、人物关系和运动轨迹。但换来的,是相比纯提示词生成更强的掌控感。

三、拍一个异地恋重逢的短片,有亮点,也有遗憾

前两个测试,更多是在验证 RoboNeo 的生成能力和控制能力。

最后,我想让它完成一次更接近真实创作的任务:给它一个故事,让它自己完成一支短片,看看它能否理解我的意图。

我本人很喜欢青春爱情类的影视作品,于是提示词是一段关于异地恋的青春短片:

帮我做一支治愈系青春爱情短片,主题:【异地恋】。故事设定:【两个恋人在热恋时期习惯用 DV 记录彼此,从海边到草原,记录那些普通又珍贵的瞬间。后来女生出国,两个人进入异地恋。多年后的某个午后,女生重新拿起那台 DV,画面慢慢进入过去的录像,最后看到一段男生从远处走来,走到女生门前的画面,她很诧异,但事实上男生没有回来,一切都是幻想,画面最后是女生幻想男生回来,两个人凑在一起。】大部分镜头是 DV 视角,要那种青春岁月的朦胧感,给我的男女主起个好听的名字,希望有电影感,情绪细腻一些,我比较喜欢那种女生在海边捡贝壳,然后一抬头的画面,横屏。

RoboNeo 识别出这是一个短片创作项目,随后通过多个 Agent 协同完成创作流程,包括剧本设计、分镜规划、视觉资产生成、视频制作以及音乐合成。

它最初规划的视频长度接近 5 分钟,我将其压缩到了两分钟左右,RoboNeo 也帮我修改了剧本和分镜头,由于是相对比较长的视频,我还是将视频完全交给 Agent 处理了。

在角色设计阶段,我发现男主的初始形象和我设想存在差距,于是让 RoboNeo 帮忙进行了修改,让他的气质更温暖。

在后续生成过程中,我还临时想到一个问题:男女主不会从头到尾穿同一套衣服吧?

我暂停生成并提出修改要求,RoboNeo 还安慰我会根据场景换衣服,最后的视频确实也换了不同的衣服,事实证明是我多想了。

来看下成片吧:

从最终的成片来看,人物一致性保持的还不错,短片叙事节奏也没问题,最后的结局很细节的是男主和 DV 里衣服不一样,表明是幻想,也符合我的要求,但问题也存在,比如女主的脸笑起来不太自然,海边分镜有两个重复等。

不过总体上来说,从配乐到成片都还是很有氛围感的,尤其是 DV 视角的滤镜和镜头晃动感很真实。

从完整性上看,RoboNeo 已经能够完成从一个故事想法到短片成片的转化。虽然它还不是一个真正意义上的 AI 导演,但已经开始承担过去需要多个岗位共同完成的部分工作。

结语:写在最后:有一定操作门槛,但也带来了更强的掌控感

体验两天后,RoboNeo 给我的最大感受是,它并不是一个完全 " 交给 AI,然后等待结果 " 的工具。 如果只是输入一句话,希望 AI 直接生成一支完美短片,它依然存在一定的不确定性。人物表情、复杂动作、长时间叙事中的细节一致性,仍然需要反复调整。

但另一方面,RoboNeo 提供的导演台、画线标注、多节点工作流等功能,也让用户拥有了更多介入空间。

从人物站位、镜头运动,到光影调整、素材替换,创作者可以不断缩小自己的想象和最终生成结果之间的距离。而且从我个人角度上来说,也推荐大家多去使用手动模式,不仅可以选择性价比高的模型,也能减少一些不必要的积分浪费。

在实际体验中,RoboNeo 生成的人物肤质已经比较接近真实影像,剧本和分镜规划也符合创作预期;通过手动调整后,镜头语言和画面控制能力都有明显提升。

当然,它仍然不是一个完全没有门槛的工具。想要获得更稳定的效果,用户依然需要理解一些基础的视频创作逻辑,也需要在 AI 生成和人工修改之间找到平衡。

从这个角度看,RoboNeo 正在尝试解决的,正是降低 AI 视频创作中的不确定性。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 智东西 职场 导演
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论