AI应用风向标(公众号:ZhidxcomAI)
作者|毕伟豪
编辑|漠影

2026年,AI视频生成工具,究竟能把一个创作者的能力推到哪一步?

智东西8月7日报道,近日,美图旗下AI短剧创作工具RoboNeo迎来了全新升级,在人像肤质以及视频生成可控性方面做了重点优化。就在刚刚,RoboNeo还接入了Seedance 2.5模型,在PC端限时5折优惠。

我,用美图Agent,一句话拍出AI短剧

先来看一个小片段:

我,用美图Agent,一句话拍出AI短剧

这是我在RoboNeo中生成的一段视频。从人物素材、镜头设计到最终成片,我没有使用传统剪辑软件,而是在RoboNeo的画布中,通过手动调试与AI结合的方式完成了整个制作流程。

这只是一次镜头实验,事实上,近期完成升级的RoboNeo,正在尝试把AI视频生成从“输入提示词、等待结果”,推进到更完整的创作流程。

近期,RoboNeo新增了人像肤质提升、4K/2K影视级超清、Skills风格库以及画线标注等能力。除了优化Agent创作流程,RoboNeo还提供多Agent协作、导演台和多节点工作流,让用户可以在故事构思、镜头规划、生成修改等环节持续参与。

深入使用RoboNeo两天后,我们发现它增加了更多用户可干预环节,对于视频生成的可控性有很大助益,“抽卡率”的确降低了不少。

价格方面,标准会员是70元/月,有2000“算力萝卜”,MiniMax H3模型限时5折,大概可以生成一分钟左右的视频。

我,用美图Agent,一句话拍出AI短剧

值得注意的是,这些模型只能在画布区域手动创作时使用,Agent全自动模式无法选择特定模型。

接下来,智东西将会从Agent全自动、半自动、AI生成手动调优三个角度来体验这款产品。

一、不给脚本,只给一句话,AI自己完成整集短剧

既然RoboNeo的定位是面向短剧创作者的AI创作工具,第一个测试,我选择站在普通创作者的视角,体验它的Agent模式,看看如果用户只提供一个故事方向,AI能否自主完成从剧本、分镜到成片的一整套流程。

我,用美图Agent,一句话拍出AI短剧

RoboNeo内置了短剧创作Skills和多种短剧提示词模板。我参考其中的模板进行了调整,输入了一段职场逆袭题材的提示词:

创作一集1分钟的AI短剧试播集,要求如下:【项目目标】单集1分钟试播,竖屏9:16,画风写实,面向短剧平台的爆款节奏。先完成这一集,满意后再规划连载。【品类】职场打脸【主角设定】公司裁员,裁到了最不该裁的人头上。被裁的员工看起来是普通工位上的小透明,实际上公司最核心的技术系统是他一个人写的,连老板都要看他脸色。

我的要求很简单:制作一集1分钟左右的AI短剧试播集,采用竖屏9:16比例,整体风格偏写实,按照短剧平台常见节奏推进。收到需求后,RoboNeo先将任务拆解,然后划归到了AI影视创作工作室协作的范围。

首先,编剧Agent开始分析故事设定,并生成完整剧本;随后分镜导演Agent进一步拆解镜头,将剧情转化为具体的镜头语言,包括场景、人物动作和画面设计。

我,用美图Agent,一句话拍出AI短剧

整个过程中,我没有对剧本和分镜进行修改,直接进入了下一阶段。

我,用美图Agent,一句话拍出AI短剧

随后,艺术总监Agent开始生成视觉资产,包括角色、场景和道具。此次任务共生成4个角色、3个场景、2个道具,并进一步拆解成25个镜头。

我,用美图Agent,一句话拍出AI短剧

在确认这些素材后,RoboNeo开始进入视频生成阶段。整个流程并不是一次性输出完整视频,而是先分别生成多个视频,再通过剪辑组合成最终短剧。

我,用美图Agent,一句话拍出AI短剧

最终成片如下:

从生成效果来看,Agent模式已经能够完成短剧创作中大量前期工作。生成的剧本具备完整的冲突结构,人物设定和剧情推进符合短剧常见节奏;在画面表现上,人物肤质和整体视觉风格较为稳定。不过,部分画面衔接、字幕以及复杂场景下的人物表现,仍然会出现一些问题。

二、肤质、打光、站位任意调节,视频生成更可控,但人物细节尚有不足

一直以来,AI视频生成有两个绕不开的问题:人物不像真人,以及生成过程不可控。

前者体现在人物皮肤质感、表情变化、光影细节上;后者则源自“一句话生成视频”的黑盒模式,用户知道自己想要什么,却不能操控AI具体应该怎么实现。

很多时候,一次生成失败,并不是模型完全无法理解需求,而是人物站位、镜头关系、光线变化等细节没有被控制好,最终导致画面失真。

RoboNeo尝试解决的,就是让创作者在AI生成之外,拥有更多人工干预空间。

比如下面这个霓虹街头视频,第一次用Agent直接生成时,人物之间的位置关系并不稳定,甚至出现背景中突然多出人物的情况。于是我没有继续依赖Agent自动生成,而是转入导演台进行调整。

我,用美图Agent,一句话拍出AI短剧

通过3D导演台,我重新规划了分镜中的人物站位,让不同镜头中的人物保持统一关系;随后让Agent基于调整后的设定重新生成角色素材。之后,我手动创建了视频节点,选择素材、模型、生成时长,并调整镜头运动。

我,用美图Agent,一句话拍出AI短剧

RoboNeo提供了一些预设运镜模板,例如推进、环绕、拉远等,降低了普通用户理解摄影语言的门槛。

我,用美图Agent,一句话拍出AI短剧

最终生成的视频并非完全由AI自动完成,而是AI生成和人工调整共同作用的结果,但至少在人物位置、镜头关系和整体节奏上,已经更接近我最初设想的画面。

RoboNeo还有很多细致的修改功能,比如修改人物打光、画线标注、调整相机角度等,比如开篇那个海边女孩的视频。我,用美图Agent,一句话拍出AI短剧

这个视频我反复修改了很多次,最开始给的女生形象提示词是这样的:

一个20岁左右的中国女孩,蹲在海边的浅水区玩水,侧身微微回头看向镜头,露出灿烂又自然的笑容,眼睛弯成月牙,眼神清澈明亮。黑色长发自然垂落,几缕发丝被海风吹起,贴在脸颊和肩头。她穿一件浅色吊带连衣裙,裙摆被海水打湿了一点。皮肤是健康自然的肤色,细腻有光泽,像真实阳光下透亮的质感,没有磨皮感。背景是夏天的海边,远处是碧蓝的海水和泛白的浪花,天空晴朗,午后柔和的光线洒在她身上,发丝边缘有一层淡淡的光晕。画面清新治愈,真实摄影质感,电影感色调。

但第一版效果并不理想,人物皮肤质感偏普通,整体光线也比较暗。我尝试调整人物光照方向,让自然光从正面照射人物,同时开启人像肤质提升功能。

我,用美图Agent,一句话拍出AI短剧

调整之后,人物面部细节和光影层次明显改善,画面距离真人摄影效果更近。

我,用美图Agent,一句话拍出AI短剧

之后,我进一步测试了人物运动控制。这一次没有使用Agent自动规划,而是完全手动操作:通过导演台中的人物位置调整画面关系,再利用画线功能标注人物运动路线。最终生成的海边奔跑镜头,在人物运动方向和镜头节奏上符合预期。

我,用美图Agent,一句话拍出AI短剧

当然,这类控制能力也意味着更高的学习成本,但如果用简单的语言概括这类工具的操作模式,那就是节点左侧是输入,右侧是输出,也即你需要引用某个节点,就把这个节点右侧的加号引线拉到生成节点的左侧加号上。

此外,单独修改任意节点不会对其他关联节点产生影响,如果要更改下游节点,就得重新搭配工作流。

事实上,RoboNeo并不是一个“输入一句话,等待奇迹发生”的工具。如果想获得更稳定的结果,用户需要理解一些基础的视频创作逻辑,比如镜头语言、人物关系和运动轨迹。但换来的,是相比纯提示词生成更强的掌控感。

三、拍一个异地恋重逢的短片,有亮点,也有遗憾

前两个测试,更多是在验证RoboNeo的生成能力和控制能力。

最后,我想让它完成一次更接近真实创作的任务:给它一个故事,让它自己完成一支短片,看看它能否理解我的意图。

我本人很喜欢青春爱情类的影视作品,于是提示词是一段关于异地恋的青春短片:

帮我做一支治愈系青春爱情短片,主题:【异地恋】。故事设定:【两个恋人在热恋时期习惯用DV记录彼此,从海边到草原,记录那些普通又珍贵的瞬间。后来女生出国,两个人进入异地恋。多年后的某个午后,女生重新拿起那台DV,画面慢慢进入过去的录像,最后看到一段男生从远处走来,走到女生门前的画面,她很诧异,但事实上男生没有回来,一切都是幻想,画面最后是女生幻想男生回来,两个人凑在一起。】大部分镜头是DV视角,要那种青春岁月的朦胧感,给我的男女主起个好听的名字,希望有电影感,情绪细腻一些,我比较喜欢那种女生在海边捡贝壳,然后一抬头的画面,横屏。

RoboNeo识别出这是一个短片创作项目,随后通过多个Agent协同完成创作流程,包括剧本设计、分镜规划、视觉资产生成、视频制作以及音乐合成。

它最初规划的视频长度接近5分钟,我将其压缩到了两分钟左右,RoboNeo也帮我修改了剧本和分镜头,由于是相对比较长的视频,我还是将视频完全交给Agent处理了。

在角色设计阶段,我发现男主的初始形象和我设想存在差距,于是让RoboNeo帮忙进行了修改,让他的气质更温暖。

我,用美图Agent,一句话拍出AI短剧

在后续生成过程中,我还临时想到一个问题:男女主不会从头到尾穿同一套衣服吧?

我暂停生成并提出修改要求,RoboNeo还安慰我会根据场景换衣服,最后的视频确实也换了不同的衣服,事实证明是我多想了。

我,用美图Agent,一句话拍出AI短剧

来看下成片吧:

从最终的成片来看,人物一致性保持的还不错,短片叙事节奏也没问题,最后的结局很细节的是男主和DV里衣服不一样,表明是幻想,也符合我的要求,但问题也存在,比如女主的脸笑起来不太自然,海边分镜有两个重复等。

不过总体上来说,从配乐到成片都还是很有氛围感的,尤其是DV视角的滤镜和镜头晃动感很真实。

从完整性上看,RoboNeo已经能够完成从一个故事想法到短片成片的转化。虽然它还不是一个真正意义上的AI导演,但已经开始承担过去需要多个岗位共同完成的部分工作。

结语:写在最后:有一定操作门槛,但也带来了更强的掌控感

体验两天后,RoboNeo给我的最大感受是,它并不是一个完全“交给AI,然后等待结果”的工具。
如果只是输入一句话,希望AI直接生成一支完美短片,它依然存在一定的不确定性。人物表情、复杂动作、长时间叙事中的细节一致性,仍然需要反复调整。

但另一方面,RoboNeo提供的导演台、画线标注、多节点工作流等功能,也让用户拥有了更多介入空间。

从人物站位、镜头运动,到光影调整、素材替换,创作者可以不断缩小自己的想象和最终生成结果之间的距离。而且从我个人角度上来说,也推荐大家多去使用手动模式,不仅可以选择性价比高的模型,也能减少一些不必要的积分浪费。

在实际体验中,RoboNeo生成的人物肤质已经比较接近真实影像,剧本和分镜规划也符合创作预期;通过手动调整后,镜头语言和画面控制能力都有明显提升。

当然,它仍然不是一个完全没有门槛的工具。想要获得更稳定的效果,用户依然需要理解一些基础的视频创作逻辑,也需要在AI生成和人工修改之间找到平衡。

从这个角度看,RoboNeo正在尝试解决的,正是降低AI视频创作中的不确定性。