文字版

用免费 AI 做 Roblox 短视频:难的不是生成,是让角色每一幕都长成同一张脸

编者按:本文内容出自 Dan AI 发布的一段约 4 分半的教程视频,配图取自视频画面。

YouTube Shorts 上有一批只做一件事的频道:把 Roblox 风格的小故事切成几段,每段几秒,配上字幕和音效,持续上传。它们不需要动画功底,不需要剪辑经验,做的人往往也不出镜。

这类账号能长到多大?教程里点开的第一个例子是 Pepe Roblox,175 万订阅,745 条视频。

往下翻它的 Shorts 列表,播放量密密麻麻挂着:4000 万、3900 万、3000 万、2300 万、2000 万、1700 万。标题清一色是「结局会让你哭」「这个声音让我破防」这种钩子。

教程要教的就是复制这条流水线:一段主提示词生成故事,一个视频模型逐幕出片,一个免费剪辑器拼起来。五个步骤,看上去是纯搬运。

但把整个流程的每一步截图铺开看,会发现难点并不在「怎么生成视频」。这条流水线真正吃功夫的地方只有一个:同一个角色被拆成十来次互相独立的生成,怎么保证她每次长出来都是同一张脸。 教程给了两道锁,一道在文字里,一道在画面里——而其中更关键的那道,作者本人并没有点破。

顺带说一句:「完全免费」这个前提,在生成器那一步就已经打了折。

01 故事:一段提示词管到底

第一步是拿到作者放在视频简介里的那份主提示词,整段复制,粘到 Claude 或者 ChatGPT。教程用的是 Claude,免费账号,模型是 Sonnet 5——这一步确实一分钱不花。

粘贴框里露出的是提示词的尾巴,也是它最值钱的部分。那段指令叫 CONTINUATION COMMAND。

它要求模型每次回答都以一句「输入 NEXT 换一个全新故事」收尾。用户一敲 NEXT,就重新生成标题、角色、世界、冲突、转折、结局、封面和关键词八项。最后一条是硬约束:不得复用之前的任何创意。

这不是一段「帮我写个故事」的提示词,是一台可以一直摇下去的选题机器。做这类频道最先耗尽的从来不是产能,是想法——这段指令解决的正是这个。

摇出来的选题也不是散着给的,而是按类别分组。画面里露出三组:贫富对比、搞笑、亲情向。

条目的密度是这样的。穷孩子拿自制卡丁车,去和富家子的超跑赛跑。一个住豪宅、一个住小公寓的邻居,互换一天生活。富家子在游戏 bug 里输光一切,只有穷孩子愿意帮他。

三条是同一个模子:落差、反转、情绪落点。看懂模子比拿到提示词更有用。

02 分镜:第一道锁藏在这里

选定一个故事,把它粘回 Claude,让模型给每一幕单独写画面提示词。这一步的输出,才是整条流水线的核心资产。

截图里这个故事叫《Pet-Sitting Gone WILD: The Secret Dragon》,主角 Zoey。每一幕的提示词都由固定字段拼成:时长、角色外观、环境、镜头角度、运镜方式、面部表情、视觉效果、情绪基调,末尾再加一句台词。

Scene 1 的镜头角度是「平视中景」,运镜「缓慢推进」,情绪基调「好奇钩子」。台词是 Zoey 说:「这活儿也太简单了,看一天宠物而已。」

真正值得注意的是 Scene 2。它没写「同上」,也没写「Zoey 继续」。

它把 Zoey 的全部外观又拼了一遍:泡泡糖粉的长辫子、好奇的大榛色眼睛、圆脸、青柠绿帽衫、牛仔短裤、粉鞋带白球鞋、缀星星补丁的小书包、经典 Roblox 方块身材。

这就是第一道锁:视频模型不记得上一次生成过什么,所以角色的一致性必须靠每一幕逐字重述来锁死。 提示词看起来啰嗦,那不是模型写废话,是它在替你对抗遗忘。

教程从头到尾没有解释这一点。但如果你自己写分镜提示词时图省事,把第二幕的外观描述简写成「同一个女孩」,出来的就会是另一个人。

03 生成:Veo 3.1 Lite,8 秒一段

拿着第一幕的提示词进 Google Flow——labs.google 出品的视频生成工具。参数面板很简单:选 Video,画幅 9:16 竖屏,数量 1×。模型下拉里选中的是 Veo 3.1 - Lite。

这张图里有两处值得停一下。

一处是这个面板上根本没有时长选项。Claude 写在分镜里的「Duration: 7 seconds」,Flow 并不读。它按自己的档位出片,后面几张截图里的成品时长统一是 8 秒。

换句话说,分镜里的秒数是给你排片用的参考,不是给模型的指令。

另一处在面板底部那行小字:Generating will use 10 credits.

生成一次扣 10 个额度。免费账号有额度上限,用完就得等刷新。这条流水线里唯一会卡住你的,就是这里。

粘贴提示词,生成,几秒后出片。

项目名自动取成了「Girl holding pet-sitter flyer」,时长 00:08:00。右上角缩略图是成品第一帧:粉色双马尾、青柠绿帽衫的 Roblox 女孩站在彩色小屋前,手里举着传单。

对照第二节那段提示词逐条看——发色、瞳色、上衣、短裤、书包、房子、镜头距离,全中。这是第一道锁生效的可观察结果:只要外观字段写全,模型就能照着长。

04 末帧继承:第二道锁

第一道锁管住了「长得像」,管不住「接得上」。上一幕结束时 Zoey 站在门口,下一幕重新生成,她可能换了位置、姿势和光线。

教程给的解法很土,但有效:播放到最后一帧暂停,点截图按钮存下这一帧。再回历史记录把它「加入提示词」,接着粘贴下一幕的提示词,一起生成。

播放头停在 00:08:00,正是整段的最后一帧。

画面里的 Zoey 和提示词描述严丝合缝:粉辫子、绿帽衫、牛仔短裤、粉书包。

第二道锁的作用是把上一幕的最后一帧变成下一幕的第一帧,让镜头之间有物理连续性。 文字锁定管形象,末帧继承管衔接,两道一起用,十几段独立生成才能看着像一条完整的故事。

剩下的幕重复这个动作即可。全部生成完,逐段下载到本地。

05 合成:CapCut,把八秒块拼成一条

最后一步用 CapCut,桌面端网页端都有,这一段是真免费。

截图停在素材刚导入媒体库的那一刻。四个片段整整齐齐标着 00:08,时间线还空着,中间写着「把素材拖到这里开始创作」。工程参数是 30fps,画幅保持原始比例。

接下来就是把片段按顺序拖上时间线,排好,导出。教程到这里就结束了,没有讲字幕、音效和封面——而看开头 Pepe Roblox 那些标题就知道,钩子往往正是靠字幕和音效打出来的。这部分要自己补。

06 代价:三处需要提前知道的折扣

这条流水线跑得通,但「完全免费、零成本」的说法要打三处折扣。

第一处是生成额度。 Flow 每次生成扣 10 credits。评论区有人反馈:自己让 ChatGPT 一次输出了 8 幕分镜,结果受限于免费额度,平均每两天才能出一段。按这个节奏,一条视频要凑齐所有分镜得花两周。真想提速,要么等额度刷新,要么付费——这是这套方案里唯一绕不开的开销。

第二处是平台合规。 评论区有人直接问:发布这类内容时要不要勾选「AI 生成」标注。教程没有回答。各平台对 AI 生成内容的披露要求不同且在变,发布前按你要发的平台自己确认一遍。

第三处是天花板。 教程里说这类频道已经通过 YouTube 合作伙伴计划全面变现。这是视频作者的说法,没给出任何具体收入数字,也无从核验。可以核验的只有播放量。把它当成一个「有人跑通了」的信号,别当成收入承诺。

还有一个不算折扣、但值得知道的事实:Flow 的左侧导航里挂着 Characters 和 Scenes 两个入口。教程全程没用它们,走的是截图末帧这条土路。如果你要长期做,值得自己去试试那两个功能能不能省掉一半动作。

07 下一步

这套方法真正可复用的不是那份主提示词,是它背后的三个判断。

选题要有可摇的机器,不能靠一次性灵感,那段 NEXT 指令就是干这个的。角色一致性锁在文字层,每一幕重述全部外观,别图省事。镜头衔接锁在画面层,上一幕末帧就是下一幕起点。

想上手的话,最小的一步是这样:先只做三幕。用主提示词摇出一个故事,写三段分镜,生成三段 8 秒,末帧继承接起来,拼成 24 秒导出。这一步只花 30 credits,够你判断这条路是不是适合你——比一次性排满八幕、然后被额度卡两周要划算得多。