一个人 3 小时做部短剧?4 段提示词,把脑洞变成能发的竖屏片
- 2026-10-01 06:53:13
你有没有刷到过那种 AI 古风漫剧。画面挺精致,人物会眨眼会转头,弹幕全在刷「怎么做的」。
我前阵子也刷到一条,点进去看完了,心里有点不服:这玩意儿我是不是也能整一个。
不是说我要去当导演。是央视财经 9 月 6 号那组数,把我惊了一下。
2026 上半年,AI 短剧和漫剧的市场规模已经破了 220 亿,全年冲 400 亿,同比涨了 138%。用户规模破 6 亿。更狠的是制作单价——从每分钟 5000 块,掉到了几百块。芒果超媒那部上星 AI 长剧《后西游记》,还把股价两天拉了 44%。
直说吧,做短剧的门槛,从「养一个剧组」降到了「一个人一台电脑」。
但我劝你别高兴太早。同一拨报道里也写了:90% 新手翻车。脸崩、动作诡异、剧情逻辑乱成一团。微博上「我学别人做 AI 短剧 belike」那个热搜,全是翻车截图,评论区笑疯了。今年 8 月起,红果、抖音、微博还专门整治「千剧一脸」的同质化内容。
所以这篇不跟你吹「人人都能爆」。就讲四步,用四段提示词,把你想讲的一个小故事,稳稳当当做成一部能发的竖屏片。避开最坑的那几个雷。
1先别生图,把故事讲圆
新手最容易犯的错,一上来就开即梦生图。生成十几张漂亮的图,拼一起发现:这剧情它不通啊。
顺序得反过来。先用 AI 把剧本和人设卡写清楚,再动笔生图。
我跟你说个真事。有个 90 后奶爸,用 AI 单人做了部科幻短剧《归墟》,11 集播放破亿。他第一步不是画图,是先把人物和每一集的钩子定下来。
你让 AI 干这个,比你自己憋强。给它一个模糊点子,它给你拉出三幕结构、每幕的冲突、还有人物小传。
直接复制这段给它:
可直接复制使用
我要做一部 60 秒的竖屏 AI 短剧,题材是<都市/古风/科幻/悬疑>。 请帮我做两件事: 一、人物小传(2-3 个角色) 每个角色写清:名字、年龄感、一句性格、一个藏在心里的动机、口头禅。 禁止写「神秘」「强大」这种空词,要写具体行为,比如「一紧张就摸耳垂」。 二、三幕剧本 第一幕(0-15秒):用身份反差或冲突开场,让观众 3 秒内知道「这人是谁、遇到啥麻烦」。 第二幕(15-40秒):麻烦升级,主角做错一个选择。 第三幕(40-60秒):反转或留钩子,不要大团圆,留一句让人想看下一个。 每幕给我「画面提示」一栏:用 1-2 句话描述这一幕该看到的画面, 方便我后面直接拿去生图。语气别端着,像给朋友讲一个刚发生的八卦。跑出来不满意,就改一句「第二幕再狠一点,让主角亏得更明显」,它自己会调。
这一步的产出,是你后面所有图的「总剧本」。没有它,后面生再多图都是散的。

先把脑洞压成人设卡和三幕,别一上来就生图。
2锁死一张脸,别让它变来变去
这是 AI 短剧最大的坑,没有之一。
你生了张帅哥图,下一镜想接着用,结果 AI 给你换了个脸。上一幕浓眉,下一幕细眉。观众一眼出戏,平台也判你「千剧一脸」。
解法其实不复杂:先花一次功夫,生成一张「定妆照」,后面所有镜头都拿这张图当参考。
即梦有「角色锁定」,可灵有「主体参考」,思路都一样——你先给 AI 看一张脸,它后面就一直用这张脸。
先让 AI 出这张定妆照,描述要钉死:
可直接复制使用
请帮我生成主角的「定妆照」提示词,我会拿去生图。 角色:<名字>,<年龄感>,<发型发色>,<脸型>,<常穿的衣服颜色和款式>, <一个标志性小特征,比如左耳一颗痣/总戴一副黑框镜>。 画风:<古风工笔/现代写实/二次元>,电影感光影,半身近景,纯色或简单背景。 要求:只出一张正面清晰脸,不要动作、不要多人、不要复杂背景, 方便我后面每张分镜都锁定这张脸。生出来挑最顺眼的一张,存好。后面每一镜,提示词里都原样复制那段外貌描述,再把这张图作为参考图上传。即梦每天有免费额度,量大了就搭配通义万相、文心一格交替用,省钱。
记住一句话:角色一致性,靠的是「一张图 + 每段原样复制的描述」,不是靠你祈祷 AI 记得住。

一张定妆照锁死一张脸,每镜复用同一描述。
3让图动起来,用「图生视频」别用「文生视频」
图有了,下一步是让它们动。
这里又是一个坑。很多人图省事用「文生视频」:输入一句话,AI 直接出片段。问题是每次生成人脸都重新长,又变脸了。
正确姿势是「图生视频」:把你那张定妆图、那张分镜图传上去,再告诉 AI 这个角色要做什么动作。脸是锁死的,动的只是动作。
可灵对中文动作理解最准,每天送积分,新手够用。即梦、Runway 也能干这事。单镜头别超过 15 秒,越短 AI 越不容易崩。
动作描述要写细,别只写「他走了」:
可直接复制使用
这是第<几>镜,基于下面这张定妆图生成 5-10 秒视频: 【上传定妆图】 画面:<深夜网约车里,暖黄顶灯,城市霓虹从车窗流过> 动作:男主缓缓抬头,看向后视镜,嘴角微微动了一下, 眼神从疲惫转成温柔。幅度小,不要大幅动作。 口型:如果这镜有台词「<台词原文>」,让口型和这句对上。 忌:瞬移、多人乱入、肢体扭曲、光影突变。保持和上一镜同样的光。跑出来如果脸飘了,别拿生成的那帧接着用,回过头用原始定妆图重新锚。这是老手压住漂移的窍门。

图生视频比文生视频靠谱,脸不变,动作再小也写细。
4声音和成片,最后拼一下就好
图能动了,剩下的就是配音、字幕、拼成竖屏。
配音用剪映的「文本朗读」就行,选个贴合角色的音色——男主选磁性男声,反派选低沉的。有个细节:AI 默认语速偏快,降到 0.9 倍更自然,听众不累。
背景音乐按场景搜「温情」「悬疑」,别一整部用一个调。开门声、雨声、手机铃声这些去素材站下免费的,细节决定质感。
最后进剪映,建一个 9:16 竖屏项目,把片段按剧本拖进时间线,开「自动识别字幕」,全局调一次色。导出前,拿这张清单过一遍:
可直接复制使用
成片自检(逐条打勾再发): 1. 人脸:全片同一个角色,有没有哪一镜突然换脸? 2. 光影:同一场戏,光是不是统一的方向?没有忽明忽暗? 3. 逻辑:观众没看过剧本,能看懂前因后果吗?卡住的地方补一句旁白。 4. 字幕:有没有错别字、有没有和口型对不上的长句? 5. 节奏:开头 3 秒有没有钩子?有没有一段无聊到想划走? 6. 声音:背景音盖过人声了吗?语速是不是偏快? 以上任一条没过,先改再发。宁晚一天,不丢脸。
把片段、声音、字幕拼进 9:16 竖屏,自检清单过完再发。
发布时间有个经验:晚上 8 点到 10 点是黄金档,周末下午 2 点也不错。标签选对,抖音选「短剧」,视频号选「剧情」。
说到底,AI 短剧能不能成,跟 AI 多厉害关系不大。重要的还是那个老理儿:你讲的故事,得有人愿意看下去。
今天就把你一直想讲、又一直没动手的那个小故事,按这四步丢给 AI 试试。哪一步最卡,回来告诉我,我看看是提示词的问题,还是故事本身得再磨磨。
#AI短剧 #AI视频 #即梦 #可灵 #提示词 #多模态 #内容创作 #普通人用AI #效率提升 #AI工具