AI短剧提示词总写不好?这篇保姆级指南帮你打通任督二脉
- 2026-10-05 19:32:22
从“写一段描述”到“写一组可拍、可控、可返修的镜头指令”,你只差这一篇。
大家好,我开始更新文章了。目前,我专注AI短剧这个方向:用AI做短剧内容,把AI工具Codex、WorkBuddy等真正用出效率,分享流量获客的实战方法,拆解商业变现路径,也帮同行对接资源、合作共赢。
我最近跟不少同行交流,发现一个特别有意思的现象:很多人在剧本上花了一周,分镜上也花了三天,结果所有精力都卡在最后一步——提示词。
打开AI工具,面对空白的输入框,脑子里有画面,就是不知道怎么写。写少了,AI给你来个“僵尸脸”;写多了,AI开始乱发挥,人物五官漂移、场景忽明忽暗,分镜之间根本接不上。
我自己也经历了很长一段时间的“提示词折磨期”。今天这篇文章,我把这段时间踩过的坑、总结的方法、验证过的模板全部整理出来,希望对正在被提示词困扰的你有所帮助。
文章比较长,建议先收藏再看,文末有可直接复制的提示词模板。
一、你的提示词为什么总是不好用?
先把问题诊断清楚,再开药方。
很多人写提示词,习惯用“人类语言”跟AI对话。比如“女主角很伤心,哭了”“男主愤怒地拍桌子”——我们觉得已经够清楚了,但AI接收到的是什么?
“伤心”这个词,在AI的“理解”里可能对应一万种表情。是默默流泪还是嚎啕大哭?是眼眶泛红还是泪流满面?AI只能自己猜。而每次猜的结果都不一样。
这就是提示词失效的根源:你写的是感受,AI需要的是指令。
还有一个常见误区:用同一段提示词生成所有镜头。新手最容易觉得“我设定好了主角外貌,后面就统一了”,结果男主角每换一个镜头就换一张脸。
核心结论很简单:提示词不是写给“人”看的,是写给“机器”执行的操作手册。
二、提示词写作的三层结构:从骨架到血肉
我实践下来,一套好用的短剧提示词,应该包含三层结构,就像盖房子——先搭骨架,再砌墙,最后搞装修。
第一层:骨骼层——角色锚点(每个镜头必带)
这是最容易被忽略、也最不能省略的一层。
每次生成新画面时,把角色的核心特征复制到提示词最前面,再叠加新的描述。
角色锚点至少包含三层信息:脸型与五官(如“鹅蛋脸、杏仁眼、薄唇”)、标志性特征(如“右眼下方浅色小痣”)、发型发色(如“黑色齐肩直发,三七侧分”)。
实操建议:给自己做一张“人物设定卡” ,把所有角色的锚点描述固定下来,每次直接复制粘贴。
关键原则:描述越具体,AI发挥空间越小。 不要说“漂亮的女孩”,要说“高颧骨、下颌线分明、皮肤偏冷白”。
换装时只改服装部分的描述,脸部和发型锚点完全保留。变量越少,AI的随机性就越容易被压制。
第二层:肌肉层——动作与微表情
这一层是区分“能看”和“好看”的关键。
很多人写动作只写“她走向门口”“他拿起电话”——这些属于基本动作,没毛病,但不够。
真正让AI短剧有“演技”的,是微表情和身体细节。我拆解过大量高赞AI短剧片段,发现那些让观众共情的镜头,几乎都有精确到面部细节的描述。
举个例子,对比一下:
❌ 普通写法:“女主发现男友背叛,很震惊”
✅ 进阶写法:“双眼瞳孔骤然放大,嘴唇微张但发不出声,手中咖啡杯倾斜液体溢出,身体微微后仰半步,手指无意识地攥紧衣角”
为什么有效?因为AI接收到的是可执行的物理指令,而不是需要“理解”的抽象概念。
再分享一个技巧:在提示词中加入“性格锚点”。 如果你的角色是“表面温柔实则腹黑的千金小姐”,那她的“开心”就不能是大笑,而是“嘴角上扬12°但眼神温度不变,指尖轻抚茶杯边缘,身体微微后仰拉开距离感”。
第三层:皮肤层——场景、镜头与氛围
这一层负责画面的“质感”。
镜头语言必须写清楚,包括景别(特写/中景/全景)、镜头运动(推近/拉远/环绕)、角度(平视/仰拍/俯拍)。不写,AI就随机给。
光影和色调同样不能省。同样的场景,暖黄灯光和冷蓝月光出来的氛围完全不同。建议在提示词中固定一组“风格锚定字符串”,每个镜头都以它开头,确保全片画风统一。
三、万能公式:直接套用的提示词模板
说了这么多理论,来点最实用的。
经过反复测试,我总结出一个短剧提示词万能公式:
角色锚点 + 场景环境 + 动作/微表情 + 景别与运镜 + 光影色调 + 约束条件
对应到具体写作,可以按照“时间 + 镜头运镜 + 精准主体 + 动作细节 + 场景环境 + 光影色调 + 音效 + 约束条件”的顺序来组织。
我来给一个完整的示例,假设是一场“女主在雨中决绝分手”的戏:
【角色锚点】林薇,26岁,鹅蛋脸,丹凤眼,黑色长直发被雨水打湿贴在脸颊,右眼角有一颗泪痣,白色衬衫已被雨水浸透
【场景环境】夜晚的城市街道,暴雨如注,路灯在积水中投下摇曳的光斑,远处霓虹模糊成色块
【动作与微表情】她缓缓松开攥紧的拳头,雨水混着泪水从下巴滴落,嘴角微微上扬但笑意未达眼底,眼神从痛苦转为释然,转身的瞬间睫毛微微颤动
【景别与运镜】中近景,镜头从侧面缓慢环绕至正面,最后定格在背影消失于雨幕中
【光影色调】冷蓝色主调,路灯暖光作为点缀,高对比度,电影胶片质感
【约束条件】不要出现其他人物正脸,不要出现文字水印
这个公式的核心逻辑是:先锁死不变的元素,再描述变化的元素。 不变的是角色和风格锚点,变化的是动作和镜头。
多镜头连载时,建议把提示词拆成两层:固定层(角色锚点+风格锚定)每次复制,变化层(动作+场景+运镜)按镜头重写。 这样既能保证一致性,又不会让提示词越来越臃肿。
四、避坑指南:这几个错误千万别犯
坑一:提示词堆砌冲突
同时写“清纯甜美”和“冷艳高贵”,AI直接精神分裂。一个镜头只给一个核心情绪基调,不要既要又要。
坑二:描述过于抽象
“她优雅地挥动智慧之手”——AI根本不知道“智慧之手”是什么。所有形容词都要能被“翻译”成画面,翻译不出来的就删掉。
坑三:场景描述太多,角色锚点被稀释
角色描述永远放在提示词最前面,让它占据“最高优先级”。场景再好看,人物不统一,观众三秒就划走。
坑四:动作幅度超出AI能力
一个镜头里安排“转身、摔倒、翻身站起、拔剑”四个动作——5秒内AI根本完不成。每个镜头只安排一个主要动作,把精力放在单镜头的情绪传递上。
坑五:忘记写负面约束
最后一定要加约束条件,明确告诉AI哪些内容不能出现。比如“不要出现其他人正脸”“不要改变角色发型”“不要添加文字水印”。
五、进阶技巧:让提示词效率翻倍的三个方法
1. 建立“创作内核手册”,一次生成永久复用
做连载短剧最头疼的是Token越烧越快。核心原因是AI没有记忆,每次对话都要重读所有历史内容。
解决办法:让AI把核心设定浓缩成一份800字以内的极简手册,包含人设底座、世界观、已更剧集总览和创作规范。后续新开对话时,粘贴这份手册即可无缝衔接。
2. 先出定妆照,再图生视频
不要指望纯文字描述就能锁住角色一致性。最可靠的方式是先生成一张标准的角色定妆照(正面半身高清),后续所有镜头以这张图为参考,提示词只写动作和场景,不重复描述外貌。
这是目前一致性最高、操作最简单的方案,尤其适合新手。
3. 建立“翻车→修复”案例库
每次生成失败,不要只是重来。把问题记下来:是角色漂移?是站位错误?还是道具消失?然后针对性修改提示词。
积累多了,你会发现自己有一套专属的“问题-方案”对照表。这比任何通用教程都有用。
写在最后
写提示词这件事,本质上是在做翻译——把我们脑子里的画面,翻译成AI能精确执行的指令。
这个翻译过程需要练习,但更需要方法。希望今天分享的三层结构、万能公式和避坑指南,能帮你少走一些弯路。
最后送大家一句话:好的提示词不是写出来的,是拆出来的。 拆解爆款、拆解自己的失败案例,拆得多了,手感自然就有了。
如果你觉得这篇文章有帮助,欢迎转发给正在被提示词困扰的伙伴。也欢迎在评论区分享你的提示词心得,我们一起交流进步。
下期预告:AI短剧分镜如何做到“无缝连镜”?——站位锁定与道具稳定实战教程。 感兴趣的朋友点个关注,不错过更新。
以上视频提示词及本文提到的提示词模板和创作内核手册模板,我整理了一份文档,后台回复“提示词”即可获取。