手把手教你做 AI 短剧,分镜、人物、场景,Pixmax全搞定(零基础版)
- 2026-10-05 03:38:30
最近的 AI 漫剧,已经开始一季接一季地追着观众跑了。
DataEye 发布的 8 月红果 AI 剧/漫剧榜里,《万妖图录传》第十季、第十一季包揽了前两名,《咱家剑宗团宠小师妹》排在了第三。

修仙、穿越、妖怪,这些原本需要不少特效才能呈现的故事,现在也有了用 AI 做成短剧的方式。
我也想顺着这个方向做一集看看。
这次想了个有点离谱的故事。一个正在高考考场上的女生,由于太困了想闭眼休息五分钟,结果被黑白无常抓错人,带到了地府。她着急回去考试,对方却告诉她,还阳回到人间还得等领导审批。更惨的是,为了躲过阎王检查,她还得临时冒充地府公考考生。
在人间高考,下了地府还得考公。
这就是我这次用 Pixmax 做的第一集,《高考睡了一觉,醒来在地府考公?》. 先给大家看看成片。
下面就结合这集,聊聊从分镜、人物和场景,到视频生成,整个过程我用 Pixmax 是怎么完成的。
先简单介绍一下 Pixmax。它是一个把剧本、分镜、图片和视频制作放在一起的 AI 创作平台。人物、场景和参考素材可以放在同一张画布上,不用每到一个环节就重新整理一遍。
除了调用模型生成图片和视频,它还有分镜脚本、3D 导演台、动作库和剪辑台。像这次片子里的三人站位、人物动作,就可以结合这些功能来安排,后面用具体镜头展开。
它的付费方式也比较直接,不用先买年度会员,再等着每个月领积分。按需要充值,积分一次性到账,永久有效,不会到月底就清零。
这次九月活动,充值 12999 元,加赠 150% 积分,一共到手 487,462 积分,相当于同样的钱拿到原来 2.5 倍的积分。
按这个档位折算,用 Seedance 2.0 生成 480P 视频,低至 0.27 元/秒。也就是一段 10 秒的视频素材,大约 2.7 元。


当然,素材生成出来,还得挑、还得剪,最终成片的成本要把重做和其他素材的消耗一起算上。但单次生成便宜一些,调整镜头时就能多留一点尝试的余地。
对制作节奏不固定的工作室来说,积分能留着接着用,也挺实在。有项目就集中做,暂时没项目就放着,不用为了月底清零赶着把余额花完。
团队还可以共享积分,配合企业版给成员分配额度、查看项目消耗。
回到这集地府短剧,我们从整理剧本和素材开始。
这集剧本接近两分钟,主要是三个出镜人物、两个场景。阎王暂时只出声音,不需要一开始就为他准备完整的角色资产。
制作顺序可以整理成一条线。
剧本 → 分镜 → 人物、场景和道具 → 视频生成 → 剪辑成片。

拿地府大殿这场戏来说,林安安的角色图、黑白无常的参考、殿门的位置,都会被多个镜头反复用到。
白无常手里还有一块 Pad。它既是道具,也是他发现抓错人的原因。后面那本黑皮书,则要留到结尾把「地府考公」的包袱抖出来。
这些东西最好从准备阶段就放在对应位置。

Pixmax 的无限画布可以把这些人物资产、场景资产、音频以及视频这些素材摊开、归类、连接,这样我们不用在文件夹里反复查找、下载与上传。
上一步结果可直接连接下一步。我们看一个镜头时,能够顺着连接找到它引用的人物和场景;需要换参考,也能找到该改的地方。
这样整个创作流程会非常清晰直观,也方便我们后面的复盘与总结。
Pixmax 的分镜脚本节点可以根据我们确定好的视觉风格和剧本内容来进行一键拆分分镜,并整理好每个镜头涉及的人物、场景和道具,为后续准备资产、生成提示词提供基础。

从画面描述、镜头语言到光影氛围与台词音效都拆分的非常清晰,当然我们还是要检查一下分镜脚本有没有问题,也可以随时修改分镜内容。

接下来我们就要去进行资产生成,pixmax 在拆分好分镜之后,会把剧本里面涉及到的所有人物、场景、道具以及人物对应的音频参考全部提取出来,并且会帮我们写好生图提示词,包括人物的三视图提示词。

这一步我们可以直接批量生成资产,然后再根据生成的资产图的效果去逐一进行调整。
pixmax 的无限画布里面聚合全行业主流 AI 大模型,当然也包括最新的 image2.5 图片模型,这次的人物和场景资产我就是用这个模型生成的。

这里我是在自己的资产库里面挑选了一个我比较满意的女性脸部参考图,然后用这张图再去生成全身的三视图。
女主的三视图提示词如下:
竖版9:16单画布,深灰色纯色背景,均匀漫射中性白光。保持人物面部特征、骨骼结构与妆容完全不变,顶部三分之一为正面头部极近距离特写;底部三分之二从左到右等宽排列正面、侧面、背面三幅取景自颈部以下的全身视图,画面上缘裁切于颈部,双手自然垂悬于两侧。真人实拍电影质感,写实比例。年轻女性外观,穿着整洁的普通高中日常校服。 身形自然。服装布料具有写实纹理,色彩自然,带有低饱和度对比。无强方向阴影,面部皮肤自然写实。这里有一个小 tips,我们传统的三视图通常是下面这样子的,左边放一个脸部特写,然后右边是人物全身的正面、侧面与背面。这样会出现一个问题,用这样的三视图作为人物形象参考的话,有可能视频模型会把全身照里面的脸作为人物脸部参考,然后由于这张全身照的脸部像素点不够,就会导致生成的视频里面人脸发生漂移,出现人物长相不一致的问题。

因此我这里的三视图的提示词写法是取景自颈部以下的全身视图,画面上缘裁切于颈部。这样就能确保视频模型只参考像素点足够多的脸部特写图,从而保证人物一致性。

黑白无常的角色形象设计方法有一点点不同。
我先用 image 2.5 模型 生成了下面这张黑白无常的游戏概念插画图

这里的概念图提示词我也是让 AI 帮忙设计的。
暗黑国风玄幻风格,数字概念艺术,游戏原画质感,双人并肩全身像,中国神话 黑白无常。【左侧黑无常】:身着绣有繁复暗纹的黑色古风官袍,头戴书写“天下太平”汉字的黑色高官帽,银白飘逸长发,冷峻精致的面容,半遮眼妆,右手抬起托举悬浮的骷髅幽魂,周身缠绕黑雾,衣身装饰银质骷髅挂饰、红色流苏与锁链;【右侧白无常】:身着轻薄飘逸的白色古风官袍,头戴书写“一见生财”汉字的白色高官帽,银白飘逸长发,冷峻精致的面容,周身环绕白色魂雾,衣袍点缀银质配饰与骷髅纹样,红色绳结细节装饰;背景为荒芜幽冥地府,残破的中式古牌坊,朦胧昏暗的浓雾,漂浮的半透明幽魂与骷髅灵体,地面散落血色痕迹,远景是破败阴司建筑轮廓。主色调为高级黑白灰,低饱和度,仅用暗红色做点缀,戏剧性侧逆光,强烈明暗对比,雾气体积光,诡异肃穆的压抑氛围,飘逸的布料纹理,根根分明的发丝质感,真实金属光泽,烟雾粒子特效,广角镜头,画面冲击力强在整体的视觉风格与服装风格满意之后,接着我还是在我自己的资产库里面挑选了一个男性脸部参考图,然后参考概念图里面的服饰生成完整的人物全身形象。



确定好人物形象之后,再用相同的方法生成人物三视图,同时也要注意黑白无常的帽子上文字也是角色设定的一部分,需要保持不变。
接着就是场景资产,这里我推荐大家直接使用 image2.5 直接生成像教室这样的真实环境的场景图。

像地府大殿这种偏玄幻视觉奇观的场景,我推荐大家使用 Midjouney V8.2 模型去生图,整体的美学风格和视觉效果会更好一些。

做场景的时候,还有一个常用的小技巧,我们可以在 pixmax 里面进一步生成场景的 720°全景图,包含正面、侧面各个角度,这样后面也可以结合 3D 导演台去选取不同视角的场景画面作为参考。

在所有资产都确定之后,下面就可以让 pixmax 直接生成各个分镜组的视频提示词,并且批量创建视频节点,这样我们就不用手动去连接各个素材节点,而且提示词也不用我们自己去一个一个镜头写。我们只需要检查每个视频提示词的内容,根据我们的需要去修改就好啦。

我们在创作过程中最容易遇到的问题,往往是不同镜头组之间角色在场景里的站位关系不一致,这里我给大家分享一下我的解决方案吧。
1、从上一个分镜中抽帧
第一种常用的方式就是从上一个分镜组的视频里面找到可以拍到所有人物位置关系的那一帧全景画面,截取下来作为下一组分镜的人物位置参考。


2、3D 导演台
另一种比较好用的方式就是使用 Pixmax 的 3D 导演台,我们可以通过 3D 导演台调整构图,控制旋转、俯仰、缩放、焦段,调整人物角色姿势骨骼,还能结合 720°全景确定空间关系,接着截图作为参考图,再结合我们之前的角色资产把人偶换成对应角色,再交给 Seedance 2.5 生成视频。这样能够更加精准地确定人物站位,减少抽卡。

另外,pixmax 的 3D 导演台里面还内置了一个动作库,里面提供了 2000 多个动捕动作,从行走、奔跑、跳跃、蹲下等日常动作,到打斗、舞蹈、情绪表达等复杂表演,动作库内预设动作全部由专业动捕设备采集。

比如这里我让黑无常在地府大殿跳一小段霹雳舞,我们在导演台里面把动作视频导出到画布后,就可以用前面做好的黑无常的形象以及地府大殿的场景图作为参考生成视频了,提示词就可以像下面这样描述,
保持无字幕,避免生成任何文字或字幕,不要生成 logo,不要生成水印。黑无常做动作遵循参考视频动作, 跳霹雳舞做定格pose。环境参考图2。
然后我们就能得到一段黑无常跳街舞的视频了。
以往 AI 视频创作,复杂动作总是难以精准把控。依靠纯文本提示词描述高难度动作,容易出现动作变形等的问题,只能反复抽卡试错,耗时耗力且成片率极低。
Pixmax 动作库将动作转化为可视化、可检索的结构化资产,选定特定动作数据后,即可一比一还原目标肢体表现,让 AI 动作拥有确定性与可控性。
这一集做完,林安安、黑白无常,还有地府大殿的素材都留下来了。后面继续做,就可以在这些基础上接着改,不用每次从头准备。
一个人做,自己知道哪张图是定稿。但是换成几个人分头做不同镜头,就得让大家都能找到同一套素材。
Pixmax 的团队资产库可以把确认好的人物、场景放在一起,供项目成员调用。需要一起调整镜头,也能在同一张画布上协作,修改会同步。
企业版可以免费申请,子账号数量不限,再按实际分工建团队、分配项目权限。谁负责哪一部分,就给谁开放对应的项目。
人多了,积分怎么花也得有个安排。
后台可以给成员设置固定额度、周期额度,或者不限制额度。新镜头需要多试几次,就根据任务调整预算。
做完之后,还能按项目、按成员查看消耗,导出明细。这一集花了多少,哪些环节用得多,下一集该留多少预算,都能拿自己的记录来估。
对持续做短剧的团队来说,前面准备好的素材能接着用,花出去的积分能查清楚,这些日常的小事安排顺了,后面的制作也更容易接上。
回头看,这集最初的念头其实就一句话。高考没考完,人先被抓去了地府,结果还得考公。
但是为了把这个脑洞拍出来,做成短剧,里面还是有不少活儿要慢慢磨的。
所以这次用 Pixmax,我更看重的是这些活儿能连着往下做。定好的人物接着用,想要的站位先摆出来,动作也有参考。遇到具体问题,手里有办法继续改,片子才有机会做完。
价格降下来,也给这种尝试留了点空间。一个还没把握的设定、一场不知道好不好笑的戏,总得先做出来,才知道值不值得往下走。如果每次试一下都要掂量很久,很多想法可能聊过就算了。
我觉得这也是现在做 AI 短剧挺有吸引力的地方。我们可以从观众的位置往前走一步,把自己的脑洞变成一段真正能播放的东西,再看看别人会不会笑、会不会想继续看。
如果你也有一个想拍的故事,可以去 pixmax 动手试试。这次充值加赠 150% 积分的活动,对经常做片子的团队来说,也能多留些打磨镜头的预算。
毕竟,自己的故事好不好看,拍出来才有答案。
关注「羊羊AI视频」,一起探索 AI 创作。
觉得有收获可以一键三连,转发给需要的小伙伴