我讲得这么清楚,它总该懂了吧——折戟AI短剧初体验
- 2026-10-04 13:30:44
最近 AI 短剧不是很火吗?空闲之余我就想着捣鼓捣鼓。
先说结论,完美主义者及强迫症玩家还是放弃吧。
因为之前试过一次,人物形象乱七八糟,于是上网先查了一些教程,才发现 AI 短剧教程也是工厂流水线形式的了。
剧本—分镜—人物形象设定—关键帧图片生成—然后开始出片
对于我这种完美主义+强迫症的人来说,剧本不难,AI 生成一个便是,分镜我不懂,AI 做什么我觉得都对。问题出在人物形象设定跟关键帧上。
AI 给我写了一个空姐的故事,第一张图很顺利,一张美丽的空姐照出炉了。

说实话,确实挺美的。都迫不及待想要生成视频看看了。
但教程说这只是第一步,角色卡的制作。
强迫症的我循规蹈矩地按照教程继续走下去了,悲剧就开始了。
因为其他镜头需要主角的其他装束,于是我让 AI 帮我生成这个人物的其他定妆照。这下好了,出来的照片五花八门,都好看,都美丽,但是总感觉脸不对,这个脸要是不对,我这个行外人都知道,到时候视频做出来,肯定是好几个不同的“女一号”。
在生成了 N 张图,跟 AI 校准了 N 次以后,我放弃了。心想,要不这个步骤先这样吧。

同一件衣服换了四种场合,脸开始不一样了
下一步是做场景图,这一步是让我彻底崩溃的。
同样的,第一张图很顺利,生成的小洋房还是挺符合剧情需要的。然后我的一个念头,就导致这个短剧“折戟沉沙”了。
我当时想,一个角度肯定不行吧,拍电视不都是从好几个角度去拍的吗?这个房间肯定要有多个角度的底图,这样到时候生成的视频才能保证逻辑一致吧。

这是原来那个方向,从玄关往阳台看
于是我对 AI 说:我手上有一张照片,镜头在玄关,正对着阳台。我需要反过来的:站在阳台上,朝玄关回看。
同一个房间,只是换了个方向。家具怎么摆、光从哪来、墙是什么材质,全都不用重新说,它只要把镜头转过去。说白了,就是转个身。
我给了它两张参考图:一张是这个房间现在的样子,一张是户型图。户型图是我自己加的——我怕它不理解空间关系,想着多给一张平面图,总该看明白了。

我额外画了张户型图
现在回头看,我一直在想,我到底是从哪一步开始走错的。
它开始回答的时候,我是放心的。
它先花了两分多钟,然后说:
我已理解两张图的关系:现有内景是从玄关往阳台看,右侧厨房、左侧沙发,远处是阳台门和红瓦老洋房。你要的是反向视角——站在阳台往玄关回看,左右会镜像翻转:厨房到了左侧,沙发到了右侧,尽头是玄关与入户门。
看到这段,我心里松了一口气。
因为它不光是说“我懂了”。它把懂的东西说出来了,而且说到了关键——镜像翻转。这是整件事里唯一有技术含量的地方,它点到了。厨房原本在右边,转过去就在左边;沙发原本在左边,转过去就在右边。位置关系一个不差。
它最后还说了一句:“生成完成,视角、布局与材质都和原片互为对景。”
“互为对景”这个词,用得挺准。它甚至预设了东南西北,把镜头切换后的角度描述得 100% 正确。
然后我看到了图。

这是它画的反视角。台面飞了,门中有门
它把左右关系说得那么对,然后画出来是另一个样子。
于是倔脾气的我,从一开始想做短剧,变成了做室内设计,死磕这张另一个角度的室内图。
每一次重新生成之前,我都觉得这回行了。理由也很充分:上一张哪里不对,我这回都指出来了;哪句话没说清楚,我这回补上了。
我每一次点确定,想的都是同一句话——这次讲这么清楚了,应该可以了吧。

我每指一个地方,它就改一点,改完还汇报一遍
结果就是我跟它对战了整整三个小时。
三个小时不算长,但它是很难受的三个小时——不是难,是原地打转。每一轮我都觉得快成了,每一轮出来都是新的错法。
我不知道它到底有没有读懂我那张平面图。 每次出给我的图,都是一些奇怪的逻辑错误。

几种错法。中间那张,方向直接反了。
每次让它改,它都能改,但是跟平面图都对不上。所以我在想:会不会 AI 没有三维空间的概念?(懂行的能留言可以留言交流交流)
这个问题的答案,我不知道去哪里找。但是有一点我开始有点了解 AI 了:它永远不会说自己不懂,因为它把不懂的地方,顺着自己的逻辑补齐了。
这就是它比我想象中难对付的地方:它不懂的部分,长得和它懂的部分一模一样。
它就像办公室里有些同事,永远跟你说好的好的,然后做的事情一塌糊涂。你就像拳头打在棉花上一样,无力。
还有个更实在的代价:钱。
我一直以为 AI 生图很便宜,两毛钱一张。结果一算,花了不下五十块。生图跟生成图,差距还是很大的。
中间有一会儿我也想过,是不是我自己的问题。我一个普通上班族,不是做室内设计的,可能是我提要求的方式不对,也可能是我用错了工具。
这点我认。要是一个真正的设计师来做,可能几分钟的事。
但反过来想,像我这样的人应该不少。我们不指望做出以假乱真的东西,只是想让它把一件说得清楚的事办成。就这么点期待。
我后来读到一份研究,讲的是另一件事,但我觉得说的是同一件事。
美国麻省理工学院有一组研究者,做的就是 AI 和人脑认知这一块。他们找了 54 个人分三组写文章:一组完全靠自己,一组用搜索引擎,一组用 ChatGPT。做了四个月,四轮。写的时候给他们戴上脑电图设备。
这项研究去年就发出来了,今年 9 月又被好几家媒体拿出来讲,《纽约时报》也报了。
结果是这样:用 ChatGPT 的那一组,大脑的连接强度最多下降了 55%。写完之后,83% 的人没法引用自己刚刚写下的句子。
还有一段,我觉得更能说明问题。研究者让一直用 AI 的人突然改成纯靠自己写,结果 78% 的人还是复述不出自己写的东西。反过来,一直靠自己写的人改用 AI,他们当中 89% 依然能复述,而且大脑活动比原来更活跃。
研究者给这个现象起了个名字:认知债务。
我觉得这件事的核心,不是“AI 能不能替你做”,是“你有没有把本该自己做的那一下让出去”。
往难听了说,你不会的东西,用了 AI,很可能还是不会。AI 只是让你看起来会。
后来那张图总算有了个雏形,也是在试了很多很多次之后。

左边是第一次成的,右边是又磨了很多轮之后的
我算是摸到一点门道,说三条。
第一,不要指望在一个错的图上改对。一开始就多生成几张,挑那张最接近你要的。
第二,也是最要紧的:不要让它在同一张图上换方向。它能调整,但它没法重来。比如左右反了,你想让它调过来,基本上调不回来。它只会在错的地方继续往细里抠。
第三,方向对了以后,才在那一张上一点一点改。
这三条说到底是一句话:
AI 能调整,不能重来。所以“重来”那一步,必须是你。
它从哪儿开始、往哪个方向去,这个起点得你定。它擅长的是在一条路上往前走,越走越细;不擅长的是退回去,换条路。
可能看到这里,有的读者会说这是你不会用 AI。
我承认,我不懂艺术设计、家装设计,我不知道该怎么把我的需求专业化地提出来。可能从事家装设计的人,用 AI 就能很轻松地解决这个问题。
我也试过用魔法打败魔法,让 AI 从专业角度去改这张图。当然,如果能成功,也就没有这篇文章了。
最后我还是想感叹一句,目前来说,AI 真的只是工具,用的人懂,它才真的懂。
这三个小时还教会我另一样东西:AI 说它懂了不算,真把结果做出来了,才是真懂了。
关于这个号
我叫它“洞穴之外的奇点”,来源于柏拉图的洞穴寓言和现在的科技奇点。
在这里我聊三件事:读点书,用点 AI,过明白。
如果你也在琢磨怎么把 AI 真正用起来,可以关注一下,我们慢慢聊。