【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事

【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事-元界深掘
【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事
此内容为付费阅读,请付费后查看
66积分
付费阅读

很多新手第一次用 AI 做短片,卡点都长得很像。

人会出。店会出。甚至分镜格子也会画。可一写「帮我写个一分钟短片,要有反转」,交回来的东西就不对了:两个人站中间说话,冲突靠吼,结尾靠旁白宣布真相。每一秒单独看都清楚,连起来却像三条预告片在接力。

这时候最容易做的两件事是:把词写更长,或者换一个「更会编故事」的模型。

更常见的原因其实更朴素——

不是模型不会讲故事,是你把半个点子,交给了一个必须同时当编剧、导演、道具和剪辑的系统。 它最省事的办法,就是交一份谁都能看懂、谁看完都不记得的热闹作业。

聊天模型会尽量听懂你的意图。可你后面还要把故事送进视频模型。视频模型不认「感人」「电影感」,它只认:这几秒里谁的手在干什么、哪一样东西能被镜头拍到。

所以这篇文章不教你更刺激的高潮,也不教哪句「反转」更灵。只教你把一个点子,问成一件能拍、做不成会出事的事。问清楚了,再写成场次。场次齐了,再进视频框。

下面所有提示词都用中文,豆包、ChatGPT、Gemini 都能跑。即梦、可灵、海螺、通义负责后面出图出视频。你不需要先成为编剧。你只需要先搞懂:短片剧本到底在回答哪几件事。


先记住一句大白话

做 AI 短片时,把工作分成四截,不要让一段词同时干完:

  • 点子只负责方向:今晚大概发生在哪、有谁
  • 三问只负责今晚的事:必须做成哪一件、什么在拦、做不成会看见什么
  • 规矩只负责观众先信什么、用什么脾气看完
  • 场次只负责哪一格能拍:手怎么动、东西怎么接、镜头先给什么

「帮我写个反转」四个字,四截里一截都没覆盖。所以它是空的。

为了让每一步都能对照,今晚只用一间屋、两个人、一件必须马上处理的事。不换城中村炸串,不换打印店,也不用修手机。我们去小区一楼的快递驿站。

二十四岁兼职站员。碎发扎一小把。深蓝马甲。工牌夹在口袋口。手指是红的。窄屋。左边一排黄色快递柜,中间一张小桌,桌上有扫码枪和一支红色记号笔,右边一堆还没入库的纸箱,门口塑料帘,顶上一根冷白灯管。墙上有电子钟。柜门 C-17 的灯一直在闪。

今晚只把这一件事写成短片:

离打烊还有 8 分钟。C-17 一直响。屏幕上的收件人是戴眼镜的女人。门口进来的是一个拎着蓝色冰袋的男人。店规写着:人像对不上,不能开柜。她必须在系统锁柜前决定——开,还是不开。

后面六步都围着这间屋走。换你自己的点子时,只换人和事,不要换顺序。


第一件事:别把简介当成剧本

你现在如果随手写一句,多半是这样的:

一个女孩在快递站遇到可疑的人,要有冲突,要有反转,1 分钟,电影感,感人

模型会很听话。它交得也很快。女孩居中,问「你到底是谁」。男人说「事情不是你想的那样」。镜头自己切两刀。结尾告诉你:原来他是好人。

六个标签都在:女孩、快递站、可疑、冲突、反转、感人。 六个标签里,没有一件能让手去干活。

人脑可以靠「可疑」脑补一整晚。AI 不行。它听不懂可疑,只听得懂能对照的事。

你也可以把这句话说得更像作文,结果往往更空:

一个善良的驿站女孩,面对一个形迹可疑的取件人,内心挣扎,最终做出选择,人性闪光

善良怎么拍?内心挣扎时手往哪放?人性闪光时灯往哪打?画面上一个都没有。

短片不是把长片剪短。观众没有时间听身世。他们只肯看一件事:有人想做成一件具体的事,有东西在拦,拦不成会出事。这三件还必须能被镜头拍到。拍不到的,先当它不存在。

还是这间驿站。三问一填,画面会自己来:

  1. 她今晚必须做成哪一件? 打烊前,把 C-17 里的冷藏件交到正确的人手里。药不能在不通电的柜子里放到早上。
  2. 谁或什么在拦她? 屏幕上是戴眼镜的女人,来的是男人。墙上贴着店规:人像对不上,不能开柜。电子钟还剩 8 分钟。
  3. 做不成会立刻失去什么? 22:00 一到,系统锁柜,冰袋里的药会捂坏。她要是违规开柜,这月奖金没了。她要是不开,药也没了。

你看,闪灯的柜、对照的屏幕、蓝色冰袋、准备打叉的红笔、墙上的 21:52,都是被这三问叫出来的。不是被「电影感」叫出来的。

造型救不了没有今晚的事。柜是什么黄、马甲是什么蓝,都排在这三问后面。

把点子丢给对话模型时,先禁止它写对白、禁止它写反转、禁止它写结局。只准它帮你把三问答满。示范已经填进驿站,可以直接复制:

图片[1]-【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事-元界深掘

这一步不要挑最复杂的。短片更吃倒计时、一扇打不开的门、一样一直在响的东西。五个人、三个地点、一套庞大世界观,看起来更像电影,送进视频框会先死。

你可以做一次对照:先用开场那句让它写一分钟剧本,再跑这段三问。不要先看谁更像故事。先看哪一份里,她的手有具体的事可做。


第二件事:第一稿只负责摊开,不负责拍

初学者还有一句很爱写的:

帮我写一个快递站的短片剧本,要有反转,人物丰满,节奏紧凑

目标没给。限制没给。今晚用什么脾气看完也没给。模型只能从训练里拣最稳的组合:解释性台词很多,冲突放到后半段,反转靠揭身份,结尾用一段话说明真相。

字很完整。拿去拍,全是说话的脸。柜子不干活,冰袋不干活,8 分钟也不干活。

更麻烦的是心理。它一写完,你就不好意思删。于是一份并不适合拍的第一稿,成了后面所有图和视频的祖宗。

换一个用法。让它先当你的问询员。你不会写剧情,但你看得懂选项。它一次只问一个能拍的问题,你选。选完,再允许它往下写。

针对这间驿站,它该问的是这类题,不是「要不要更有文学性」:

她更怕违规扣钱,还是更怕药捂坏? 男人进门先出示证件,还是先把冰袋往桌上一放? 店规是贴在墙上让镜头拍到,还是她自己背出来? 8 分钟是墙上的钟,还是 C-17 自己的倒计时? 她准备拒收时,手里拿的是红色记号笔,还是已经写了一半的拒收单?

每答一个,画面就多钉死一格。答完时故事还没有结局,可已经能拍了。

图片[2]-【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事-元界深掘

问完你手里该有的,不是一段故事,是一张能检查的纸:

今晚的事
人:二十四岁驿站兼职,深蓝马甲,碎发,手指红。
第二人:三十出头男人,深灰外套,右手蓝色冰袋。
屋:黄柜、小桌、扫码枪、红记号笔、塑料帘、冷白灯管、电子钟。
必须做成:22:00 前把 C-17 的冷藏件交出去。
拦着的:屏幕女人像 vs 门口男人;墙上店规;还剩 8 分钟。
做不成:柜上锁,冰袋捂热;或者她违规开柜,工牌被扣。
开场 3 秒:C-17 灯闪,电子钟 21:52,她已经把拒收单摊开。
从头到尾都在的东西:蓝色冰袋、红色记号笔、柜门提示音。

纸上这些都有了,才进入下一步。还没有,就继续问。不要写剧本。


第三件事:感觉要翻译成今晚的规矩

同一间驿站、同一组人,其实能拍成三种完全不像的片子。

压着拍:对白极少。她对照屏幕,他不解释。提示音一下一下响。钟走得比人快。 好笑地拍:他不会用扫码枪,冰袋一直要滑出塑料袋,她越想按规定来越手忙脚乱。 心软地拍:冲突不是赢他,是她看见冰袋上的水,决定承担扣钱。结尾不要演讲,只留一个动作。

方向一变,说话方式、镜头速度、柜门颜色的意味、结尾停在哪,全变。

你不告诉它方向,它会走训练里最常见的那一档:解释很多,情绪平均,所有信息堆在最后一秒揭晓。能看完,记不住。

所以「高级、有质感、像电影」这些词太宽。要把感觉翻译成能检查的规矩。

你想要压迫,就写成:对白少于三句;信息先藏;声音比台词早响;人有停顿和回避。不要写成「氛围压抑、张力拉满」。 你想要好笑,就写成:错在手上不在嘴上;同一件事做失败两次;第三下才做成。不要写成「轻松幽默」。 你想要心软,就写成:冲突不是击败对方;结尾留一个主动的小动作;不要旁白总结。不要写成「温暖治愈」。 你想要快,就写成:前 8 秒出现问题;中间必须有一次二选一;结尾用一个画面收。不要写成「节奏紧凑」。

驿站如果走压迫,规矩可以钉成这样:

对白不超过三句。
男人进门先把冰袋放桌上,不要先自我介绍。
C-17 的提示音从开场响到她做决定,不许当背景音乐用。
她对照人像时,镜头先只给屏幕和证件,不给男人全身。
不许旁白。不许字幕解释店规。店规必须是墙上那张纸。

模型听见的是限制,不是夸奖。限制才指挥得动它。

还有一种很常见的写法,是丢一个你喜欢的片名:

写成某某电影那种感觉,镜头也要像那个导演

它不会真的像。它只会把训练里跟这个名字最常绑在一起的脸、色、旁白往上贴。你自己的驿站没了。

你真正喜欢的,往往只是一小块:留白、说话少、灯不美、结尾不把答案说尽。这些才配写进规矩。

图片[3]-【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事-元界深掘

这一步有一个很好用的验收:把「电影感」三个字删掉,故事还必须能拍。删不掉,说明你还在用夸奖代替规矩。


第四件事:反转是让人回头看懂刚才那一格

提到反转,新手第一反应几乎都是:坏人其实是好人,好人其实是卧底,取件的才是偷件的。

身份对调能用。可它太常见了。观众开场就会猜「这个男人到底是谁」。猜对了,你后面白拍;猜错了,也只是被换了一个标签。前面那些柜子和冰袋,全程在围观。

能站住的反转,不是让人惊呼「我没想到」。是让人回头说:原来刚才那一格,早就拍过答案了。第二次看,仍然成立。因为线索本来就在画面里,不是你结尾临时加的。

短片里有五个特别适合动手的位置。五个都还用这间驿站,不换店,不换人。

人的目的变了,不是好人坏人变了。她以为男人急着取件,是因为心虚。后来才看懂:他急的是冰袋,不是柜。他一直把冰袋举到她眼前,她却只顾对证件。善恶没换,目的换了,关系就换了。

一个动作前面像毛病,后面像办法。他进门把扫码枪抓起来乱扫,她以为他要硬开柜。后来才知道:到付件已经付过,枪响那一声是付款成功,不是撬锁。动作没变,解释变了。

一件道具先当背景,后当钥匙。红色记号笔她拿来准备在拒收单上打叉。柜门侧面其实有同一支笔写的半句字,被柜门挡着。拉一下门,才露出「夜班可给」。笔不是突然出现的神器,是开场就在桌上的那一支。

声音比嘴先把真相送进来。C-17 的「请取件」循环响。她听成系统在催她按规定拒绝。其实白班把这单设成了「到柜即通知家属」,家属就是这个男人。提示音从第一秒就在说「给他」,她一直听成「别给」。

镜头决定观众先看见什么、暂时看不见什么。前半段只拍她盯屏幕、盯证件、盯店规,男人只有肩膀。后段拉远,才看见他左手一直拎着渗水的冰袋,桌腿边已经积了一小摊。信息不是新加的,是你刚才不让观众看全。

前半段以为他要冒领,后半段看懂他在保药的冰,拍冰袋比证件更早伸过来。 前半段以为乱扫是抢,后半段看懂枪响是已付款,拍扫码枪指示灯亮一下。 前半段以为红笔用来拒收,后半段看见柜侧有同一支笔的字,先给笔特写,再给柜侧字。 前半段以为提示音在催拒收,后半段听懂它在叫家属,音一直在,人不解释。 前半段只看见他脸可疑,后半段才看见手在发抖、冰袋在漏,所以先近后远,不要一上来全身。

五条不必全用。60 秒用两条就够,三条就满。五条一起上,会变成魔术表演,观众来不及信。

最容易翻的坑,是前面拍一套、结尾另说一套。男人突然掏出一张家属证明,或者突然哭着说「这是我妈的药」。你听懂了,画面没干活。下次再看,前面那些格子仍然是空的。

反转要过两关。前面至少有两格已经拍过线索:冰袋进门就在,提示音开场就响。揭示靠动作、道具、声音或拉远,不靠演讲。她拉开柜门看见半句字,比他亲口说「我是家属」管用。

图片[4]-【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事-元界深掘

设计完可以倒着检查:把最后揭示那一格遮住,前面还像不像「他要冒领」。如果前面已经在喊「他是好人」,反转就没了。如果前面完全看不出冰袋,反转就是作弊。


第五件事:先走几条路,再挑一条人少、场少、能停住的

很多人对着第一份剧本就开始出图。后面通常会在三个地方被动:人多了,脸接不住;场多了,灯接不住;关键情节全靠嘴说,结尾没有一个能停住的画面。

第一个版本可以当草稿,不能当祖宗。故事需要比较。同一个点子走出几条路,再用能不能拍来筛,比在一份普通稿上反复润色快。

驿站这个点子,至少能走出三条完全不像的路。对照看,你就知道热闹和能拍不是一回事。

第一条热闹,但拍不了。她怀疑整栋楼的驿站在调包,要追到小区门口,保安加入,物业加入,最后发现是一个团伙。5 个人、3 个地点、1 次奔跑。看起来像短片,进模型会先换脸,再换门,再把冰袋弄丢。

第二条能拍,也有事做。就这一间屋。8 分钟。C-17 灯闪。她准备拒收。男人不会解释,只会把冰袋往前送。揭示靠三样已经出现过的东西:柜侧被挡住的半句字、扫码枪已经嘀过、拉远看见冰袋在漏。她开门。药还是凉的。电子钟 21:59。两个人,一个场,一个结尾画面。这条推荐走。

第三条心软,但少了一层误判。她看他可怜,违规开柜,结尾帮他重新扎冰袋。能拍,也可爱。可观众开场就知道她会给,60 秒里缺少「先信错一次」。片子会暖,不会回头。

筛选时别问哪条最离奇。问这五句就够:

开头 8 秒有没有问题撞上脸? 主角有没有一次两难,不能两全? 冲突能不能被柜子、冰袋、钟、笔拍出来? 关键道具是不是少而有用? 结尾能不能停在一个不用解释的画面上?

第一条五项全翻。第三条缺第二项。第二条五项都能在这间屋里指出来。

短片不是缩短的长片。它不需要给男人完整身世,也不需要给驿站一部创业史。它需要的是:一个人,面对一件今晚必须处理的事,做出一次会留下痕迹的选择。

图片[5]-【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事-元界深掘

选出那一条之后,把这些钉死,不许下一份提示词再发明:

已锁定
目标:22:00 前把 C-17 冷藏件交出去
阻力:人像对不上 + 店规 + 倒计时
代价:药捂坏,或她被扣钱
两难:开柜违规,不开柜药坏
揭示:柜侧半句字 + 拉远的漏水冰袋(扫码枪嘀过可作为辅)
结尾画面:柜门开一条缝,冰袋贴着药箱,钟 21:59,两个人都不看镜头

还没有这张纸,就不要写场次。


第六件事:现在才允许它写成能进视频框的场次

三问有了,规矩有了,反转位置有了,选定的路也有了。这时再让它写场次。

最重要的一句是:不要重新抛一个开放问题。「帮我写个完整剧本」会让它把前面的选择忘掉,再交一份更像作文的东西回来。

已经钉死的选择,要当作不可改的材料交给它。它只负责拆成能拍的格子,不负责再创作一次人生。

驿站选定第二条之后,60 秒可以拆成三场。每场必须有任务:让她得到信息、失去机会、做出选择,或让观众改判。哪一场三项都不干,就删。删掉的场,比写得漂亮的废场值钱。

第一场,大约 12 秒,开场撞上问题。电子钟 21:52。C-17 灯闪,提示音响。她已经把拒收单摊开,红色记号笔在手里。男人掀帘进来,先把蓝色冰袋放桌上,再掏证件。屏幕上是戴眼镜的女人。她对照,笔盖打开。这一场只做一件事:让观众先相信「这是冒领」。不要让他解释自己是谁。

第二场,大约 28 秒,规定把她卡住。她把证件和屏幕并在一起。墙上店规就在她耳边。男人去抓扫码枪,枪嘀一声。她以为他硬开,按住枪。他不说话,只把冰袋往前推。她准备在拒收单上打叉,笔尖碰到纸,停住。这一场让两难出现,但还不要揭。不要让第三人打电话来救场。

第三场,大约 20 秒,改判,然后停住。她去关 C-17 的提示音,手拉开柜门,看见侧面同一支红笔写的半句「夜班可给」。镜头这才拉到全身:冰袋已经漏了一小摊。她开门。药箱贴上冰袋。钟 21:59。帘子被风掀一下。两个人都不看镜头。这一场用已经出现的笔和冰袋改判,停在一个画面上。不要她说「原来是这样」,不要他鞠躬,不要字幕写「温情驿站」。

三场连起来,检查的是连续性,不是文采。上一场的笔还在不在她手里;冰袋有没有中途换颜色;柜号有没有从 C-17 变成别的。

格子里还没有事,格子一定空。现在事有了,格子才配画。场次写完,先看「这一场干什么」,再去画分镜。

图片[6]-【六十四】你的 AI 短片不是缺反转,是点子还没问成一件今晚必须做成的事-元界深掘

场次出来以后,不要立刻进视频框。先做三件很土、但最管用的事:

两人各钉一张静帧,马甲、冰袋、工牌不许第二镜改。 空屋一张,黄柜在左,小桌在中,帘子在门,钟在墙上。 按三场画格子,上一格能走进下一格,人不要瞬移到门外。

视频词最后才出现,而且要短。它只负责把已经走完的事拼上,不许再发明感人的对白和电影感运镜。


收一收:顺序比词漂亮更重要

实际开工时,按这个顺序走就行。

先把「帮我写个反转短片、电影感、人物丰满」删掉。这些是评分,不是施工。 先逼出三问。必须做成哪一件、什么在拦、做不成今晚会看见什么。拍不到的不算。 让它当问询员,一次一问。你只选能看见的选项。问完输出「今晚的事」,不要剧本。 把观众要感受的写成准和不准。压迫就少话、藏信息、让声音先干活。不要写像某部电影。 在五个位置里挑反转,最多用两条。人的目的、误读的动作、开场就在的道具、场内声音、镜头先藏后露。揭示不靠演讲。 同一点子走出几条路,按能不能拍来筛。人少、场少、嘴少、结尾能静住。把选定的那条锁成一张纸。 这才写成三场。每场有任务。动作按先后。对白能省就省。写完先自检,再画格子。 先用一个人、一间屋、60 秒练会。别一上来五个人跨三个场地追车。

AI 短片真正能拍动的故事,不是「反转」两个字写进去就有的。是模型还没出图之前,你已经能用手指着说:她要开这扇柜,钟在走,冰袋在漏,笔在桌上,观众先看错,后面用已经拍过的东西改回来。

还拍不像的时候,先别换模型。回头看纸。

两个人在吵架,别急着加冲突和张力,先改三问里那件具体的事。 结尾旁白宣布真相,别急着加更深的主题,先改开场就在的道具或声音。 人一多脸就漂,别急着上群像和反转套反转,先锁回两个人、一间场。 像预告片不像一段事,别急着写电影感和一分钟混剪,先看三场任务能不能从上走进下。 故事对了视频还假,别急着把视频词写更长,先让静帧、空屋、格子齐,词变短。

模型能少猜,不能替你决定今晚拍哪一件。人越多、场越多、嘴越多,翻车越快。

今晚不要验收「看起来很像短片」。验收这几条就够:

开场 8 秒就能看见问题。 她必须在两坏里选一坏。 冰袋、柜灯、红笔至少有两样从头干到尾。 结尾停在一个不用解释的画面上。 没有任何一句在替观众做阅读理解。

你可以先用开场那句让它写一份「反转短片」对照。再只跑三问,看她的手有没有事做。再只加一条规矩:对白少于三句。最后让揭示落在拉开柜门看见半句字、镜头拉远看见冰袋在漏。

人和屋还在那间驿站里,你就真的会把点子写成能拍的事了。

THE END
喜欢就支持一下吧
点赞12 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容