【五十】爆款一反推就像开盲盒?别让 AI 猜「这是什么片」,先把镜头、人、灯、位置按秒问清楚

【五十】爆款一反推就像开盲盒?别让 AI 猜「这是什么片」,先把镜头、人、灯、位置按秒问清楚-元界深掘
【五十】爆款一反推就像开盲盒?别让 AI 猜「这是什么片」,先把镜头、人、灯、位置按秒问清楚
此内容为付费阅读,请付费后查看
66积分
付费阅读

你把链接丢过来的时候,操作大概是这样的:

暂停 → 整段扔给对话模型 → 打一句「描述这个视频,并给我视频提示词」→ 复制那一大段 → 丢进视频模型。

它回得很快,也写得很像那么回事:

凌晨便利店,电影感,生活流,一个短发女生走进来,氛围安静又孤独,
动态运镜,浅景深,光影高级,情绪饱满,超写实

店在。人在。灯箱也在。你多看两秒还是想划走。她不是没进门,是进门的方式太懂事了:你写走进来,她在画面中间标准地迈步;你写电影感,镜头开始毫无理由地晃。像拿着一张写了「便利店深夜」的答题卡在交卷。门是贴上去的。冷柜没有哈气。

你后补的两句我也看见了。「再写细一点。」「提示词长一点,不要假。」词更长了,片还是假片。最多变成:一个在标准地走路,一个在标准地拿瓶子。还是盲盒。只是盒子更大。

【二十一】练过别只扔一张截图。【二十七】练过别把动作写成待办。【四十八】练过别跟第一帧抢权。 这一节接在后面:三帧截对了,词还是假,是因为你让对话模型交的是点名册,不是这几秒里每样东西站在哪、怎么动。

口诀:复刻不是让它猜「这像什么片」。先问镜头站哪,再问人这八秒怎么走,再问灯从哪边打,再问东西在谁旁边。问完这些,才允许它写生成词。


先把验收说清楚。你要的不是「看得出这是便利店」,是:

她从自动门进来,灯箱在右侧,冷柜门上有一层哈气。她走到冷柜前,手才去碰玻璃。瓶不要从空气里长出来。镜头不要自己切第二个景。

下面只用这一家店跑完。凌晨两点。城中村路口,24 小时便利店。人、门、灯箱、冷柜、绿茶瓶,全部不许换。


开场:你反推的是点名册,它当成购物清单去贴

「电影感、生活流、动态运镜」对你是感觉。对它是三张可以随便贴的标签。它最省事的做法,就是找训练里最常见的那种「好看的便利店夜景」:人居中、灯箱标准地亮着、地上刚好有一块会反光的地砖。于是你看见的是清楚,不是这条片子。

真人凌晨进便利店,身上同时装着好几样东西:门外的冷、冷柜门上的水珠、手里还没决定买哪一瓶。镜头也闲不住。模型不会自动替你装。你只报生活流,它就交一份标准深夜人像作业。

所以正确的顺序不是「先写这是什么风格的视频,再让它动」。是先让这八秒里的镜头、人、灯、东西有各自的位置,再允许它写一句生成词。

看片时只问四句:镜头这会儿站哪?人先动哪一下?灯从哪边打到脸上?一样东西在不在她手够得到的地方?


一、别写「请给我视频提示词」,写它交出来的那些词为什么没用

很多人以为自己已经会反推了。其实只是把截图换成了整段视频,问题还是那句:「这是什么?帮我写成提示词。」模型会调出最标准的那一版:主体、场景、氛围、运镜,四样各写两个形容词。画面不会崩。它只是假。假在没有中间那一层:谁在哪,先发生哪一下。

1. 你问「这是什么视频」,它只会给你点名

点名很认真。店过了,人过了,饮料过了。可你拿去生成,模型听到的是一份购物清单:请放置 1 个女生、1 扇门、1 排冷柜、1 瓶茶。她从哪进、茶在第几层、灯打在哪侧,清单上没有,它就现场发明。

你原来那句,属于只报点名册:

请描述这个视频,并给我视频提示词,要专业,要电影感

交作业的标志就三样:全是名词和形容词;没有「第几秒」;没有「镜头从哪移到哪」。看见这三样,这段词可以直接删。不是它写得不够好,是它答错了题。

这一步只练一件事:先判断这段反推词里有没有位置和先后。没有,等于没反推。

2. 词写得再长,也会在三处翻车

你可能觉得自己已经够细了。它也能准确返回:

一个穿灰色抓绒衣的短发女生走进便利店,经过灯箱和货架,在冷柜前拿起一瓶绿茶,安静、孤独、电影感,动态运镜,浅景深

核心物件齐了。拿去跑视频,却还是开盲盒。因为它只回答了「店里有什么」。

动作没有先后。 写了「走进来,拿起瓶子」。人还在走,茶已经在手里;或者人到了冷柜前,瓶从空气里弹出来。 镜头没有路线。 写了「动态运镜」。跟在右后方、从脚抬到瓶、还是门口看着她走,它自己加戏。常见结果:绕圈、无故推进、忽然切特写。 东西没有站位。 灯箱在左还是右?冷柜是侧面那一排还是正面那扇门?不写站位,模型把东西摆到「好看」的地方。好看和原片,不是一回事。

你以为写细了模型实际在猜常见样子
走进便利店拿茶走和拿谁先谁后人还在走,瓶子已经在手里
动态运镜、生活流往哪移、移多快镜头乱晃,或原地放大假装在跟
灯箱、冷柜、浅景深东西在画面哪一侧灯箱跑到她面前,门上没有哈气

改法先记一句:身份、店名只当介绍。真正占位置的,是这八秒里镜头、手、灯、瓶,各自在哪、先发生哪一下。


二、别让它猜风格,先问四样能看见的东西

正确问法不是「帮我写提示词」。是「帮我看这几秒里,镜头、人、灯、东西各自站哪」。每一问都必须能在画面上指出来。指不出来的,不算回答。

把视频丢过去,只许它按这四问答。一次问完,不要再补「写得文艺一点」:

图片[1]-【五十】爆款一反推就像开盲盒?别让 AI 猜「这是什么片」,先把镜头、人、灯、位置按秒问清楚-元界深掘

问对了,它不该再给你「安静又孤独的午夜」,而该接近这种能指认的话:

镜头在她右后方,中近景,胸口高,平视。
她穿灰色抓绒衣,没看镜头,右脚刚迈进自动门,左手插在口袋里。
门帘外的白光从背后打进来,灯箱在右侧刮过脸颊。
最近处是门框,左侧是冷柜,门上有哈气,远处货架糊掉。

读完你能在店里把她摆回去。摆不回去的,还是作文。

图的核心是站位。视频的核心是先后。四问之后,必须再加第五问。没有这一问,你只是在复刻一张更清楚的海报:

图片[2]-【五十】爆款一反推就像开盲盒?别让 AI 猜「这是什么片」,先把镜头、人、灯、位置按秒问清楚-元界深掘

先钉死站位,再钉死先后。少一样,都还在让它猜。


三、别用一段话概括整条片子,把八秒切成能跑的三截

四问五问都问了,有人会把答案揉成一段超长的话再丢回去生成。模型一看见超长,又开始抓名词。

8 秒不要装下进门、逛街、结账、出门。只装得下:从门口走到冷柜,手碰上玻璃。三截都还在同一条镜头里,不要写成三个景。

三截就这三下:进门被带着走 → 沿着冷柜走、哈气在 → 手碰上玻璃,门还没开。

还空,是三截写成了同一种「她在走」。 又在演戏,是中途加了回头、掏手机、微笑。 店变形、乱切镜,是「生成单镜头」没写死。

只写「走进来拿茶」,等于把两件事叠在同一秒。模型不知道第 1 秒和第 8 秒有什么区别,于是全程都在表演终点:人一出场,瓶子已经在手里。

你要是把「拿茶」写成终点广告,就会变成这样:

她走进便利店,拿起绿茶,满意地看向镜头

常见结果:在冷柜前标准举瓶。没有「刚刚从门口走过来」的痕迹。

改法就一座桥。旧状态先写具体:还在走、手还在口袋。新状态只写结果:手贴上玻璃。瓶还在里面。

  • 还没拿: 进门、空手、在走
  • 桥: 停住、手离开口袋
  • 才碰到: 手贴上玻璃,瓶还在柜子里

再加「拉开门、拧瓶盖、喝一口」,又会变成待办事项。那是下一条的事。

想贴标签的时候,改成眼睛能核对的那一下。一次只改一处:

你想写改成能看见的
走进店里、生活流右肩先入画,镜头在右后方跟着
拿起瓶子、动作自然右手贴上玻璃,瓶还在柜子里
动态运镜、电影光影胸口高度跟着走,灯箱从右侧刮过脸颊,不要绕圈

写完问自己:旁边拍的人听完,能把机器摆到那个位置吗?摆不出的,生成出来多半还是购物清单。


四、把对话模型改成现场检查员,不要让它当你的编剧

分开问是为了手熟。真要拆完一条片子,按顺序装进同一次提问里,只许它填空,不许它写作文。

不要开场就说「你现在是顶级导演」。它一听导演两个字,就开始写影评。你要的是现场跟拍会填的那张表。

目标视频换成你自己的。表没填完,不许写最后那段生成词:

图片[3]-【五十】爆款一反推就像开盲盒?别让 AI 猜「这是什么片」,先把镜头、人、灯、位置按秒问清楚-元界深掘

对:它先交表,你再看生成词。生成词的密度,用第三节那三截就行,不要再写长。 还假,是表跳过了,直接给你一段漂亮中文。 变忙,是 8 秒里写进了进门、拿瓶、结账、出门。

对照原片时,按这个拆,不要先问像不像电影:

  1. 镜头: 是不是一直在右后方跟着,没有绕、没有切
  2. 人: 是不是先走完,手才抬起来
  3. 灯和东西: 灯箱是不是在右侧,哈气是不是在冷柜门上
  4. 终点: 瓶是不是还在柜子里

四样都在,这条才算从点名册变成一段正在发生的事。


五、真要跑通:先把人钉在静帧上,再让这八秒动

拆对了,直接文生视频,仍可能换人、换店、换瓶。视频模型同时要发明长相、货架和动作,它会优先保住「看起来像便利店」,把你写的先后丢掉。

所以先出一张首帧。长相、店、灯,交给这张图。视频提示词里能少写就少写。

首帧:门口,空手

图片[4]-【五十】爆款一反推就像开盲盒?别让 AI 猜「这是什么片」,先把镜头、人、灯、位置按秒问清楚-元界深掘

图过了,再跑图生视频。第三节那三截直接贴,不要在视频里重新介绍她是谁、店在哪。

还假,是静帧里她已经握着茶。 变忙,是又加了拉开门、拧盖、喝一口。 整个人换了,是视频提示词里又把「短发女生灰色抓绒」写了一遍,跟第一帧打架。

走完这两步,你会得到「能看的一段跟拍」,不是剪辑过的爆款原片。这条作业只负责把进门到举手跑对。对上了,再接下一条:拉开门。不要一条里报仇。


这一节怎么用

先问一句:你反推出来的那段词,是一份能摆机位的说明书,还是一份点名册?是点名册,就先别补电影感、再长一点、再专业一点。

  1. 人像店像、一动就假,先删生活流、电影感、动态运镜
  2. 词很长仍像盲盒,检查三处:动作有没有先后,镜头有没有路线,东西有没有左右
  3. 问对话模型时,改成四问加一问:镜头、人、灯、前后;这八秒谁先动
  4. 8 秒只切三截,终点不要写成已经拿在手里
  5. 先出门口空手的静帧,再跑图生视频;视频里只写先后

单人进店拿东西,按这个填:

成片什么样别急着加先改哪一步
店和人都对,像会微微动的海报再有电影感、提示词写长删生活流/运镜;问镜头站哪、这八秒谁先动
人一出场瓶子已在手里动作更丰富先空手走;停住当桥;手才贴上玻璃
镜头乱转,店变形动态运镜、多机位生成单镜头;写死右后方跟着
人突然开口,或切了第二个景旁白、更有故事开头写死:无台词;生成单镜头

再记四句,生成前当验收:

  1. 先问站位,再问先后。 镜头、人、灯、东西四样指不出来,不许写生成词。
  2. 8 秒只走一座桥。 进门到举手已经够了。拿出来、喝一口,是下一条。
  3. 所有动作写出后果。 手贴上玻璃、瓶还在柜子里。只写「拿茶」,模型会发给你终点。
  4. 静帧钉住人货灯,视频只负责动。 底图已经在交点名册,视频里再写电影感,盲盒会更大。

课后只跑这一家便利店。先用开场那句点名册出一条对照;再按四问五问拆一遍;再跑第三节那三截,看手是不是到结尾才抬起来;最后把门口静帧当首帧,视频里把风格词、身份词全部删掉。

看的时候不要先问清不清、像不像爆款。先问:镜头这八秒有没有一条路线。人是不是先走后举手。灯和冷柜有没有各自的位置。瓶有没有提前跳到手上。

句子里还在写电影感、生活流、动态运镜、请给我专业提示词,就删。先让这八秒,从自动门走到一块有哈气的玻璃上。

THE END
喜欢就支持一下吧
点赞12 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容