三招打破AI短剧的“PPT感”:一个野路子导演的实战笔记你好,我是小序。
前几篇教程之后,我收到最多的问题不是“角色怎么统一”,也不是“场景怎么锁定”。
而是一句特别笼统、但特别真实的话:
“我的短剧看起来像PPT。”
说实话,这个问题挺难回答的。因为“像PPT”不是某一个环节出了问题,而是整条流水线上缺少了一个角色——导演。
我们大部分人在用AI做短剧的时候,把自己当成“编剧+操作员”——写完剧本,填完提示词,点击生成,完事。
但专业剧组里,编剧写完剧本之后,还有一个关键角色叫导演。导演不写剧本,不做后期,他只做一件事:决定“观众的眼睛往哪看”。
你有没有发现,同样的剧本、同样的角色、同样的场景,不同导演拍出来完全不一样?区别就在于——有人只是把画面拍出来了,有人知道观众的眼睛应该往哪看、怎么看、看完什么感觉。
这篇不讲理论,讲三个我实操里摸索出来的野路子技巧。不高级,但管用。
技巧一:把镜头当成“偷窥者”
先问你一个问题:你拍两个人对话,镜头放哪?
大部分人会说:放正面啊,两个人轮流拍。
对,也没错。但你的画面就“平”了。因为观众在看一个“我正大光明地看他们在说话”的画面。
我后来换了一个思路:镜头不是摆在现场的摄像机,而是一个躲在角落的偷窥者。镜头出现在某个位置,是有原因的——有人在这个位置看,或者有人不希望被看到。
举个例子。
A和B在天台谈判。正面拍两个人,是中景,情绪到位,逻辑也对——但画面没有层次。
换成“偷窥者”视角:镜头藏在天台门缝后面,门只开了一条缝,画面里先看到门的边缘,然后透过门缝看到A和B在远处对话。因为距离远,观众看不清他们的表情,只能看到动作和姿态——反而更想知道他们在说什么。
这就是“偷窥者”视角。它给观众一个心理暗示:你正在偷偷看一个你不该看的场景。 这种“偷窥感”天然比“正大光明地拍”更有张力。
我的习惯操作是:在分镜描述里,先不问“这个镜头要展示什么”,而是问“谁会想看这个画面,他藏在哪”。把“藏在哪”写进提示词,镜头就有了“位置感”。
GPT Image 2分镜描述示例:
“全景,镜头在右侧门缝后方,门框占据画面左边缘5%,透过门缝看到[角色名]在[场景]中[动作]。构图强调窥视感,观众和门后的人共享同一个观察位置。”
技巧二:在过渡段落“杀人”
很多AI短剧像PPT,不是因为正片拍得不好,是因为过渡段落没人在意。
什么叫过渡段落?角色从A点走到B点的过程、从坐着到站起来的过程、从说完一句话到说下一句话之间的空隙。新手习惯用全景一拍到底,观众看到的就是一个“移动的人体”,没信息、没情绪,就想快进。
我后来养成一个习惯:在有台词的段落里,我老老实实拍人物;但在过渡段落里,我不拍人,我拍别的。
比如一场戏:“男主听完电话,从办公室走到会议室。”
标准拍法是:近景拍他挂电话,中景拍他站起来,全景拍他走出门,再中景拍他走进会议室——四五个镜头,全是人。观众看的就是一个“有人在走路”。
我的拍法是:
镜头1:近景,挂电话的手,手指用力按掉通话键(特写手,不露脸)
镜头2:中景,门被推开,画面里没人(拍门,不拍人)
镜头3:全景,走廊尽头的会议室门开着,里面已经有灯光(拍空走廊,不拍人)
三个镜头结束。观众在“没人”的画面里完成了“他在移动”的认知,而且因为他们没看到人,反而会想“他现在什么表情”——这个“想知道”的状态,比直接看到更有张力。
这就是所谓的“空镜叙事”——在没有对白和主要角色出现的段落里,用环境镜头代替人物镜头,让观众的注意力从“看脸”切换到“感受氛围”。
我的习惯是:写分镜的时候,把过渡段落的“人脸镜头”全部删掉,换成环境特写和暗示性镜头,然后看看剧情是不是依然完整——如果完整,说明这些镜头比人脸更有信息量。
GPT Image 2分镜描述示例:
“特写,空镜,桌面上的手机屏幕亮起,来电显示‘未知号码’,屏幕光在黑暗中照亮了旁边的一支笔。无人物,无对白。暗示角色已经离开,留下正在响铃的手机。”
技巧三:用画面边缘讲故事
大部分人填提示词的时候,只填“画面中央有什么”。
于是所有信息都挤在画面中间,四周是空的。观众一眼看完,没有“探索”的乐趣。
专业导演很会用画面边缘——边缘的信息不是主体,但它告诉你主体正在经历什么。
比如拍一个人坐在咖啡馆等人。
中央是你填的主体:“男主坐在窗边,看着窗外。”
如果只写这一句,画面就只拍了男主。但如果你在画面边缘加一些信息呢?
画面左下角:一杯已经喝了一半的水,杯壁没有水珠(说明放了很久)
画面右上角:窗外的天色从亮变暗(说明等待时间很长)
桌面边缘:手机屏幕朝下放着(说明他在刻意不看手机)
这些细节不用占据画面中央,甚至不需要观众第一眼就看到。但它们存在,观众就会在潜意识里“读”到——这个人在等一个人,等了很久,他不想看手机确认对方有没有发消息来。
边缘信息不叙事,它“暗示”叙事。 这种暗示比正面交代更有力量,因为它让观众自己拼出了“他在等人”的结论——观众自己拼出来的,比直接告诉他的,更有沉浸感。
我的习惯操作是:在生成故事板之前,先想好每个镜头的“边缘信息”——画面左右边缘和角落应该有什么东西。然后在提示词里明确写道:“画面左下角有X,右上角有Y,中央是Z。”不需要每格都填满,每2-3格加1个边缘细节就行。
GPT Image 2分镜描述示例:
“近景,[角色名]坐在窗边低头看手机。画面左下角:喝了一半的咖啡杯,杯壁无水珠,说明放了很久。画面右上角:窗外天色已暗,路灯刚亮。中央:手机屏幕亮度照亮[角色名]的侧脸。”
写在最后
这三个技巧都不是“AI操作技巧”——它们不需要你换工具、改参数、学新提示词格式。
它们只需要你换一个思路:
AI不缺生产力。缺的是一个会用画面说话的人。
这三个技巧,是我自己在实操里摸出来的。不是什么大师理论,就是反复试错之后的总结。不一定全对,但管用。
📌 后台回复「导演」,领取这三个技巧的GPT Image 2提示词模板,可以直接套用。
你在做短剧时有没有发现过什么“野路子”技巧?评论区聊两句——我也想学。
👇 点个「在看」,让更多创作者扔掉PPT感。
我是小序,下期见。