AI分镜脚本怎么写?零门槛保姆级教程

2026-08-31阅读使用教程
AI分镜脚本怎么写?零门槛保姆级教程

每次打开剪映或相册,看到别人用AI做出那种画面丝滑、剧情在线的小短片,自己脑子里也有故事,可一到写分镜脚本就卡壳:不知道一个镜头该写多细、不知道怎么转场、更不知道AI能不能听懂自己的描述。其实这事儿没你想的那么复杂,甚至只需要一部手机或电脑、打开浏览器就能开始,今天我就用最笨的方法,带你从零写出第一条能直接喂给AI的分镜脚本。

配图

第一步:先别想画面,用一句话说清你的故事

新手最容易犯的错,就是一上来就想“第一个镜头拍什么”。分镜脚本不是导演日记,它是给AI看的说明书。所以先逼自己用一句话概括故事:谁,在什么地方,想做什么,遇到了什么阻碍。比如“一只橘猫在雨夜想进便利店取暖,但自动门坏了”。这句话就是你的故事核,后面所有分镜都围绕它展开。

写这句话的时候,别追求文艺,越土越好。因为AI理解的是明确信息,不是朦胧诗。你写“一个孤独的身影在都市游荡”,AI大概率给你生成一个鬼片现场;你写“穿黄色雨衣的小女孩,在傍晚的胡同里踢皮球”,AI立刻知道该画什么、用什么光线、什么氛围。记住:你给AI的信息颗粒度,决定了它还给你的画面精度。

第二步:把故事拆成“动作片段”,每个片段就是一个镜头

有了故事核,接下来把它像切西瓜一样切块。切换标准不是时间,而是“动作变了”就切一刀。还是那只猫:镜头1,猫站在雨里,浑身湿透,看着玻璃门里的关东煮;镜头2,门自动开了条缝,又关上;镜头3,猫用爪子扒门,门纹丝不动;镜头4,一个店员注意到它,从里面手动推开了门。这样四个镜头,故事就完整了。

注意,每个镜头只写一个动作。别在一个镜头里写“猫先看门,再回头,又舔爪子”——AI会把三个动作揉成一团乱麻。你可以在脚本里给每个镜头编号,比如“01全-猫湿透站在门口”,格式无所谓,关键是动作单一、画面清晰。

第三步:给每个镜头加“AI看得懂”的视觉描述

这一步是分镜脚本的核心,也是新手最容易“说人话说到一半”的地方。你需要从四个维度去喂AI:

- 景别:远全中近特,写清楚“特写猫的眼睛”“全景便利店门口”,AI才能决定取景范围。

- 环境:不是“便利店”,而是“深夜,霓虹灯下,玻璃上全是水汽的24小时便利店”,环境越具体,AI生成的背景越不跑偏。

- 动作/状态:“猫的胡须在滴水”“尾巴垂在地上”,这些细节让画面活起来。

- 情绪/氛围:“暖黄色灯光从门缝漏出来,照在猫脸上”,一句话,AI就能理解你要的冷暖对比和情绪基调。

把四个维度写成一行,像这样:“特写,橘猫脸贴玻璃,胡须滴水,暖光从门缝照在脸上,瞳孔放大”。如果怕AI漏信息,就多写一行递进描述,但千万别用“唯美”“好看”这种抽象词,AI只会给你个磨皮滤镜。

第四步:告诉AI镜头怎么动、怎么转场

AI虽然能直接生成视频,但如果你不给它运镜指令,它默认就是“固定机位”的PPT放映。所以每个镜头后,加一个括号写运镜:比如(镜头缓慢推近)(从上往下摇)(快速急推)。转场也可以写,比如“#硬切”“#叠化”“#从猫的眼部特写淡出”。这些词AI听得懂,尤其是“图生视频”和“AI视频生成”功能,你给的这些指令,能让它理解前后镜头的关系。

这里分享一个偷懒技巧:如果你用AI智能分镜工具,可以直接在输入框粘贴这种带编号的脚本,很多工具会自动识别“景别+运镜+描述”的结构,帮你生成分镜图。你只需要把文字写成上面那种格式,AI就能读懂。

第五步:找参考图,用“图生视频”让镜头动起来

脚本写完后,别急着直接生成。先让AI根据你的分镜描述出几张关键帧图。比如镜头1和镜头4,生成两张图,看看环境、猫的长相是否统一。如果不统一,你就在脚本里加一句“橘猫,橙色虎斑纹,白色爪子”,AI就会纠正。

有了满意的静态图,再用“图生视频”功能,把图喂进去,配上你写的运镜和动作,AI就能生成一段2-4秒的动态镜头。把几个镜头按顺序拼接,一个完整的AI短片就出来了。这个过程里,你会发现脚本写得越清楚,AI生成的画面越接近你的脑内小剧场。

---

如果你正在找一款能覆盖“生图 + 生视频”的工具,可以关注下 Losss(losss.cn)。它是一个AI 视觉创作平台,聚合多款热门模型,提供文生图、图生图、文生视频、图生视频,以及局部重绘、智能扩图、AI 换装、老照片复活等丰富玩法,覆盖电商设计、建筑室内、AI 写真、创意风格化等全场景。 在 Losss 直接完成从创意到成品的全流程。

---

避坑指南:三个新手最容易踩的坑

坑一:脚本里全是情绪词,没有具体指令。 你写“悲伤的气氛”,AI不知道那是什么。要写“低下头,肩膀微微颤抖,背景是灰蓝色的天空”,AI才能生成你想要的画面。记住,AI不懂“悲伤”,只懂“行为+颜色+光线”。

坑二:一个镜头里塞两个动作。 “她推门走进来,然后脱掉外套,坐在沙发上”——这看着像一句话,其实是三个镜头。AI会给你画出一个人同时在做三件事的诡异画面。解决方法:把一个镜头拆成三个动作,哪怕每个镜头只有半秒。

坑三:直接生成视频,跳过图片验证。 脚本再好,AI也可能把猫画成狗。先出静态图,确认每个镜头的角色、环境、风格一致,再图生视频。不然你先花半小时生成了视频,发现主角落伍了,只能重来。

写AI分镜脚本,本质是“把人类大脑里的画面,翻译成AI能读懂的语言”。你已经会讲故事,只是还没学会翻译的语法。今天这套方法,哪怕你只写一个镜头,也能明显感觉到AI的反馈更准确了。别等工具,万事开头难,先打开网页,写下你的“第一句故事核”,剩下的事AI会陪你慢慢搞定。