AI 剧本转分镜:先交出能复核的文字镜头表
最后更新:
把一场戏拆成每镜看什么、发生什么、从什么状态开始,以及把什么状态交给下一镜。
这次实际拿到了什么
2026-09-12 核查的本地证据中,一次 GPT-5.5 文本请求返回了 S01、S02、S03 三条镜头记录,每条都有景别、动作、起始状态、结束状态和中文图像提示词。输入是自有原创短戏,不涉及现成影视剧改写。本页展示的是该文字结果及编辑分析,不是生成后的三张画面。
文字镜头表负责把视觉任务说清楚;绘制的故事板负责呈现画面安排,两者不能只因都叫“分镜”就混用。Adobe 的故事板说明强调用连续画面沟通故事和拍摄选择。本篇先完成可检查的文字层,再让关键帧承接。来源核查日期为 2026-09-12:Adobe 故事板指南。

复测输入:故事与限制条件放在同一次任务里
原始短戏写明雨夜、灰外套、座椅右侧的白信封、背面蓝花,以及追向出口的动作。限制条件不是风格词,而是决定结果是否可用的事实:只出现林安和远处失主,不增加对白,信封从座椅到手中不能倒退。
以下为原始请求内容的可读整理,保留原任务与字段。你可以在支持所选文本模型的客户端或接口中复测;先从模型目录确认当前可用模型,再按接口文档发送。历史成功不保证今天每次输出完全相同,“只输出 JSON”也不能代替解析检查。
把原创短戏拆为3镜,只输出JSON:
{"shots":[{"id":"S01","framing":"","action":"","start_state":"","end_state":"","image_prompt":""}]}
镜号S01-S03,每镜提示词用中文,保留服装、信封、雨夜车站。不要添加情节。
雨夜的小车站,穿灰色外套的林安准备离开。座椅右侧留着一封没有姓名的白色信封。林安停下,拿起信封,看到信封背面画着一朵蓝花。他看见出口处有人正在寻找东西,便握着信封追过去。
约束:人物只出现林安与远处失主;林安的灰色外套不变;信封从座椅到手中不能倒退;不添加对白或额外情节。实际三镜结果:发现、拿起、追赶
下表是原始返回的压缩展示,镜号和动作顺序未改变。S01 交代空间并让林安注意到信封,S02 将信封从座椅转入手中,S03 保持持有状态追向出口。三镜覆盖了原文的主要事件,没有写出原文不存在的归还结局。
注意“主要事件覆盖”不等于镜头已经完全可制作。返回里 S01 提示词提前安排了远处模糊身影,这是视觉调度,需要编辑确认;S02 把拿起和展示背面放在一起,仍要处理翻转动作。保留这些细节,是为了让读者看见真实结果的可用部分和待修订部分。
| 镜号与景别 | 动作 | 起始状态 | 结束状态 |
|---|---|---|---|
| S01 远景,出口与座椅同框 | 准备离开后注意到信封 | 灰外套林安在座椅附近,白信封在右侧 | 林安停在座椅旁,注意到信封 |
| S02 中近景,人物与信封 | 拿起信封,看到背面蓝花 | 信封仍在座椅右侧,林安站在旁边 | 信封在手中,背面蓝花清晰可见 |
| S03 中远景,站内望向出口 | 持信封追向找东西的人 | 林安持有信封,失主在出口处 | 林安朝出口追去,信封仍在手中 |
字段分工:动作过程与关键帧时刻分开写
action 描述一段行为,start_state 和 end_state 描述两个端点,image_prompt 则必须选择一个可画的瞬间。下面 S02 的动作与起止字段来自实际返回;可以据此发现,“正在拿起”与“已展示背面”不一定能在一张静态画面同时表达。
下游需要结束帧时,就在返工单中明确“拿起后,信封背面朝镜头”;需要动作起始帧时,就保持信封仍在座椅上。不要把整个动作段直接当静态图片要求,导致一张图同时出现桌上和手中两个信封。按这个分工拆字段,也便于用 JSON 或表格导出给其他制作者。
{
"id": "S02",
"framing": "中近景,聚焦林安与座椅上的信封",
"action": "林安停下并拿起白色信封,看到信封背面画着一朵蓝花",
"start_state": "白色信封仍位于座椅右侧,林安站在座椅旁,穿着灰色外套",
"end_state": "林安将白色信封握在手中,信封背面的蓝花清晰可见"
}三遍复核:先字段,再事实,最后看能不能接
第一遍检查结构:shots 是数组,镜号唯一且为 S01 到 S03,六个字段没有缺项。第二遍逐条比对原文:林安服装、信封颜色与数量、蓝花所在面、失主位置、结尾动作都要核对。结构正确的 JSON 仍可能漏掉故事信息,不能只检查能否解析。
第三遍只读上一镜结束和下一镜开始。S02 结束是手中持信封,S03 开始就不能回到空手。原始结果的这条流转在文字上吻合,但没指定左右手,也没有规定机位和出口在画面中的方向。ScreenSkills 对场记的说明涉及动作、视线、服装和道具记录,可作为复核维度参考;这里的检查表是本篇对原创样例的整理。来源检索日期为 2026-09-12:ScreenSkills 场记职责。
修订只解决可定位的问题,不整表随机重写
假设制作决定让林安始终用右手拿信封,就新增一个“右手持有”的调度约束,检查 S02 到 S03 两镜,而不是重新生成整场戏。这个右手方案是教学修订,原始三镜返回没有该字段。要保留旧表,让后续同事知道哪些是实测文本,哪些是编辑决定。
另一个待定项是蓝花的可见性。实际 S03 提示词仍要求蓝花可见,但追赶姿态未必允许信封背面对镜头。先确定叙事是否还需要再次展示蓝花;若不需要,允许它被遮挡,但物理上仍在背面。更细的做法见连续性状态演练,不要为了让每镜都“看清线索”牺牲自然动作。
修订性质:编辑拟定,未重新调用模型
基线:三镜实际返回 v1
问题:未指定持信封的手;S03强制蓝花可见可能妨碍动作
制作提案:S02右手拿起,S03右手保持持有
需确认:S03是否必须让蓝花对观众可见
只修改:相关起止状态与单帧提示词
保持:三镜顺序、灰外套、白信封、雨夜车站与追赶结尾
验收:相邻状态衔接;任何新增调度单列交给画面制作者:一镜一任务,附上已确认版本
验收单位是可执行镜头,不是一次返回的行数
接单时写清交付的是文字镜头表,包含多少镜、哪些字段、是否包含手绘或生成图,以及允许几轮结构调整。客户增加一个新人物是需求变更,漏写蓝花则是修正原任务错误。不要用这次返回三行推算任意长剧的产出速度或收益。
记录每轮尝试、人工修订时间、最终确认镜数,费用以实时价格与实际调用记录核对;若没有通过的镜头,就不计算“每个可用镜头成本”。本批没有完成逐项费用关联,因此本页不发布总费用。已实测的结论停留在三镜文字产物,成片、声音和视频链路需要另外取得证据。
常见问题
AI 输出了三镜,为什么还要编辑?
模型可以拆出主要事件,但持物左右手、机位、信封背面何时可见等制作决定仍不完整。编辑需要把可执行细节与原作事实分开确认。
镜头数量越多,效果越好吗?
不一定。每个镜头应有独立叙事任务;增加镜头也增加图像、连续性和剪辑检查。先用最少镜头讲清动作,再按需要增加。
image_prompt 可以直接生成视频吗?
它在本次结果中只是中文图像提示词。视频的动作、时长和连续性需要单独的工具与实测,不能由字段名称推断。
本页配图是三张真实关键帧吗?
不是,配图是依据文字表绘制的教学流程图。真实产物是三镜文字记录,另页展示的一张参考帧也不等同于三镜画面完成。
返回 JSON 有格式错误怎么办?
保存原始响应,先定位是否截断、字段缺失或内容被包在文本中。修复格式后仍要重新核对事实,不要把解析成功当内容验收。