拆原文之前,先定义改编目标
先确定成片形式、画幅、时长、目标观众、制作方式,以及这一集必须兑现的戏剧承诺。45 秒竖屏钩子、两分钟漫剧场次和概念预告片需要完全不同的结构。把内容边界写成一句话,后续所有取舍都能回到同一个目标上检查。
从原文中提取会影响镜头的信息
分别整理主事件、人物目标与关系、可见动作、地点、时间变化、情绪转折、对白、旁白和重要道具。不要试图把每句话都画出来。内心解释可以转成旁白、人物反应、象征性特写,也可以在动作已经足够明确时被省略。这一步建立的是分镜必须保留的事实层。
按剧情状态变化划分场次,而不是照抄自然段
一个场次应有相对稳定的时间与地点、明确的戏剧问题,并在结束时产生有意义的状态变化。标出新空间建立、人物控制权转移、新信息改变决定,或情绪方向反转的位置。先按场次工作,可以避免分镜变成一长串彼此脱节的图片说明。
先画情节节拍,再写单个镜头
把每个节拍概括为铺垫、施压、选择、结果或转场,给出大致时长,并记录观众进入下一段前必须知道的信息。场次对制作来说太宽,镜头对结构检查又太细,节拍正好承担中间层。先在这里修复缺少升级或结尾无力的问题,避免镜头数量增长后再推翻。
把节拍转成可执行镜头
为每个镜头确定标题、目的、可见动作、对白或旁白、时长、景别、角度、运镜和转场上下文。只描述能够被看见或听见的内容,把“极度孤独”之类文学表达换成可观察证据:构图距离、无人回应的动作、空旷前景或持续停留的反应。另一位创作者应能无需猜测就完成这一镜。
在镜头表旁建立连续性资产库
为角色、场景和关键道具建立可复用记录,并把永久身份规则与单镜头表演要求分开。角色资产负责年龄、面部结构、轮廓、服装锚点和禁止变化;具体镜头负责姿势、情绪、视线和临时状态。只有当中性参考图能降低多个镜头的不确定性时,才值得生成并确认。
从已确认的决策编译图片与视频提示词
图片提示词应组合已确认的资产规则、当前镜头的构图、光线、可见动作和排除项;视频提示词则要强调时间行为:起始状态、动作路径、摄影机运动、环境动态和结束状态。两类提示词都应从同一条镜头记录编译,避免文字、静帧和动态各自发展成互相冲突的版本。
选择性生成,并回到序列检查
不要因为模型能够生成,就把所有候选画面都做出来。优先生成建立空间的镜头、身份关键出场、复杂空间动作,以及团队确实需要视觉决策的镜头。审片时不仅看大图,还要回到连续性轨道。单帧再漂亮,只要破坏方向、节奏或角色连续性,仍然需要修改。
导出一套相互连接的制作资料
最终交付应使用稳定的镜号和资产名称,把镜头表、时长、对白、动作、提示词、连续性规则和已确认图片连接在一起。为工具导出结构化数据,为人员导出易读审片文档,并在需要时附上原始媒体。只有下一位执行者无需从零散聊天记录中重建上下文,这套流程才真正完成。


