生成“一镜到底”的 AI 动作视频,最容易出问题的往往不是画面质感,而是空间关系、人物一致性和动作衔接。一种更稳定的做法,是先让 ChatGPT Image 2 生成一张 3:1 超宽故事看板,把连续场景中的路线、人物走位、冲突节点和结尾落点全部规划清楚,再将它作为 Seedance 的调度参考图。

下面以“地下停车场追逃”为例,完整整理这套从超宽故事看板到 15 秒连续跟拍视频的工作流。

一、最终效果

这段追逃镜头的动作路线是:电梯冲出 → 察觉异常 → 追逐现身 → 堵截挣脱 → 障碍阻挡 → 冲向出口。

二、为什么要先制作 3:1 超宽故事看板

常规分镜通常把不同镜头拆成多个画格,但“一镜到底”强调的是同一连续空间中的运动。使用超宽横图,可以把多个动作阶段放进同一条空间轴线,提前解决以下问题:

  • 场景路线:明确人物从哪里进入、经过哪些区域、最后从哪里离开。
  • 人物走位:提前区分主角和追逐者的位置、方向及距离。
  • 追逐关系:确认谁在前、谁在后,何时追上以及如何重新拉开距离。
  • 冲突节点:规划抓住、推搡、挣脱、绕车和撞翻障碍等关键动作。
  • 结尾落点:让模型知道镜头最终要落到出口坡道,而不是在中途随机结束。

本例使用的超宽故事看板如下:

地下停车场追逃 3:1 超宽故事看板

三、工作流拆解

  1. 先确定一个能够在连续空间中完成的短剧情。
  2. 把场景路线、人物走位、追逐关系、冲突节点和结尾落点整理为动作链。
  3. 使用 ChatGPT Image 2 生成 3:1 超宽故事看板,可在图中加入箭头、文字和时间线,帮助模型表达调度关系。
  4. 将故事看板作为视频生成参考图,并在视频提示词中明确:图中的标记只用于理解调度,成片中必须全部移除。
  5. 用 Seedance 生成横版 15 秒视频,强调连续跟拍、不切镜头、不跳剪。

本例的完整空间路线为:

电梯区 → 柱子区 → 黑色轿车旁 → 杂物区 → 出口坡道

完整动作链为:

主角从电梯冲出 → 追逐者从另一部电梯或消防通道冲出 → 柱子旁抓住主角并发生推搡碰撞 → 主角挣脱后绕过黑色轿车 → 冲进杂物区撞翻清洁推车和路锥 → 追逐者被障碍绊住 → 主角冲向出口坡道。

四、Seedance 完整提示词

参考图仅用于场景调度、人物关系和动作节奏参考。最终视频中不要出现任何文字、箭头、圈线、时间线或手绘标记,画面必须是干净的电影镜头。

生成一段 15 秒写实电影感地下停车场追逃动作短视频,横版,一镜到底,连续跟拍,不要切镜头,不要跳剪。

场景为现代地下停车场,冷白顶灯,灰色水泥柱,少量车辆,地面反光,远处出口坡道有强光。空间路线清楚:

电梯区 → 柱子区 → 黑色轿车旁 → 杂物区 → 出口坡道。

从始至终只有两个人:主角是黑衣背包年轻男性;追逐者是棕色或卡其色外套的高大中年男性。

两人长相、体型、服装必须明显不同。不要出现第三个人,不要出现分身、复制人、路人或穿帮人物。

动作链条:主角从电梯冲出 → 追逐者从另一部电梯或消防通道冲出 → 柱子旁抓住主角并发生推搡碰撞 → 主角挣脱后绕过黑色轿车 → 冲进杂物区撞翻清洁推车和路锥 → 追逐者被障碍绊住 → 主角冲向出口坡道。

声音氛围:脚步回声、喘息声、阻喝声、撞柱声、撞车声、推车翻倒声、杂物散落声。

画面风格:写实电影感、地下停车场压迫感、动作连贯、人物一致、空间连续。

五、根据完整提示词生成的成片

六、提高稳定性的关键细节

  • 参考图负责调度,不负责最终视觉元素:箭头、文字和时间线可以帮助规划,但提示词中必须明确要求成片去除。
  • 限制人物数量:明确从始至终只有两个人,并写清服装、年龄、体型差异,可减少分身和路人。
  • 动作必须形成因果链:每个节点都要自然触发下一个节点,避免只罗列互不相关的动作。
  • 空间区域要可识别:电梯、柱子、轿车、杂物区和出口坡道都是清晰的视觉锚点。
  • 镜头语言要写具体:使用“一镜到底、连续跟拍、不切镜头、不跳剪”,比只写“电影感”更容易控制结构。
  • 音效也要进入提示词:脚步、喘息、碰撞和杂物散落声能够增强动作节奏与现场感。

七、可复用的通用公式

这套方法不仅适合停车场追逃,也可以迁移到走廊逃生、仓库潜入、街巷追逐、展厅盗窃或科幻基地穿越等连续空间剧情:

确定连续空间 → 设计人物路线 → 标出冲突节点 → 生成超宽故事看板 → 清理成片限制 → 编写连续动作链 → 生成一镜到底视频。

真正决定连续性的,不只是模型能力,而是生成前是否把空间、人物和动作关系规划清楚。先用一张超宽故事看板解决“怎么走、在哪里发生、下一步做什么”,再让视频模型负责运动和质感,通常会比直接从一段长提示词开始更加稳定。