FlyAIgh
Home/术语表

AI 视频与分镜术语表

用大白话解释 AI 视频和分镜生成背后的术语——从分镜、镜头清单,到任何现代工具里都会遇到的生成模式(t2v、i2v、r2v)。

分镜与前期

分镜(Storyboard)
一串有序的镜头——每个用画面或文字标出构图和动作——让你在开拍前就「看见」整部片子。在 AI 流程里,每一格往往还带着用来生成它的提示词。
镜头清单(Shot list)
一场戏里每个镜头的结构化文字拆解:镜头编号、景别(大全景/中景/特写)、机位、运动、主体和时长。镜头清单是分镜的「表格版」。
动态分镜(Animatic)
把分镜画面按时间排成的幻灯片,常配粗剪声音,用来在还没有任何成片素材前检验节奏。它是静帧的播放,不是生成的视频。
故事梗概(Logline)
用一句话概括一个故事:主角、目标、阻碍和利害关系。后面一切创意决定都拿它来衡量。
故事大纲(Treatment)
整个故事的散文式摘要——通常一到两页、不含对白——在写剧本之前完成,好让结构问题能低成本地改掉。
剧本(Screenplay)
一部片子的成型脚本:场景标题、动作和对白。在 AI 分镜流程里,剧本先锁定,再拆成一个个镜头。
定场镜头
通常用在一场戏开头的大全景,交代地点和空间关系,让观众先知道「这是哪儿」,再收紧到具体动作。
剪切(Cut)
从一个镜头到下一个镜头的切换。规划好镜头之间的剪切,才能让分镜读起来像连续的运动,而不是一堆互不相干的画面。

AI 生成模式

文生视频(t2v)
直接用文字提示词生成视频片段,不需要输入图片。
图生视频(i2v)
让一张静态图动起来:你给一张起始帧,模型据此生成运动。
参考图生视频(r2v)
用参考输入(定义角色、风格或主体)生成视频,而不指定严格的首帧。在多模态模型上,参考不仅可以是图片,还可以是参考视频和参考音频(见「视频转视频」)。
首尾帧(firstlast)
同时给出起始图和结束图,模型生成把两者连起来的中间运动。
文生图(t2i)
用文字提示词生成一张静态图。
图生图(i2i)
用提示词编辑或改造一张已有图片,同时保留其核心内容——常用于换装、改表情、清理参考图。

AI 视频概念

角色一致性
让一个角色在多个镜头和多次生成里始终是同一个人——同一张脸、同一身造型、同一副身形——做法是把身份参考图和人设绑定到一个可复用的角色上,而不是每条提示词里重新描述。
视频提示词
发给视频模型用来生成一个镜头的结构化描述——通常包括首帧、镜头中的运动、落点——外加参考图和风格。
多模型平台
在一个账号里就能调用多个 AI 模型(如 Sora 2、Kling、Seedance、VEO)的平台,于是你能把每个镜头交给最合适的模型,而不必被锁死在一个引擎上。
帧衔接(Frame chaining)
把上一个镜头的尾帧作为下一个镜头的首帧,让连续动作跨剪切仍然连贯。
超分辨率放大(Upscaling)
把一张图或一段视频的像素分辨率拉高——比如 1080p 放大到 4K——同时由 AI 模型重建出合理的细节(边缘、纹理),而不只是把像素硬拉伸。常见用法:先用较低分辨率把 AI 生成的画面便宜地跑出来,再放大收尾。FlyAIgh 的 Upscaler 跑在 Topaz Labs API 上。

视频转视频与参考

视频转视频(v2v)
用一段已有的视频来引导生成一段新视频,而不只靠文字。参考片可以驱动新生成的风格、运镜或主体。在现代多模态模型上,做法是把源片当作参考视频连同提示词一起传入——而不是把原片逐帧重绘。
风格迁移(Style transfer)
把一段媒体的视觉美学——配色、年代感、动画风格——搬到新内容上。在 AI 视频里,风格迁移是最常见的视频转视频任务之一(比如把实拍变成动漫)。
参考视频(Reference video)
作为输入提供、用来引导生成的一段视频——它的质感、运镜或运动会被带进新输出。它和首帧不同:参考视频是「导演信号」,不是字面意义上的起始画面。
参考音频(Reference audio)
作为输入提供的一段音轨,让生成的视频跟着它走或把它融进去——用于以音乐为主或音画同步的生成。像 Seedance 2.0 这类多模态模型,能在参考图和参考视频之外再接受参考音频。

剪辑与衔接

匹配剪辑(Match cut)
一种剪切:上一镜里的某个形状、运动或构图延续到下一镜,让转场显得刻意而连贯。是生硬、毫无关联的硬切的反面。
J-cut 与 L-cut
声音和画面在不同时刻切换的剪辑。J-cut 里,下一镜的声音先于画面进来;L-cut 里,上一镜的声音延续进下一镜。两者都让镜头之间的接缝更顺。
跳切(Jump cut)
在同一主体、只有细微差别的两个镜头之间剪切,制造时间或位置上刻意的「跳跃」。用来制造节奏或压缩时间;当目标是「看不见的连贯」时会避免使用。
180 度轴线法则
一条连贯性准则:把摄影机始终保持在两个主体之间那条假想线的同一侧,让他们的左右位置在剪切之间保持一致。越过轴线会让观众迷失方向。

镜头语言(景别与运镜)

远景(大全景)
把主体放在完整环境里的镜头,交代整个场景和各人所处的位置。在 AI 视频里它是定场的一拍——先生成它锁住空间关系,再切到更近的镜头。
中景
大致从腰部以上取景一个人——近到能看清表情,又宽到能看到肢体动作。对白戏的主力镜头。
特写
用单个主体(通常是脸)填满画面,承载情绪或细节。在 AI 视频里,特写最考验角色一致性,因为脸占得大。
横摇(Pan)
摄影机在固定点上水平转动,向左或向右扫过场景。在 AI 视频提示词里要写「镜头向左/右摇」,而不是去移动主体。
纵摇(Tilt)
摄影机在固定点上垂直转动,向上或向下倾——用来展现高度或跟随主体起身。横摇的纵向版本。
推轨镜头(Dolly)
整台摄影机沿轨道朝主体推近或拉远、改变透视的镜头(不同于只放大的变焦)。「推近」积累张力,「拉远」交代环境。
跟拍(移动镜头)
摄影机跟在移动主体的旁边或后面,让它始终留在画面里。也叫移动镜头或跟随镜头——AI 视频动态运镜提示词的主心骨。
变焦(Zoom)
改变镜头焦距来放大或拉宽视野,而不移动摄影机。变焦压缩空间,推轨改变空间——即使取景一样,两者看起来也不同。
仰角镜头
从主体下方仰拍的镜头,让主体显得有力、高大或具压迫感。俯角镜头的反面。
俯角镜头
从主体上方俯拍的镜头,往往让主体显得渺小、脆弱或被审视。
斜角镜头(Dutch angle)
摄影机倾斜、让地平线呈对角线的镜头,制造不安、紧张或失衡感。也叫倾斜镜头。
过肩镜头
从一个人肩膀后方望向另一个人的取景,把对话锚定在空间里。双人对白的标准机位,也是 180 度轴线法则保持视线一致的地方。