收藏这一条
以后反推不用从零措辞,上传视频,复制即用~
这条是我顺着图片反推那套方法,
把视频拆到镜头、参数和负面提示词之后压出来的。
短视频、广告、Vlog、MV 都能用
指令分两套:
快速版——一键出结果
完整版——逐镜头拆解
一、快速通用版(所有视频都能用)
适合:短视频、产品展示、Vlog 片段、任何你想快速拿到提示词的场景。
请根据上传视频,反推一套完整、可直接使用的 AI 视频生成提示词。
要求:提示词表达无歧义、高度可执行,严禁模糊抽象表述,每一项都必须具体到可视化、可落地。
提示词必须覆盖以下 7 项核心要素:
1. 主体
明确视频核心对象的所有关键细节。
人物:年龄段、性别、种族、体态(身高体型比例)、面部特征(脸型、五官比例、肤质)、发型(长度 / 颜色 / 造型 / 发质)、妆容(眼妆 / 唇色 / 腮红 / 高光)、服装(款式 / 面料 / 颜色 / 图案 / 合身度)、配饰(耳饰 / 项链 / 手表 / 眼镜 / 帽子)、情绪状态与整体气质。
物品:尺寸比例、材质(金属 / 木质 / 塑料 / 玻璃 / 织物)、颜色与饱和度、表面反光特性(镜面 / 哑光 / 磨砂 / 半透明)、结构细节、使用状态(全新 / 磨损 / 运动中)。
场景作为主体时:建筑类型、空间尺度、关键地标或标志性元素。
2. 动作
精准描述主体动态的完整流程:起始姿态 → 运动过程 → 结束姿态。
明确速度节奏(匀速 / 加速 / 减速 / 骤停)与力度变化。
细化手部动作(手指姿态、抓握方式、手势含义)、重心转移轨迹、身体朝向变化。
微表情:眉毛、眼睛、嘴角的细微变化与时间节点。
视线方向:看镜头 / 看画外 / 追踪某物 / 低垂 / 上扬。
多镜头时说明:入镜方式(从画面哪侧 / 如何出现)→ 画面内停留与移动 → 出镜方式。
3. 场景
明确环境背景与空间结构。
室内:房间类型、建筑风格(现代 / 工业 / 中式 / 北欧 / 巴洛克)、空间布局、家具陈设、墙面材质与颜色。
室外:地形地貌、植被类型、天际线、街道或自然环境特征。
前景 / 中景 / 背景的层次关系与纵深感。
时间(清晨 / 正午 / 黄昏 / 深夜)、季节、天气(晴 / 阴 / 雨 / 雪 / 雾 / 风)。
整体氛围关键词(宁静 / 紧张 / 梦幻 / 压迫 / 温馨 / 荒凉)。
4. 光影
指定光线的完整参数。
光线类型:自然光 / 人工光 / 混合光;硬光 / 柔光 / 漫射光。
光源方向:正面光 / 侧光 / 逆光 / 顶光 / 底光 / 伦勃朗光 / 蝴蝶光。
光线强度与柔硬度(硬边阴影 vs 渐变过渡)。
光影对主体的具体影响:面部明暗分割线位置、轮廓高光形状、投射阴影范围与方向、眼神光形状。
反射与折射效果(地面反光、水面倒影、玻璃折射)。
整体色温(暖黄 / 冷蓝 / 中性白)与色温变化趋势。
5. 运镜
说明镜头的完整运动信息。
景别:大远景 / 远景 / 全景 / 中景 / 中近景 / 近景 / 特写 / 大特写。
焦段感受:广角畸变感 / 标准透视 / 长焦压缩感。
构图方式:三分法 / 中心构图 / 对称 / 黄金螺旋 / 引导线 / 框架构图。
镜头运动轨迹:推 / 拉 / 摇 / 移 / 跟拍 / 环绕 / 升降 / 俯拍 / 仰拍 / 手持晃动 / 斯坦尼康稳定。
运动速度与节奏(匀速 / 渐快 / 渐慢 / 突然变速)。
景深控制:大光圈浅景深虚化 / 小光圈全景深 / 焦点转移(从前景到背景)。
屏幕比例:16:9 / 9:16 / 2.39:1 / 1:1。
多镜头时标明切换逻辑(硬切 / 叠化 / 闪白 / 遮罩转场)与时序关系。
6. 风格
定义整体视觉风格与美学调性。
影像风格:电影感 / 纪录片 / 广告大片 / MV / Vlog / 赛博朋克 / 复古胶片 / 日系清新 / 暗黑哥特 / 极简主义。
色彩风格:高饱和 / 低饱和 / 单色调 / 互补色 / 类比色 / 莫兰迪色系 / 霓虹色系。
调色方向:暗部偏青还是偏紫、高光偏暖还是偏冷、中间调倾向。
画面质感:胶片颗粒 / 数码锐利 / 柔焦梦幻 / 高对比硬朗 / 低对比朦胧。
确保人物、场景与光影风格三者统一。
7. 画质
明确技术参数与质量约束。
分辨率:4K / 8K / 1080p。
帧率:24fps 电影感 / 30fps 标准 / 60fps 丝滑 / 120fps 慢动作。
画面质量约束:高细节渲染、抗锯齿、无噪点、无模糊、无畸变、无比例错误、动作自然流畅、皮肤质感真实。
二、完整专业版(逐镜头拆解 + 成品提示词 + 负面提示词)
适合:想精确复刻镜头语言的专业用户,多镜头长视频,广告 / 短剧 / MV 级别的复刻需求。
请全面化身为顶级 AI 视频提示词架构师、电影级镜头语言分析师与多模态视频逆向工程师。
不要只总结视频内容。请严格按照时间顺序,逐镜头完成以下全部拆解:
第一步:逐镜头时间轴拆解
对视频中的每一个镜头,按时间顺序逐一输出以下全部维度。
每个镜头必须包含的 18 个维度:
① 镜头编号与时间码
用 Shot 01 格式标注。
② 主体身份与外观锚点
人物的年龄 / 性别 / 种族 / 体态 / 发型 / 妆容 / 服装 / 配饰 / 情绪,或物品的完整视觉描述(同快速版第 1 项标准)。
③ 动作轨迹
起始姿态 → 运动过程 → 结束姿态,含手部细节、重心变化、力度节奏。
④ 微表情与视线
眉毛 / 眼睛 / 嘴角变化的具体时间节点,视线方向与变化。
⑤ 场景空间
室内外类型、建筑风格、空间布局、关键陈设。
⑥ 前中后景关系
前景元素 → 中景主体 → 背景环境的层次与纵深。
⑦ 景别
大远景 / 远景 / 全景 / 中景 / 中近景 / 近景 / 特写 / 大特写。
⑧ 机位高度与角度
平视 / 俯拍 / 仰拍 / 荷兰角 / 鸟瞰 / 虫眼视角,机位距主体距离。
⑨ 焦段感受
广角(畸变 / 空间延伸)/ 标准 / 长焦(压缩 / 背景虚化)。
⑩ 构图
三分法 / 中心 / 对称 / 黄金比例 / 引导线 / 框架 / 对角线构图。
⑪ 景深
浅景深(虚化程度与范围)/ 深景深 / 焦点转移方向。
⑫ 运镜方式与速度
推 / 拉 / 摇 / 移 / 跟拍 / 环绕 / 升降 / 手持 / 斯坦尼康,匀速 / 加速 / 减速 / 骤停。
⑬ 光线方向与类型
光源方向、硬光 / 柔光、自然光 / 人工光、光比。
⑭ 综合色温与调色
暖 / 冷 / 中性,暗部色调倾向,高光色调倾向。
⑮ 材质与质感
画面中关键材质的视觉表现(金属反光 / 织物纹理 / 皮肤质感 / 液体流动)。
⑯ 节奏
本镜头的时间长度、动作节奏、剪辑节奏感(快 / 慢 / 停顿 / 呼吸感)。
⑰ 转场
与下一镜头的衔接方式(硬切 / 叠化 / 闪白 / 遮罩 / 运动匹配 / 声音桥接)。
⑱ 环境声音与音效
环境底噪、关键音效、音乐节奏与画面的配合关系。
第二步:输出成品生成提示词
基于上述拆解,反推出一套适用于【目标视频模型(如 Sora / Kling / Runway / Vidu / 可灵 / Pika,请指定)】的成品生成提示词。
多镜头提示词格式要求,每个镜头必须分别标注:
1. 起始画面:镜头第一帧的完整视觉描述
2. 人物动作:主体在本镜头内的完整动态过程
3. 摄影机运动:镜头运动的完整轨迹与速度
4. 结束画面:镜头最后一帧的完整视觉描述
5. 镜头衔接:与下一镜头的视觉 / 动作 / 情绪连接方式
第三步:输出负面提示词(防崩指令)
必须附带负面提示词 / 禁止项清单,覆盖以下全部类别:
人物一致性防崩
禁止人物变脸(面部特征在镜头间发生漂移或突变)
禁止肤色不一致(同一人物在不同镜头中肤色明显变化)
禁止发型突变(长度 / 颜色 / 造型在镜头间不连续)
禁止服装漂移(衣服款式 / 颜色 / 图案在镜头间发生变化)
禁止配饰消失或变形(耳环 / 项链 / 眼镜等在镜头间不一致)
肢体与动作防崩
禁止多余手指或缺少手指
禁止手指融合、手指穿模
禁止关节反向弯曲
禁止肢体比例失真(手臂过长 / 腿部过短 / 头身比异常)
禁止动作断裂(动作在帧间出现不连续跳跃)
禁止肢体穿透物体或穿透自身
禁止悬浮(人物脚部未接触地面时不应悬空)
面部与表情防崩
禁止面部扭曲或五官位移
禁止牙齿异常(多排牙 / 牙齿融合 / 牙齿消失)
禁止眼睛异常(大小不一 / 瞳孔方向不同 / 眼白过多)
禁止表情僵硬或表情与情境不匹配
禁止嘴型与语音不同步(如有口型需求)
场景与物理防崩
禁止背景闪烁(背景元素在帧间出现明灭或跳变)
禁止背景元素漂移(建筑 / 树木 / 家具位置在镜头间移动)
禁止物理关系失真(物体悬浮 / 阴影方向矛盾 / 反射不合理 / 重力异常)
禁止透视错误(近大远小关系被破坏)
禁止比例失真(人物与环境的大小关系不合理)
禁止材质突变(同一物体表面材质在帧间发生变化)
画面质量防崩
禁止画面模糊或局部失焦(非刻意景深效果)
禁止噪点过多或色带(banding)
禁止画面撕裂或帧间闪烁
禁止水印、文字伪影、乱码
禁止分辨率不一致(画面局部清晰度不同)
运镜与时间防崩
禁止镜头运动突然跳变(非刻意效果的运镜不连续)
禁止时间流速异常(非刻意的快进 / 卡顿 / 回放)
禁止镜头间光线方向矛盾(上一镜头侧光,下一镜头变顶光)
禁止镜头间色温突变(非刻意的冷暖跳跃)
第四步:核心原则声明
只学习镜头逻辑和视觉方法,不照抄人物、品牌、台词和具体故事。
输出的提示词是对视觉语法的提取,不是对原视频内容的复制。
三、按类型细化的补充指令
在上述通用指令基础上,根据视频类型追加以下专项要求:
人物 / 剧情类视频
每个镜头标注人物情绪弧线(情绪起点 → 变化节点 → 情绪终点)
多人场景标注人物空间关系(站位 / 距离 / 朝向 / 互动方式)
对话场景标注正反打机位切换逻辑与视线交叉关系
标注表演节奏(台词密度 / 停顿 / 沉默的戏剧功能)
产品 / 商业广告类视频
产品每次出现时标注:展示角度、光线打法、材质高光位置、Logo 可见度
标注产品与手 / 环境的交互方式(拿起 / 放下 / 旋转 / 使用演示)
标注节奏与信息密度的关系(快节奏 = 情绪驱动 vs 慢节奏 = 细节展示)
标注字幕 / 标题 / 价格等文字元素的出现时机与动效
风景 / 旅行类视频
标注大气透视层次(近景清晰度 → 中景雾化程度 → 远景朦胧度)
标注自然光的时间变化(日出金光 / 正午硬光 / 黄金时段 / 蓝调时刻)
标注环境声音层次(风声 / 水声 / 鸟鸣 / 远处人声 / 寂静)
标注运镜与地形的配合关系(沿山脊线摇 / 顺河流跟 / 越过山头升降)
音乐 / MV 类视频
标注剪辑点与音乐节拍的对应关系(踩拍 / 反拍 / 连续快切)
标注视觉节奏与音乐段落的对应(前奏 = 慢镜头 / 副歌 = 快切蒙太奇 / 间奏 = 空镜)
标注色彩与情绪的对应变化(暖色 = 欢快段落 / 冷色 = 忧伤段落)
标注特效与音乐的同步关系(bass drop = 闪白 / 旋律上升 = 镜头上升)
美食 / 手工 / 教程类视频
标注俯拍工作台的构图布局(工具 / 材料 / 成品的空间排列)
标注特写镜头的触发逻辑(关键步骤 / 材质变化 / 完成瞬间)
标注手部动作的精确描述(揉 / 切 / 搅 / 倒 / 撒的速度与力度)
标注材质变化过程(面团膨胀 / 酱汁收浓 / 金属焊接发光)
四、输出格式模板
为确保输出结果可直接使用,要求 AI 按以下格式输出:
视频概览
视频总时长:
总镜头数:
整体风格:
主要色调:
目标生成模型:
镜头时间轴
【Shot 01】
景别:
机位:
构图:
主体描述:
动作轨迹:
微表情 / 视线:
场景空间:
前中后景:
焦段 / 景深:
运镜:
光线:
色温 / 调色:
材质质感:
节奏:
环境音:
转场至下一镜头:
(每个镜头重复以上结构)
成品生成提示词
【镜头 01 提示词】
起始画面:
人物动作:
摄影机运动:
结束画面:
镜头衔接:
完整提示词:
(每个镜头重复以上结构)
负面提示词
(输出完整负面提示词清单)
全局风格锚定
整体视觉风格:
色彩体系:
画面质感:
分辨率 / 帧率:
画质约束:
五、怎么用
上传视频 → 复制下方对应指令 → 粘贴给任意多模态 AI(GPT / Claude / Gemini / 豆包等)→ 拿到可直接喂给 Sora / Kling / Runway / Vidu / 可灵 / Pika 的成品提示词。
收藏这条,下次反推视频直接复制粘贴
可以多多转给你那个还在说「帮我反推这个视频」的朋友~