提示词从画面中读取了什么
画面帧按时间顺序采样,因此工具可以对它们进行比较:主体在各帧之间缩小意味着镜头在后拉,地平线倾斜意味着这是手持运镜,光源扫过面部则意味着有车驶过或人物转头。它会说明镜头大小、机位高度与角度、主体的动作及其变化过程、场景、时间与天气、光线的方向与质感,以及画面的色调与风格特征。
随后,它会以“动态”的方式写出提示词——每一句话都在说明什么在运动,包括镜头本身。风格会被保留而非“升级”:粗颗粒的手机拍摄画面依然会保持粗颗粒质感,除非你另有要求,因为这通常正是提取提示词的意义所在。
图生视频提示词:让静态图片动起来
只有一张图片时,并没有真实的动作可供读取,因此工具会根据画面推断出一个合理的动作:人像会得到缓慢推近镜头与一个细微手势,产品会得到环绕镜头与一个运动元素,风景则会得到镜头漂移与天气变化。你的指令会覆盖这一切——“她抬头微笑”或“镜头静止,只有水在动”这样的句子,才能让图生视频提示词真正属于你。
提示词会保留图片已经确定的内容。主体、构图、光线与色调都会被详细描述,以确保视频模型生成的第一帧与你的图片相符——这正是 Sora、Veo、Kling 和 Runway 的图生视频模式忠实还原参考图所需要的。
COMMON QUESTIONS
Video to prompt FAQ
什么是视频转提示词生成器?
它会读取一段短视频或一张静态图片,写出能在 AI 视频生成器中重现该镜头的文字提示词。提示词会描述画面中的动态:主体的动作、镜头运动、光线、节奏与时长,并采用 Sora、Veo、Kling 或 Runway 最易读取的格式。
如何从视频中提取提示词?
上传一段最长60秒的 MP4、WebM 或 MOV 视频。浏览器会在片段中采样四帧画面并发送分析,视频文件本身不会离开你的设备。选择视频模型与目标时长,添加可选的额外说明,然后点击“生成”。如果视频较长,请先剪辑出你想要提取提示词的那一个镜头。
可以改用图片生成视频提示词吗?
可以。添加一张图片,工具会写出图生视频提示词:它会保留图片的主体、构图、光线与风格,并补充视频模型为使其动起来所需的动作、镜头运动与时间节点。这正是 Sora、Veo、Kling 与 Runway 图生视频模式所需要的输入。
它能生成 Sora 2 的提示词吗?
可以。选择 Sora 2 后,提示词会以简洁散文体写出;如果动作包含多个节点,还会附上带秒数标注的简短分镜表,并以一行音效说明结尾,因为 Sora 2 会生成同步声音。
Veo 3、Kling 与 Runway 呢?
每个模型都有各自的选项。Veo 3 会得到一段带音效说明的电影感段落;Kling 会得到按主体、动作、场景、镜头、光线顺序排列的紧凑提示词;Runway Gen-4 会得到一段以 Runway 自身镜头运动词汇开头的简短提示词。选择“通用模式”则能得到适用于多种模型的提示词。
它能还原一段 AI 视频背后的确切提示词吗?
没有任何工具能从一段成品视频中读出其隐藏的原始提示词。它所做的,是足够精确地描述画面中可见的动作、镜头、光线与风格,使得再次运行该提示词能产生同类型的镜头。
视频转提示词工具是免费的吗?
在每日免费额度内,你无需注册账号即可试用。付费方案下,每次运行消耗2个积分,因为它需要读取多帧画面,并写出比图片工具更长的提示词。
支持哪些视频文件格式?
支持60MB、60秒以内的 MP4、WebM 和 MOV 视频,以及 JPG、PNG 和 WEBP 图片。由于画面帧是在你的浏览器中读取的,非常老旧的浏览器可能无法支持所有编码格式;如果视频加载失败,请将其导出为 MP4(H.264)格式后再试。