视频转提示词

视频转提示词

上传一段短片或一张图片,获取适用于 Sora、Veo、Kling 或 Runway 的视频提示词:镜头、运动、光线与节奏。

添加一段短片,系统会在你的浏览器本地采样四帧画面——视频本身不会离开你的设备。你也可以添加单张图片来获取图生视频提示词。

或使用图片链接
请使用可直接访问的公开图片链接。
消耗 1 点数
你的结果
See what you can makeExplore an example while you get started.
Portrait on a rainy Kyoto train platform
IMAGE TO VIDEO PROMPT · SORA 2

Slow push-in on a woman holding a transparent umbrella on a rain-washed Kyoto platform at blue hour. Rain streaks the frame; she turns her head toward an arriving train whose warm headlights sweep across wet paving. 0–4s: static medium shot, rain and steam drifting. 4–8s: the camera eases forward as the train enters from the right. Audio: soft rain, distant announcement chime, train brakes.

EXAMPLE WORKFLOW

从一帧画面到一段 运动镜头。

静态图片和视频片段都能转化为视频提示词,说清楚画面中发生了什么、镜头如何运动,以及这个镜头会持续多久。

视觉参考在京都雨中站台上撑着透明伞的女子
AI result

缓慢推近镜头,拍摄一位身穿苔绿色羊毛大衣、在蓝调时刻的京都雨湿站台上撑着透明伞的女子。0–3秒:静态中景,雨丝划过画面,湿润地面倒映着珊瑚色灯笼的光。3–8秒:镜头缓缓向前推进,一列火车从右侧驶入,温暖的车头灯光扫过她的脸庞,她转头望向火车。冷色环境光与暖色实用光源形成对比,35毫米胶片质感,安静的电影氛围。音效:持续的雨声、远处站台的报站铃声,以及火车刹车的嘶嘶声。

图生视频提示词 · SORA 2

让一张静态人像动起来。

图片提供了主体、光线与氛围,提示词则补上 Sora 所需的运镜、动作与时间节点。

Read result

缓慢推近镜头,拍摄一位身穿苔绿色羊毛大衣、在蓝调时刻的京都雨湿站台上撑着透明伞的女子。0–3秒:静态中景,雨丝划过画面,湿润地面倒映着珊瑚色灯笼的光。3–8秒:镜头缓缓向前推进,一列火车从右侧驶入,温暖的车头灯光扫过她的脸庞,她转头望向火车。冷色环境光与暖色实用光源形成对比,35毫米胶片质感,安静的电影氛围。音效:持续的雨声、远处站台的报站铃声,以及火车刹车的嘶嘶声。

试用 Video to Prompt
视觉参考钴蓝色台座上的琥珀色香水瓶
AI result

镜头以微距镜头的浅景深效果,围绕放置在湿润钴蓝色台座上的半透明琥珀色香水瓶缓慢环绕180度。随着镜头旋转,柔光箱的高光在玻璃瓶身与象牙色瓶盖上流动;一条浅色纸质丝带在微风中轻轻扬起后落下;台座表面泛起细微的涟漪。深钴蓝背景,玻璃与绸缎质感,静谧奢华。音效:低沉柔和的工作室环境音,伴随一声轻柔的水滴声。

图生视频提示词 · VEO 3

把产品照片变成环绕镜头。

当提示词写明环绕方式、光线变化以及场景中唯一的一处细微动作时,产品静态图就能变成简短的主打视频。

Read result

镜头以微距镜头的浅景深效果,围绕放置在湿润钴蓝色台座上的半透明琥珀色香水瓶缓慢环绕180度。随着镜头旋转,柔光箱的高光在玻璃瓶身与象牙色瓶盖上流动;一条浅色纸质丝带在微风中轻轻扬起后落下;台座表面泛起细微的涟漪。深钴蓝背景,玻璃与绸缎质感,静谧奢华。音效:低沉柔和的工作室环境音,伴随一声轻柔的水滴声。

试用 Video to Prompt
采样视频帧一只驮着天文台的巨龟穿过月光下的草地(4帧)
AI result

一只驮着小型黄铜木质天文台的巨龟,缓缓穿过月光下野花盛开的草地;它经过时花朵随风摇曳,天文台的窗户里透出跳动的暖光。远景镜头,缓慢跟拍,速度与巨龟的步伐一致。手绘水粉童话绘本风格,靛蓝色天空中云朵飘移,银色月光洒落,宁静而奇幻。

视频转提示词 · KLING

从视频片段中读取动作。

工具从四帧采样画面中读取主体动作与镜头运动,并按 Kling 的紧凑格式写出。

Read result

一只驮着小型黄铜木质天文台的巨龟,缓缓穿过月光下野花盛开的草地;它经过时花朵随风摇曳,天文台的窗户里透出跳动的暖光。远景镜头,缓慢跟拍,速度与巨龟的步伐一致。手绘水粉童话绘本风格,靛蓝色天空中云朵飘移,银色月光洒落,宁静而奇幻。

试用 Video to Prompt

写出动态,而非静态画面

了解 视频生提示词 生成器的工作原理

图片提示词描述的是一帧静止的画面,而视频提示词必须描述变化:主体在接下来的八秒内做了什么、镜头如何运动、光线如何变化,以及每个节点分别发生在什么时候。这款工具会从视频片段中读取这种变化,或者从单张图片中推断出来,然后用你的视频模型能够理解的语法写出提示词。

三步从视频中提取提示词

  1. 添加视频或图片。 上传最长60秒的 MP4、WebM 或 MOV 视频,系统会在你的浏览器中采样四帧画面;也可以添加一张图片,生成图生视频提示词。
  2. 选择模型与时长。 选择 Sora 2、Veo 3、Kling、Runway Gen-4 或通用模式,设置目标时长,并可添加“缓慢推近”或“保留雨天效果”等额外说明。
  3. 生成、粘贴、优化。 将提示词复制到你的视频生成工具中。如果动作对了但镜头太宽,只需修改一条指令再重新生成即可。

提示词从画面中读取了什么

画面帧按时间顺序采样,因此工具可以对它们进行比较:主体在各帧之间缩小意味着镜头在后拉,地平线倾斜意味着这是手持运镜,光源扫过面部则意味着有车驶过或人物转头。它会说明镜头大小、机位高度与角度、主体的动作及其变化过程、场景、时间与天气、光线的方向与质感,以及画面的色调与风格特征。

随后,它会以“动态”的方式写出提示词——每一句话都在说明什么在运动,包括镜头本身。风格会被保留而非“升级”:粗颗粒的手机拍摄画面依然会保持粗颗粒质感,除非你另有要求,因为这通常正是提取提示词的意义所在。

图生视频提示词:让静态图片动起来

只有一张图片时,并没有真实的动作可供读取,因此工具会根据画面推断出一个合理的动作:人像会得到缓慢推近镜头与一个细微手势,产品会得到环绕镜头与一个运动元素,风景则会得到镜头漂移与天气变化。你的指令会覆盖这一切——“她抬头微笑”或“镜头静止,只有水在动”这样的句子,才能让图生视频提示词真正属于你。

提示词会保留图片已经确定的内容。主体、构图、光线与色调都会被详细描述,以确保视频模型生成的第一帧与你的图片相符——这正是 Sora、Veo、Kling 和 Runway 的图生视频模式忠实还原参考图所需要的。

Sora 2、Veo 3、Kling 与 Runway 读取提示词的方式各不相同

同一个创意需要用五种不同的方式写出来。Sora 2 和 Veo 3 能够生成声音,因此它们的提示词末尾要加上一行音效说明;Kling 更看重主体与单一清晰的动作;Runway 则希望先用它自己的语言描述镜头运动。在工具中选择模型后,提示词会自动遵循相应规则。

视频模型提示词写法音效长度
Sora 2以简洁的散文体书写;若动作有多个节点,则附上带时间标注的简短分镜表支持原生音效:需以一句声音或对白结尾约180词以内
Veo 3一段电影感的完整段落:镜头、动作、环境、光线、风格支持:需添加一句音效设计说明,对白用引号标出约160词以内
Kling主体 → 动作 → 场景 → 镜头 → 光线,突出一个清晰的主要动作不支持60–110词
Runway Gen-4先描述镜头运动(推近、环绕、跟拍、升降),再描述主体动作不支持约80词以内
通用模式跨模型通用散文体:镜头与运镜、主体动作、场景、风格、时长可选90–160词

谁在使用视频提示词生成器

创作者与营销人员无需从零学习镜头语言,就能把一张产品照片或活动静态图变成一段简短的主打视频。影视创作者与剪辑师从参考镜头中提取提示词,在 Sora 或 Veo 中重现其运动与光线。社媒团队用新的主体复现某条表现出色的视频的节奏。提示词工程师则把这些针对特定模型的格式作为起点,比较 Sora 2、Veo 3 与 Kling 对同一镜头的不同演绎。

隐私、限制与费用

你的视频不会被上传。浏览器会以缩小尺寸采样四帧画面,仅分析这几帧;你提交的任何内容都不会被添加到画廊或展示给其他人。视频片段限制为60秒、60MB以内,这个时长足以覆盖单个镜头,也能保证分析速度。每次运行消耗2个积分,是图片工具价格的两倍,因为它需要读取多帧画面并写出更长、带时间节点的提示词。

需要为静态图片提取提示词?使用Image to Prompt。想从文字开始?Text to Prompt可以帮你扩写,而Image Prompt Gallery则按风格展示已完成的提示词。

COMMON QUESTIONS

Video to prompt FAQ

什么是视频转提示词生成器?

它会读取一段短视频或一张静态图片,写出能在 AI 视频生成器中重现该镜头的文字提示词。提示词会描述画面中的动态:主体的动作、镜头运动、光线、节奏与时长,并采用 Sora、Veo、Kling 或 Runway 最易读取的格式。

如何从视频中提取提示词?

上传一段最长60秒的 MP4、WebM 或 MOV 视频。浏览器会在片段中采样四帧画面并发送分析,视频文件本身不会离开你的设备。选择视频模型与目标时长,添加可选的额外说明,然后点击“生成”。如果视频较长,请先剪辑出你想要提取提示词的那一个镜头。

可以改用图片生成视频提示词吗?

可以。添加一张图片,工具会写出图生视频提示词:它会保留图片的主体、构图、光线与风格,并补充视频模型为使其动起来所需的动作、镜头运动与时间节点。这正是 Sora、Veo、Kling 与 Runway 图生视频模式所需要的输入。

它能生成 Sora 2 的提示词吗?

可以。选择 Sora 2 后,提示词会以简洁散文体写出;如果动作包含多个节点,还会附上带秒数标注的简短分镜表,并以一行音效说明结尾,因为 Sora 2 会生成同步声音。

Veo 3、Kling 与 Runway 呢?

每个模型都有各自的选项。Veo 3 会得到一段带音效说明的电影感段落;Kling 会得到按主体、动作、场景、镜头、光线顺序排列的紧凑提示词;Runway Gen-4 会得到一段以 Runway 自身镜头运动词汇开头的简短提示词。选择“通用模式”则能得到适用于多种模型的提示词。

它能还原一段 AI 视频背后的确切提示词吗?

没有任何工具能从一段成品视频中读出其隐藏的原始提示词。它所做的,是足够精确地描述画面中可见的动作、镜头、光线与风格,使得再次运行该提示词能产生同类型的镜头。

视频转提示词工具是免费的吗?

在每日免费额度内,你无需注册账号即可试用。付费方案下,每次运行消耗2个积分,因为它需要读取多帧画面,并写出比图片工具更长的提示词。

支持哪些视频文件格式?

支持60MB、60秒以内的 MP4、WebM 和 MOV 视频,以及 JPG、PNG 和 WEBP 图片。由于画面帧是在你的浏览器中读取的,非常老旧的浏览器可能无法支持所有编码格式;如果视频加载失败,请将其导出为 MP4(H.264)格式后再试。