先写动作,再写形容词
描述画面里发生的变化:盒盖打开、脚踩进水坑,或杯子逐渐装满。为动作配一个可辨识的声音,生成后才有明确的检查依据,而不是只凭“电影感”判断。
规划三段画面及对应声音。这个免费浏览器工具生成带时间标记的文字简报,不生成视频或音频文件。
按时间对应画面与声音;不会向视频服务发送生成请求。
时间有效:三段画面按顺序覆盖计划时长。
场景与镜头: 陶瓷茶壶向橡木桌上的玻璃杯倒茶,固定近景镜头,柔和窗光;全程保持同一茶杯与茶壶。 计划时长(秒): 6s 计划画幅: 16:9 持续环境声(可选): 安静的室内底噪,无音乐或说话声。 [0–2s] 可见动作: 茶壶移动到空杯上方,准备倾斜。 音效或对白(可选): 壶身倾斜时,壶盖轻轻碰响。 [2–5s] 可见动作: 稳定茶流注入杯中至半杯,杯子保持不动。 音效或对白(可选): 轻柔倒水声,与可见水流同时开始和结束。 [5–6s] 可见动作: 水流停止,茶壶移开,茶杯留在画面中。 音效或对白(可选): 最后一滴水声,随后只留室内底噪。 时间标记是创作目标,不保证模型逐帧遵守。生成后请结合画面检查声音。
规划无需登录或积分。离开前请复制简报,本工具不会存储内容。时长与画幅用于规划,不代表模型支持的参数列表。
打开独立的 Veo 3.1 视频生成器描述画面里发生的变化:盒盖打开、脚踩进水坑,或杯子逐渐装满。为动作配一个可辨识的声音,生成后才有明确的检查依据,而不是只凭“电影感”判断。
雨声、室内底噪和远处交通声放在持续环境声中。每段声音栏留给短暂音效或指定说话者,避免把一次溅水写成从头到尾的背景噪音。
注明一个说话者,写清需要说出的短句。重要音效尽量不要挤在同一窗口。工具检查画面片段的顺序,但不会计算说话所需时间,也不保证口型同步。
选择主体、镜头、计划时长和画幅,用准备、变化、结束三个片段组织一件事。把计划写得更长,不代表所选生成器能用一次请求生成相同时长。
所有时间都从视频开始的第 0 秒算起。相邻片段可以共用边界,本工具不允许画面片段互相重叠。未覆盖时段可以保留,但会提示你判断是否需要补充有意的停留。
将简报粘贴到你有权限使用的视频工具,并确认该工具实际支持的设置。生成后分别开声、静音观看,检查事件时机、说话者和画面连续性。简报是创作方向,不是成片效果证明。
倒茶示例将准备、倒水和最后一滴分开。同样结构也适合无品牌包装开箱或抽屉关闭。当微小的物理音效才是重点时,不要额外堆叠无关音乐。
一句对白示例把短句放在两个无对白动作之间。优先缩短句子,而不是要求加速朗读。请人工检查嘴部动作和发音;时间顺序合理并不代表模型一定能自然说话。
雨中行走示例把持续天气声与一次踩水动作区分开。关闭声音即可复制仅画面版本,原有声音笔记仍然保留,便于检查场景在无声时是否依然表达清楚。
它生成可复制的文字时间简报,包括场景、计划时长、画幅和三段带时间标记的画面。可选声音指令与每个动作放在一起;它不会渲染、播放或下载视频与音频。
不是。它们描述你希望的顺序。视频工具可能只近似理解时间,也可能支持不同的片长。本工具能检查不合理或重叠的画面时间,不能预测模型行为、对白长度或声音延迟。
关闭“包含声音指令”。输出会去掉环境声和各段音效,并明确要求静音。声音内容仍保留在当前页面中,重新开启即可恢复。请在实际生成后确认输出确实无声。
可以直接复制文字,无需账号。工具不存储输入,因此请在离开或刷新页面前复制。如果浏览器不允许访问剪贴板,可选中展示的文字手动复制。
本工具规划事件和声音在什么时候出现;Veo Omni 运镜实验室则在场景不变的情况下对比两种镜头方向。先在这里整理时间,再根据需要单独比较运镜。
不是。Flux Klein AI 提供独立规划工具,并非 Meta 官方服务,也未在此接入 Muse Video 视频生成。Meta 的 Muse 公告介绍了原生音频,也提示声画同步仍有挑战。页面另行链接的生成器是 Veo 3.1,生成前请确认其可见模型选择器。