Veo 的长处与 Seedance 正好互补:它对环境细节和微物理(气球膨胀、液体流动、布料垂坠、烟雾扩散)响应最好,而且能一次生成同步的原生音频与口型。代价是片段短,一般 4 / 6 / 8 秒可选,支持延长。
推荐顺序
场景与时间 → 主体与动作 → 环境细节(这一层给足) → 相机 → 音频 / 对白 → 风格
注意第二层的位置:Veo 需要你先把「这是什么场景」交代清楚,再描述主体。这与 Seedance 的「先主体后环境」相反。
环境层可以放心写细
一间傍晚的书房,窗外正在下小雨,玻璃上有水痕;
桌面上一盏黄铜台灯,灯罩边缘有一道暖色溢出;
纸张在空调风口下轻微起伏。
这类「物理上会动的细节」是 Veo 的舒适区,写得越具体,画面越不空。
对白与音频怎么写
[人物 A, 低沉沙哑的声音]: "你确定要这么做?"
[人物 B, 轻快但带一丝紧张]: "已经来不及改了。"
环境声:远处雷声,室内雨滴敲窗。
音效:纸张翻动、椅子轻响。
- 每句对白都要标说话人和语气。只写对白内容,模型会随便分配声音。
- 控制节奏:需要停顿时显式写「稍作停顿」「片刻之后」。
- 对白之间留转场:连续两句紧挨着写,容易出现口型抢拍。
- 8 秒内不要塞超过 2 句对白。
避坑
- 别用它做长动作:8 秒限制下,复杂动作会被压缩成快进。适合对话、微物理、产品演示这类「静止中的细节」。
- 不要写「镜头快速运动」:Veo 在剧烈运动上的稳定性不如可灵与 Seedance,追求运动感换模型更省时间。
- 对话类视频里,人物正脸 + 台词同时出现时,口型同步对时长最敏感 —— 优先用 8 秒而不是 4 秒。