这两个模型的提示词哲学几乎是相反的 —— 一个要求你把结构写全,一个要求你先写最少。放在一起看,能帮你理解「提示词长度」这件事本身没有标准答案。
Vidu:六段式,结构越全越稳
[主体描述] + [主体动作/表情] + [场景/背景] + [运镜方式] + [光线/氛围] + [音效/对白]
- 最佳字数 50-150 字:短于 50 字信息不足,长于 150 字开始互相干扰。
- 支持切镜:自动切镜 / 多视角切镜 / 规划切镜(写「镜头一:……;镜头二:……」)/ 过肩镜头 / 宫格叙事。
- 需要多镜头叙事时,把镜头写清楚,不要指望模型自己分段。
Runway:极简迭代,一次只加一层
Runway 的推荐做法与 Vidu 相反:先写一个最小的动作,然后逐层叠加。
第 0 层(最小动作):一个人向前走
第 1 层(主体运动):一个人沿湿漉的街道向前走
第 2 层(镜头运动):手持镜头在人物身后跟随
第 3 层(场景运动):雨丝在镜头前斜落,霓虹倒影随步伐晃动
第 4 层(风格词):冷色调,夜景,电影感
- 只用正向描述,不写负面词。Runway 的负面表述收益很低。
- 聚焦「运动」而不是复述图片。图生视频时,不要重新描述画面里已经有的东西,只写「怎么动」。
- 常用镜头词:
handheld camera tracks…、locked camera、dolly in。
怎么选
- 要做多镜头叙事、需要一次性把结构交代清楚 → 用 Vidu 的六段式。
- 要做单镜头微调、反复迭代打磨一个动作 → 用 Runway 的逐层叠加。
- 同一个创意想比较效果时,先固定主体与场景描述,只改运镜那一层,否则你无法判断是哪一处改动起了作用。