AI视频提示词怎么写出片更稳
本篇讲 AI 视频的提示词思路:为什么"一句话"和"一段话"出片差很多,主体、环境、镜头、声音各要交代什么,以及怎么靠小步迭代拿到想要的画面。预算怎么安排,见免费积分与每日额度怎么规划;不想写字的走法,见照片变短视频的模板玩法。
为什么一句话不够
"一只猫在跑步"这种提示词,模型只能猜:什么品种、什么场景、镜头离多远、要不要声音。猜出来往往平!写提示词的本质,是把摄影师、美术和音效师会问的问题提前答一遍——信息给得越具体,出片越接近脑里的画面。
五个要素,各说一句
- 主体:谁或什么在画面里,长什么样、穿什么、什么状态;
- 环境:在哪儿发生——黄昏的天台、雨后的巷子、棚拍白底;
- 镜头:怎么运动——缓慢推进、环绕半圈、固定机位、从左往右平移;
- 光线与氛围:暖色逆光、冷色月光、赛博霓虹,直接决定质感;
- 声音:要不要环境音、音效或对白。原生音频一次生成,写进提示词就行。
照这个骨架写:"黄昏天台,穿白衬衫的少年回头,镜头从左侧缓慢推进,暖色逆光,环境音是风声与远处车流"——比"一个少年在天台"出片稳定得多。
小步迭代,别一次到位
第一版提示词跑出来的片子,通常只对了一半。更省预算的改法是只动一个变量:构图不对就改镜头描述,色调不对就改光线描述,动作不对就把动词写得更具体。每轮只改一处,两三轮基本就能收敛。
图生视频同理:选图时优先主体清晰、边缘干净、构图有力的照片,然后只描述镜头怎么动——推进、环绕、跟拍。想让画面里某个东西单独动,用运动笔刷涂抹那块区域、画出轨迹就行。
常见的三个坑
- 同一段话塞三个场景——模型会平均用力,每个都不像。一段提示词只拍一个镜头;
- 形容词堆到十个——"史诗感大片级震撼绝美"这类词互相稀释,不如一个具体的"雨后霓虹湿地面";
- 忽略画幅——竖屏素材先把 9:16 定好再生成,横屏转竖屏裁一刀会丢主体。
把这套骨架练熟后,剩下的就是素材与工具的准备。三条出片路径、手机端安装与使用,见 PixVerse 介绍站。