上个月帮表姐做AI视频,才发现新手最容易踩的4个坑
上个月我表姐突然找我,说想给她家闺女做个生日视频,用AI那种,看别人发的效果绝绝子,自己捣鼓了两天差点把电脑砸了,
我过去一看,好家伙,她踩的坑我去年帮另一个朋友做的时候也踩过,今天就把新手最容易掉的四个坑掰开说说,顺便把怎么绕过去也讲清楚。
核心结论
新手做AI视频,八成的时间都浪费在四件事上:提示词写得太笼统、素材喂得太多太杂、生成参数没调对、忘了检查口型同步。这四点你提前避开,做一条能看的视频大概能省下差不多三四个小时。
具体方法
第一步:把提示词拆成“谁+在哪+干什么+什么风格”
我表姐一开始输入的是“一个小女孩过生日很开心”。
这种提示词AI根本没法接,出来的画面要么是模糊的卡通人脸,要么直接给她生成了一只戴生日帽的猫(这个我真没想到)。
后来我让她改成“六岁女孩,坐在铺碎花桌布的餐桌前,面前一个插着六根蜡烛的草莓奶油蛋糕,暖黄色灯光,宫崎骏动画风格”。
同一个工具,出来的画面直接能用了哈。
记住,AI视频工具对数量词和具体物件特别敏感,你写“六根蜡烛”它就给你六根,写“几根”它可能给你画成一把筷子。
第二步:素材只喂三到五段,每段别超五秒
你是不是个人看法是素材越多AI学得越像?
错了。
上个月我用某东上买的便宜麦克风录了表姐的声音,一共喂了十二段进去,结果AI合成出来的声音像在水里说话。
后来删到只剩四段,每段大概三到四秒,反而清晰得跟原声差不多。
视频素材也一样。
你扔二十张照片进去,AI会挑花了眼,人物脸型来回跳。
我现在的习惯是:同一个人物,只给正面、侧面、半身各一张,最多再加一张全身。
就这四张,跑出来的形象稳定性比十几张强得多。
第三步:参数里这两个数值先动
打开生成设置,别被那一堆英文吓到。
你优先找两个东西:运动幅度和一致性强度。
- 运动幅度调到中等偏下(大概30%到40%的位置)。调太高人物会像喝了假酒一样乱晃,调太低就成了静态图加轻微呼吸。
- 一致性强度拉到70%到80%。这个数值保证你生成第二段视频时,人物的脸和第一段不会差出十万八千里。
我试过把一致性强度拉到95%,结果画面直接卡成PPT,每帧都在抽搐。别问,问就是手欠。
第四步:生成完先看口型对没对上,再导出
这一步特别容易被跳过。
尤其是做带说话的视频,AI有时候会把“妈妈”的口型对成“爸爸”,或者干脆嘴巴不动光眨眼。
我去年十月在杭州出差,晚上在酒店帮朋友赶一个祝福视频,导出后才发现后半句口型全错,又重新跑了一遍,白白多花了四十分钟。
现在的习惯是:每生成十秒就回放检查一遍,发现口型对不上就立刻调整音频的起始时间,往前挪0.2到0.3秒通常就能救回来。
别等到整条视频都渲染完了再去看,那时候改起来更麻烦。
避开这几个坑之后,我表姐那条生日视频前后用了不到两个小时就搞定了。她闺女看完指着屏幕说“妈妈这个姐姐好像我”,把表姐乐得不行。

还有个小细节:做视频的时候把手机调成勿扰模式。
我表姐中间接了三个电话,每次回来都得重新找思路,浪费的时间比做视频本身还长。
(如果你有更好的经验,欢迎在评论区补充。
)