中秋节前做AI视频,我妈说画面太假,后来加了这1样东西才自然
中秋前那阵子我寻思做条AI视频给我妈看看。
哈。
我爸说,忽略这个点的人亏大了(叹气)
用某款国产工具跑了十来条,画面一出来我自个儿都觉得像塑料花。
我妈凑过来瞄了一眼说:“这啥玩意儿,人跟纸片似的,树叶子都不带晃的哈。”
(这话扎心,但确实没冤枉我)
后来折腾了差不多四五天,我才摸到门道。
不是模型不行,是我少喂了一样东西。
核心结论
缺的那样东西就是真实素材打底。
纯靠提示词生成,AI给你的是“平均脸”和“平均光”。
我9月18号在杭州家里试了一组对比,同一段提示词,纯文生视频出来的画面,树叶边缘像刀切。
加了一张我闺女在小区楼下拍的实景照片当参考图,再跑一遍,树叶缝隙里透出来的光斑就自然多了。
说白了,AI视频要像真的,得拿真东西去“腌”它。
具体我是这么干的。
先拿手机拍一段自家阳台的日落,或者楼下那棵桂花树。
不用拍多好,有个大概构图和光线方向就行。
然后把这张图喂给工具当首帧参考,提示词里写清楚“保持参考图的色温和阴影方向”。
我用的那个工具叫可灵,生成的时候把“参考强度”拉到0出头到0.7之间。
拉太高画面会僵,拉太低又回到塑料味。
(这个数值我试了七八遍才找到甜点区)
还有一招是加动态模糊。
AI生成的视频帧太干净了,每一帧都像精修照片,连起来反而不像真的。
我在剪映里给生成的片段叠了一层很轻的方向模糊,强度大概15%到20%。
尤其是人物转头或者镜头横摇的时候,加和不加差别巨大。
不加的时候我妈说“像看PPT”,加了之后她说“这还差不多”。
具体方法
再一个就是音效别偷懒。
很多人做AI视频只盯着画面,其实声音占真实感的四成。
我一开始用的工具自带配乐,听着像商场开业。
后来换成自己去素材站扒的环境音,比如风吹树叶的沙沙声、远处小孩跑过的脚步声。
音量压到-18dB左右,垫在底下。
画面里有人走路,就单独加一层鞋底蹭地的声音,跟画面对齐。
我妈看完说“这回像在楼下遛弯拍的”。
还有个坑我得提一嘴。
别一次性生成太长的片段。
我试过一条15秒的,中间人物脸直接糊了。
后来改成每段3到5秒,分开生成再拼。
这样每个片段都有独立的参考图和提示词,稳定性高很多。
拼的时候注意转场别用花哨的,硬切最像真实拍摄。
我闺女幼儿园老师发的那种日常视频,全是硬切,看着就自然。
- 参考图强度0出头到0.7,太高僵太低假
- 动态模糊大概十来个点到20%,转头横摇必加
- 环境音垫底-18dB,脚步单独对齐
- 单段3到5秒,硬切拼接
最后说个我自己的笨办法。
生成完先别急着导出,在手机上看一遍。
手机屏幕小,很多在电脑上不明显的假感,手机上反而一眼看穿。
我就是在手机上发现人物手指头数量不对的。
(AI画手这个老毛病现在好多了,但偶尔还是翻车)
改完再导出,基本就能骗过我妈这种“火眼金睛”了。
现在她拿着我做的中秋视频在家族群里发,还跟人说“这是我儿子用那个什么AI弄的”。
语气里居然有点小骄傲。
行吧,奶爸的面子算是保住了。