前几天心血来潮,想做一条 15 秒的时尚人像短片:车展现场、怼脸抓拍、高级感。需求写得越细,越发现 AI 视频最难的不是"好看",而是"真实"。
写给 AI 的标准
我的提示词里有一大段是这么写的:
不要网红感,不要夸张整形脸,不要塑料皮,不要过度磨皮,不要假睫毛过重。人物皮肤必须真实:清晰可见毛孔、轻微皮肤纹理、轻微卡粉、轻微痘印、眼下细纹、嘴唇唇纹、少量碎发。
很有意思——我们平时修图是往"完美"走,给 AI 提需求却是往"不完美"走。高级感的秘密,恰恰是那些微小的瑕疵。
被打回的一版
第一版成片:转场不丝滑,帧率不稳定。AI 生成的每一帧单独看都还行,连起来就露馅了。人的眼睛对动态的"假"极其敏感,一卡顿,真实感全没了。
第二版我加了明确要求:转场衔接干净利落、全程帧率稳定、动作连贯无卡顿。好多了。
学到的
- 真实感 = 细节的克制,而不是细节的堆砌;
- 动态连贯性比单帧精美重要得多;
- 给 AI 的指令越具体、越"反直觉"(比如要求保留瑕疵),效果越好。
下次我打算把这些标准整理成一份固定模板,省得每次重写一遍。