猫咪怎么对话?AI视频生成步骤 封面图
使用教程

猫咪怎么对话?AI视频生成步骤

约 5 分钟阅读

想让猫咪在视频里“对话”,先把“对话”拆成两半:画面里的猫咪嘴在一张一合,头部有轻微起伏;台词和声音后期再配。AI视频生成能直接解决的是前一半,也就是让静态图动出说话感。

你搜到的「AI视频生成」,在这站对应的入口就是「AI视频」。下面所有生成步骤都在这一个入口完成,不用换地方。

一、别把“说话”当成一个动作来写

模型看不懂“说话”这个抽象词。你写“让猫说话”,它可能只让猫张嘴,也可能让整只猫乱动。更稳的做法是:把“说话”拆成可见的连续动作。

一个猫咪对话视频里,真正让人感觉“它在说话”的动作,通常是这么几类:

  • 嘴巴中等幅度缓慢开合,而不是一下张很大
  • 下巴带着嘴部一起轻微上下移动
  • 头部偶尔轻轻点一下,或者微微上扬
  • 眼睛自然眨动,频率不用太高
  • 脖子和身体基本保持稳定,只有嘴部周围在动

把这些写进提示词,生成结果就会往“像在说话”靠。不要只写“说话”“聊天”“开口讲话”这种看不见具体画面的词。

如果你第一次试,先只写嘴部动作,不要同时要求猫做大表情、转头、抬爪。动作越多,模型越容易把注意力分到别处,嘴部反而动不起来。

二、照片变视频:猫咪怎么弄

这是最常用的一种。手头有一张猫照,直接让它动起来。

  1. 先挑一张合适的照片:猫脸清晰,嘴巴没有被毛全挡住,最好正面或半侧面。
  2. 照片背景越干净越好。纯色墙、地板、毯子都比一堆杂物稳。背景乱,模型容易把背景也跟着动起来。
  3. 猫在画面里占比大一点,远景猫脸太小,嘴部动作会看不清。如果照片太大,先裁一下,让猫头占画面主要位置。
  4. 打开 AI视频。如果有模型选项,选一个能接收图片输入的;没有选项就按默认。
  5. 上传猫咪照片。
  6. 提示词写:猫咪嘴巴缓慢开合,头部轻微上下点动,镜头固定,背景保持不动。
  7. 时长、画面比例按模型默认先试一次,生成后回放看嘴部。

如果猫脸变形了,把提示词里“头部转动”“身体动作”这类要求删掉,只保留嘴部开合和轻微抬头。照片变视频的关键是,动作越少越容易控制。

照片素材的几个坑

  • 嘴巴被毛遮住大半的猫,生成时嘴部动作容易糊成一团。要么换一张露嘴的照片,要么把提示词里的“嘴巴开合”改成“下巴轻微开合”。
  • 照片分辨率太低或者噪点太多,模型可能把噪点当成毛发来动。尽量用清晰原图。
  • 侧脸太偏的照片,嘴部不太容易识别。半侧面到正面之间最稳。

三、没有照片:用文字生成猫咪动态

如果没有现成猫照,也可以走文字生成视频。

  1. 打开 AI视频,进入文字生成入口。
  2. 把猫咪外观描述清楚:毛色、大概体型、拍摄角度。例如“一只橘色短毛猫,正面近景”。
  3. 接着写动作:“嘴巴缓慢开合,头部微微上扬,像在慢慢说话”。
  4. 加上镜头约束:“固定镜头,背景为浅色墙壁,光线不变”。
  5. 按模型默认时长生成,先看猫咪五官是否稳定,再改提示词。

文字生成的好处是不依赖素材,但嘴部位置比照片更难控。如果生成出来的猫嘴开合不明显,就把“嘴巴缓慢开合”放在提示词更靠前的位置。

文字生成时怎么防止猫脸崩掉

  • 一定要写“正面”或“半侧面”,不要只写“猫咪”。不带角度的描述,模型容易给出全侧面或奇怪机位。
  • 加入“镜头固定”能让画面不晃,猫脸也更容易稳定。
  • 如果猫的品种说不准,写毛色和长短毛就行,例如“短毛、橘色”,不一定非要写具体品种。

四、提示词模板和示例

可以用这个结构:主体 + 嘴部动作 + 头部动作 + 镜头/背景。

部分 怎么写 示例
主体 毛色、角度、景别 橘色短毛猫,正面近景
嘴部动作 开合幅度、速度 嘴巴中等幅度缓慢开合
头部动作 方向、幅度 头部微微上扬,偶尔轻点
镜头/背景 固定、简洁 镜头固定,背景保持不动

三个可以直接改的提示词:

  1. 一只橘色短毛猫正面近景,镜头固定,嘴巴中等幅度缓慢开合,头部微微上扬,背景保持不动。
  2. 一只黑白猫半侧面,镜头轻微推进,嘴巴小幅度一张一合,像在慢慢说话,光线不变。
  3. 一只白色长毛猫坐在浅色背景前,只有嘴部和下巴轻微运动,眼睛自然眨动,头部偶尔轻点。

提示词不用一次写很长。先给最核心的嘴部动作,看生成结果;哪不对再补背景、镜头或头部约束。如果你现在手头有猫照,可以到 AI视频 里用第一组提示词先跑一段看看。

五、生成效果不好怎么调

嘴部不动

换一张嘴巴更清楚、没有遮挡的照片。提示词只保留“嘴巴缓慢开合”,不要同时让猫做大表情,否则模型可能把动作分配错了。

整只猫都在晃

加上“固定镜头,背景保持不动”。如果还是晃,把动作幅度词减少,例如“轻微”“缓慢”“小幅”。

猫脸变形

优先选正脸或半侧面。提示词别出现“转头”“身体转向”这类大动作,只让嘴部和下巴附近有轻微运动。

生成失败或时长不对

不同模型对图片比例、时长和文件大小的要求不一定相同。先按默认设置试;不行就换一张更小的图片,或者换一个模型。时长不是越长越好,先按默认来,生成一段能接受的再说。

嘴部动作太夸张

如果嘴巴张得太大,像在打哈欠而不是说话,把“开合”改成“小幅度开合”“中等幅度开合”,并加上“缓慢”。幅度词比想象中重要。

六、生成后你还需要知道的事

AI视频 生成的是动态画面,不是带完整配音的成片。也就是说,猫嘴会动,但“猫说了什么”这句台词要后期在剪辑软件里配字幕或声音。这一步不在 AI视频 里完成,AI视频 只负责把静态图变成有说话感的画面。

所以流程是:先生成满意的嘴部动作片段,再导出做字幕和配音。如果嘴型还不对,就先回到提示词那一步继续调,不要急着进入剪辑。

如果生成出来的片段长度不够,可以先确定好一个固定机位和提示词,再生成多段素材。不同段之间让猫咪动作稍微有一点变化,后期拼起来会更自然。别试图一次生成很长的对话,多段拼接往往更可控。

七、动手前可以照着检查一遍

  • 照片或文字描述里,猫嘴是否清楚可见
  • 提示词里是否出现了“嘴巴开合”这个动作
  • 有没有写“镜头固定”和“背景保持不动”
  • 是否只要求嘴部和头部轻微动作,没有让猫转身、抬爪
  • 是否按模型默认参数先生成一段,而不是一上来就调很长的时长

这五条都确认了,再去 AI视频 生成,失败率会低很多。