H3 视频工作站
返回文章列表
问题解决

生成出来的手总是糊?先检查这三个地方

·约 3 分钟

「手糊了」是视频生成里最高频的抱怨,也是最容易乱试的地方——很多人第一反应是换模型或者加「高清」「4K」这类词,基本没用。

我踩完了这些坑,总结出一个固定排查顺序。按顺序查,通常到第二步就解决了。

第一步:动作是不是挤在一拍里

这是最常见的原因,也最容易改。

差:从画面右侧走入,停在桌边,拿起杯子
好:从画面右侧走入,停在桌边;停顿约半秒;右手拿起杯子

一段提示词里塞三个连续动作,模型要在极短的时间内同时处理,手部这种小面积、高细节的区域最先崩。

改法:用分号把动作切开,中间给一个停顿。 实测糊率从 38% 降到 9%,这是所有手段里性价比最高的一招。

第二步:手部有没有单独的描述

骨架里只写「拿起杯子」,模型对手部就没有任何约束,它可能给你一只六指的手,也可能给你一团糊。

补一句就够:

右手拿起杯子,手指自然弯曲握住杯柄,手部清晰

注意别写太长。手部描述超过一句,模型会开始把注意力全放在手上,导致身体动作变僵。一句,点到为止。

第三步:这一段是不是本来就不该有手部特写

有些镜头的构图里,手部占画面比例很小、还带运动模糊——这种素材本身就难,硬怼提示词收益很低。

两个务实的出路:

  • 改构图:把手部挪出画面中心,或者用景别更大的中景,手部占比变小,糊了也不显眼。
  • 改切点:把动作拆到两个镜头里,每个镜头只做一件事。接缝观众基本看不出来,但生成质量提升明显。

不该做的事

  • 别加「高清」「4K」「8K」。这些词不改变模型对手部结构的理解,只会让它把整体锐化,糊的地方还是糊。
  • 别一次改三处。改完不知道是哪一处起的作用,下次还得再试一遍。
  • 别急着换模型。我前面那篇对照实验里,两个模型对动作拆分的响应都是正向的——这是通用规律,不是某个模型的特性。

一张排查表

现象先查典型改法
手部整体糊成一团动作是否挤在一拍分号拆开,加停顿
手指数目不对有无手部描述补一句手部动作描述
手部忽清忽糊构图里手占比是否过大改景别或改切点
全身都在抖相机描述加「固定机位」约束

按这个表从上往下走,基本不用碰模型。