最近试了下 Muse 的视频能力,发现它一次只能生成约 10 秒视频,但换个思路,完全可以用「拆镜头」的方式做长漫剧。
我的流程:
剧本 → 分镜 → 人物/场景/道具资产 → 锁定资产 → 逐镜生成 → 拼接成片
3 分钟≈180 秒,按 10 秒一镜,就是 18 个镜头。
真正难的不是生成,而是人物一致性、场景连续性和对白。
实测下来,有几个经验比较重要:
• 资产先行:人物、服装、场景先固定,后面 Prompt 尽量不要改
• 一镜一确认:生成一镜,确认没问题再继续
• 英文写画面,中文写对白:更容易控制画面和发音
• 一镜只做一个核心动作,复杂动作尽量放在开场
• 不要过度追求导演意图,要在模型能做到的范围里找最优解
我自己跑下来,一个 10 秒镜头通常需要 3~4 次生成,一集 18 镜,几十次生成很正常。
目前 Muse 在中文对白、发音和复杂动作上还有明显短板,这些地方反而比画面质量更容易翻车。
所以做 AI 漫剧,核心:把长内容拆成一个个可控的小镜头,再把它们拼起来。
10 秒练手感,一集练流程,系列化才是真正的挑战。
#AI漫剧howto #ai #AI工具 #大模型 #动画制作 #howto用好AI #AI学习 #人工智能 #muse #小红书科技AMA
