本机实测环境:Windows + ComfyUI + 显卡 RTX 5080 16G。以下节点名均来自真实工作流界面,不虚构参数。

做 AI 漫剧最劝退的环节,往往不是生成本身,而是把一本小说拆成能喂给模型的几十条镜头提示词。手动一句句写,写到后面人设写歪、场景写串,一下午出不了 5 个镜头。其实你只要把小说按固定格式整理好,MiniMax-H3 工作流就能自己吃进去,批量出同人设的连续片段。下文为行文简洁用 H3 指代。

▍ 一、为什么你的小说转漫剧卡壳

  1. 整章丢进去,模型读不懂:H3 的 CR Text #134 文本节点只认单镜头描述,一大段剧情它会抓不到重点,出来的人物动作和场景都偏。
  2. 首帧图不统一,画面跟着跳:每段镜头如果用不同的首帧图喂 LoadImage #140,人物站位和背景开场就会漂移,剪辑时接不上。
  3. 种子没锁,同一段剧情反复抽卡:RandomNoise #129 不固定的话,同一句提示词每次生成的人物姿态、背景光都不一样,出来的片段没法连续用。
  4. 提示词没分层,全靠英文硬写:没有固定结构,写一个镜头要折腾十分钟,还不能保证下一段的风格一致。

打开网易新闻 查看精彩图片

把小说段落按"一个动作=一个镜头"整理成 TXT 分镜表

▍ 二、实测方案:四步把小说变成镜头

方案一:按固定格式拆分小说

不要整章复制。按 "场景 + 人物动作 + 神态/光线" 拆成短句,每段控制在两行以内,例如:

雨夜便利店门口,女主回头,路灯发黄,头发被风吹乱

存成 TXT,一段一个镜头。这样做的好处是,复制进 CR Text #134 时,模型能直接理解当前帧要什么。

方案二:同一套首帧图锁死开场画面

把所有镜头的主角起始画面统一成同一张高清图,走 LoadImage #140 → ImageScaleToTotalPixels #139 → ImageCrop+ #147 → MiniMaxH3ImageToVideo #131 的首帧图像端口。提示词可以换场景,但人物站位和开场构图不会跟着乱变。首帧图尽量用肩部以上大头照或稳定中景,复杂背景容易在生成时把主体带偏。

打开网易新闻 查看精彩图片

ImageCrop+ #147 将处理后的首帧图送入 MiniMaxH3ImageToVideo #131 的首帧图像端口

方案三:固定 RandomNoise 种子保连贯

在 RandomNoise #129 节点里把控制方式从 randomize 改成 fixed,noise_seed 写一个固定值。同一段剧情多次生成时,人物姿态和背景光都会保持在一个可控范围内,减少剪辑时的跳变感。

打开网易新闻 查看精彩图片

RandomNoise 节点控制方式设为 fixed 并写入固定种子值

方案四:turbo 四步采样批量跑

Load Lora #146 挂上 turbo LoRA,模型强度 1.05,BasicScheduler #124 的 steps 保持 4,一段 10 秒镜头生成时间能压到比较低的范围。把整理好的 TXT 分镜表一段段复制进 CR Text #134,点执行,跑完就是一串同人设镜头。

打开网易新闻 查看精彩图片

ComfyUI 队列中按顺序排布的多段小说镜头任务

▍ 三、完整操作链路

提示词链路:CR Text #134 → MiniMaxH3ImageToVideo #131.prompt → BasicGuider #126 → SamplerCustomAdvanced #125 → VAEDecode #122 / VAEDecodeAudio #121 → CreateVideo #130 → SaveVideo #92。

首帧图链路:LoadImage #140 → ImageScaleToTotalPixels #139 → ImageCrop+ #147 → MiniMaxH3ImageToVideo #131.image。

提示词只在 CR Text #134 一个框里写,正面描述放前面,空一行后写 负面词:低画质 畸形 模糊,没有独立的负面提示词输入框。

▍ 四、踩坑提醒

  1. 分镜表别写对话,H3 目前对嘴型不稳定,人物说话容易口型错位,建议先做动作和表情镜头。
  2. 每段提示词都要带光线和场景词,否则同一个种子下也会因为没有环境约束而画风漂移。
  3. 首帧图尽量避开复杂背景,纯色或简单场景的人物照,生成时人物主体更稳。
  4. 显存吃紧时把分辨率降一档、单段时长从 10 秒压到 5-6 秒,5080 16G 能稳跑。

▍ 五、复盘

小说转漫剧的关键不是让模型替你写脚本,而是让脚本格式足够标准、参考图和种子足够稳定。做到这三点,一段小说变成十几个连续镜头,基本就是复制粘贴 + 批量生成的事。模型对复杂剧情和对话的支持还有限,现阶段更适合做 "画面驱动型" 短片段,而不是强依赖台词推动的长剧情。

你手头的小说转成漫剧卡在哪一步?评论区说,下篇我挑一个写成完整流程。

这套工作流我自己一直在用,需要的朋友评论区扣“工作流”,我看到会发源文件给你,导入 ComfyUI 就能直接跑。