- 🔗 Link workflow —— *使用自定义工作流的推荐方式。*直接从 ComfyUI 自己的工作流库里挑一个链接进来;在 ComfyUI 里编辑保存,ComfyTV 自动读到最新版。见 custom-workflows.zh.md。
- ⬆ Upload workflow —— 从磁盘导入
.json文件,不用重启。
Image Stage

- 提示词:主文本框。上游 Text 节点内容会追加进来;上游图片喂给当前工作流的
LoadImage(只有 i2i 工作流会消费)。@image_N记号可以在文中内联引用接进来的图片槽位。 - workflow —— 自带:Local SD1.5(文生图)、Local SD1.5 I2I(图生图)、Image Ideogram4 T2I——加上你 Link 或 Upload 进来的任何工作流。
- resolution / aspect_ratio / batch_size:目标尺寸档位、画幅、每次 Run 出几张。
images 是本次 Run 的整批;image 是你在节点上点选的单张(没点之前默认第一张)。
图生图
选Local SD1.5 I2I,把参考图接进 images 槽,写提示词,Run。
Video Stage

- workflow —— 自带两个家族:
- LTX 2.3(纯视频):
Local LTX 2.3 T2V—— 文生视频。Local LTX 2.3 I2V—— 图生视频。Local LTX 2.3 FLF2V—— 首尾帧生视频。在 images 上接两张图(起始 + 结束关键帧)。Local LTX 2.3 IA2V—— 图 + 音频生视频。
- MiniMax H3(一趟直出带声音的视频——环境声、拟音甚至对白):
Local MiniMax H3 T2V—— 文生视频+音频。Local MiniMax H3 FLF2V—— 首尾帧生视频+音频。Local MiniMax H3 R2V—— 多参考:接入多张图(角色设定、场景、道具、风格)和可选的参考音频,在提示词里用@image_N/<Audio N>指名引用,跨镜锁定身份与连续性。H3 工作流内置 Lightning LoRA,生成耗时约减半(见 models.zh.md)。
- LTX 2.3(纯视频):
- resolution / aspect_ratio / duration:输出尺寸、画幅、时长。
- audio 输入 —— IA2V 必需;H3 R2V 作参考音频;其余工作流不用音频。
Text Stage

Music Stage

- ACE-Step v1 Song —— 轻量默认。
- MiniMax Music 3 —— 更高质量的完整歌曲。
- 提示词:自由 tags——曲风、情绪、BPM、乐器编制。
- 歌词(可选):留空 = 纯器乐;非空 = 人声曲目。
- 时长:滑块(1–240 秒,默认 30)。
Speech Stage

audio 输入(IA2V)、Mux Audio 节点或音频套件。
3D Model Stage

model kind 的工作流生成 3D 模型(GLB)。自带三个:
- Hunyuan3D 2.1 —— 图生带贴图网格。
- MoGe-2 Depth Mesh —— 单目深度估计图生几何。
- TripoSplat Gaussian —— 图生高斯泼溅(也能载入 Scene3D)。
model kind 工作流。节点内嵌轨道预览;旋转视角后会自动截图进它的图片输出,下游图像 stage 可以直接消费模型的外观。GLB 本体流向 3D 节点——Scene3D、网格操作、材质,详见节点参考。