这个 ComfyUI 教程工作流使用 MiniMax H3(一种全模态模型)把一条文本提示词直接变成带原生立体声音频的成片视频,一次生成即可同时合成画面、旁白、音效与音乐。无需管理任何文件输入——只要描述你要的内容,节点图会返回约 15 秒、24 fps、最高 2K 分辨率,并且立体声已内嵌在视频里。

在实现上,MiniMax H3 子图(节点 79dd8a95-ce9d-4c14-b264-2162e8bec5ce)负责生成与解码。它使用 MiniMax H3 的视频与音频 VAE(minimax_h3_video_vae_fp16.safetensors 和 minimax_h3_audio_vae_fp32.safetensors)从模型 latent 重建帧与立体声音频。ResolutionSelector 将常用预设映射到满足 32 倍数约束的有效尺寸(如 960×544、1152×640、1216×672),而 SaveVideo 会把帧序列与立体声音频流复用封装为单个 MP4。画布中的 MarkdownNote 提供快速提示与示例提示词。最终得到的是一条紧凑的“纯提示词”流水线,适合快速概念可视化、社媒发布,以及带音频节奏的叙事短片。

API

通过代码使用此工作流

每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。

e8099b642c9f.json
正在获取工作流 JSON…

使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。

// Install (beta)
npm i @comfyorg/sdk

// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");

SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。

Comfy Cloud API 访问需要包含 API 密钥的套餐。

常见问题

常见问题

查看所有工作流
Showing 30 of 30 templates