這個 ComfyUI 教學工作流程使用 MiniMax H3(全模態模型)把單一文字提示詞直接轉成成品影片,並在一次流程中合成畫面、語音、音效與音樂,輸出含原生立體聲音訊的成品。無需管理任何檔案輸入——只要描述你想要的內容,節點圖就會回傳約 15 秒、24 fps、最高 2K 的影片,並將立體聲音訊直接內嵌在成品中。
在底層,MiniMax H3 子圖(節點 79dd8a95-ce9d-4c14-b264-2162e8bec5ce)負責生成與解碼。它使用 MiniMax H3 的影片與音訊 VAE(minimax_h3_video_vae_fp16.safetensors 與 minimax_h3_audio_vae_fp32.safetensors)從模型的 latent 重建畫面與立體聲音訊。ResolutionSelector 會把常用預設映射到有效尺寸(以 32 的倍數,例如 960×544、1152×640、1216×672),而 SaveVideo 會將影格與立體聲音訊串流封裝成單一 MP4。畫布上的 MarkdownNote 提供快速提示與範例提示詞。結果是一條精簡、僅提示詞的管線,適合快速概念可視化、社群貼文,以及需要音訊同步的敘事內容。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題













