このワークフローは、1枚の静止画像からMiniMax H3を使ってステレオ音声付きの短尺動画クリップを生成します。中心となるMiniMax H3生成ノード(id: 4c314f31-ecda-4b08-ae98-faaba1bf613f)が、1回の処理で動画フレームとシーンに合った音声を同時に合成します。LoadImageで指定した画像が被写体と全体のスタイルを決定し、MiniMax H3ノード内でテキストガイダンスを追加することで動きや雰囲気を調整できます。
モデルの効率的な動作と構図維持のため、GetImageSizeとUse Image Sizeグループでアスペクト比を保持しつつ、ResolutionSelectorとImageScaleToTotalPixelsでMiniMax H3推奨のメガピクセル予算と32の倍数制約に合わせた解像度を自動計算します。生成されたクリップはSaveVideoでMP4として書き出され、動画ストリームと(有効時は)生成音声が含まれます。使用するモデルアセットは、動画用VAE(minimax_h3_video_vae_fp16.safetensors)と音声用VAE(minimax_h3_audio_vae_fp32.safetensors)です。
API
このワークフローをコードから利用
すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。
Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。
FAQ














