
此 ComfyUI 工作流程運用 ElevenLabs 模型強大語音辨識能力,將音訊或影片檔中的語音內容轉為文字。流程從 'LoadAudio' 或 'RecordAudio' 節點開始,讓使用者可上傳現有音檔或直接錄音。音訊輸入後,'ElevenLabsSpeechToText' 節點會處理音訊資料,運用先進語音辨識技術將語音轉為精準文字。文字可透過 'PreviewAny' 節點預覽與編輯,確保內容正確無誤。此流程特別適合需要將訪談、演講等語音內容轉錄為文字的內容創作者、研究人員與專業人士。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題
常見問題
Showing 30 of 30 templates













