ElevenLabs: 음성에서 텍스트로

이 ComfyUI 워크플로는 ElevenLabs 모델의 기능을 활용해 오디오 또는 비디오 파일의 음성을 텍스트로 전사합니다. 워크플로는 'LoadAudio' 또는 'RecordAudio' 노드로 시작하며, 기존 오디오 파일을 업로드하거나 인터페이스에서 새 오디오를 직접 녹음할 수 있습니다. 오디오 입력을 확보한 뒤 'ElevenLabsSpeechToText' 노드가 오디오 데이터를 처리하여 고급 음성 인식 알고리즘으로 발화 내용을 정확한 텍스트로 변환합니다. 변환된 텍스트는 'PreviewAny' 노드를 통해 미리보기 및 편집이 가능해, 필요에 따라 전사 결과를 검토하고 수정할 수 있습니다. 이 워크플로는 인터뷰, 강의 등 말로 된 콘텐츠의 전사본을 만드는 데 유용하며, 음성을 텍스트로 효율적으로 변환해야 하는 콘텐츠 크리에이터, 연구자, 전문 직군에 적합합니다.

API

코드에서 이 워크플로우 사용하기

모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.

api_elevenLabs_speech_to_text.json
워크플로우 JSON 불러오는 중…

Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.

// Install (beta)
npm i @comfyorg/sdk

// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");

SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.

Comfy Cloud API 접근은 API 키가 포함된 요금제가 필요합니다.

FAQ

자주 묻는 질문

모든 워크플로우 보기
Showing 30 of 30 templates