
Este fluxo do ComfyUI utiliza os recursos avançados do modelo ElevenLabs para transcrever fala de arquivos de áudio ou vídeo em texto. O fluxo começa com o nó 'LoadAudio' ou 'RecordAudio', permitindo ao usuário fazer upload de um arquivo de áudio existente ou gravar novo áudio diretamente na interface. Após a entrada do áudio, o nó 'ElevenLabsSpeechToText' processa os dados, utilizando algoritmos avançados de reconhecimento de fala para converter as palavras faladas em texto preciso. Esse texto pode ser visualizado e editado pelo nó 'PreviewAny', garantindo que o usuário possa revisar e refinar a transcrição conforme necessário. Este fluxo é especialmente útil para criar transcrições de entrevistas, palestras ou qualquer conteúdo falado, sendo uma ferramenta valiosa para criadores de conteúdo, pesquisadores e profissionais que precisam converter fala em texto de forma eficiente.
API
Use este workflow a partir do código
Todo workflow Comfy é um grafo JSON. O payload abaixo é este workflow, exatamente como o ComfyUI executa — obtenha-o pela URL, mantenha-o no controle de versão ou carregue-o no ComfyUI e execute nó por nó.
Execute a partir de TypeScript ou Python com o Comfy SDK. O mesmo código serve para o Comfy Cloud ou um ComfyUI hospedado por você — apenas a URL base muda.
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");O SDK utiliza um workflow no formato API: abra este workflow no ComfyUI e use Arquivo → Exportar Workflow (API).
O acesso à API do Comfy Cloud requer um plano com chave de API.
FAQ













