ElevenLabs:音声からテキストへ

このComfyUIワークフローは、ElevenLabsモデルの高精度な音声認識機能を活用し、音声や動画ファイルからテキストへの書き起こしを行います。ワークフローは「LoadAudio」または「RecordAudio」ノードから始まり、既存の音声ファイルをアップロードするか、インターフェース上で新規録音が可能です。音声入力が用意できたら、「ElevenLabsSpeechToText」ノードが音声データを処理し、高度な音声認識アルゴリズムで話し言葉を正確なテキストに変換します。変換されたテキストは「PreviewAny」ノードでプレビュー・編集でき、必要に応じて修正が可能です。インタビューや講義、会議などの書き起こしに最適で、コンテンツ制作者や研究者、業務で音声をテキスト化したい方に便利なツールです。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

api_elevenLabs_speech_to_text.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates