
此 ComfyUI 工作流程利用 ElevenLabs Speech-to-Speech API 進行語音轉換。你可提供來源音訊(用 LoadAudio 或 RecordAudio),選擇目標語音(ElevenLabsVoiceSelector 選預設語音,或 ElevenLabsInstantVoiceClone 建立新語音),ElevenLabsSpeechToSpeech 節點會產生新錄音,保留原始內容與節奏,但聲音特質改為所選語音。可用 SaveAudioMP3 或 SaveAudioOpus 儲存輸出。
技術上,流程將來源音訊與目標語音 ID 一同送入 ElevenLabsSpeechToSpeech。選項一,ElevenLabsVoiceSelector 會查詢 ElevenLabs 帳號並輸出選定語音。選項二,ElevenLabsInstantVoiceClone 上傳乾淨參考音訊,回傳新語音資源,再送入 Speech-to-Speech 節點。Note 節點提供指引,部分節點預設旁路,僅需啟用所需部分。設計上方便 A/B 測試預設語音與即時複製,並用明確儲存節點簡化檔案管理。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run "ElevenLabs:語音轉語音" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("api_elevenlabs_speech_to_speech_api.json");
const job = await client.run(wf);
await job.getOutputs("222")[0].toFile("output.png"); // SaveAudioAdvancedSDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題













