Google Gemini

이 ComfyUI 워크플로는 Google의 Gemini 모델을 활용해 멀티모달 AI가 일관되고 문맥에 맞는 텍스트를 생성하는 기능을 보여줍니다. 워크플로는 핵심 처리 유닛 역할을 하는 GeminiNode와, Gemini 모델이 분석/해석할 이미지를 입력할 수 있는 LoadImage 노드를 포함해 여러 노드를 사용합니다. 이러한 구성요소를 통합해, Gemini의 고급 추론 능력이 텍스트 및 이미지 입력 모두에 어떻게 적용되는지 보여주며, 시각 콘텐츠를 기반으로 텍스트를 생성하는 흐름을 자연스럽게 구성합니다. 또한 PreviewAny 및 BatchImagesNode 노드는 여러 출력의 시각화와 관리를 지원해 생성된 콘텐츠를 처리하고 검토하기 쉽게 합니다.

API

코드에서 이 워크플로우 사용하기

모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.

api_google_gemini.json
워크플로우 JSON 불러오는 중…

Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.

// Install (beta)
npm i @comfyorg/sdk

// Run "Google Gemini" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("api_google_gemini_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("2", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("20")[0].toFile("output.png"); // SaveText

SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.

Comfy Cloud API 접근은 API 키가 포함된 요금제가 필요합니다.

FAQ

자주 묻는 질문

모든 워크플로우 보기
Showing 30 of 30 templates