Google Gemini

このComfyUIワークフローは、GoogleのGeminiモデルを活用し、マルチモーダルAIによる一貫性のある文脈的なテキスト生成能力をデモします。GeminiNode(コア処理)、LoadImageノード(画像入力)などを組み合わせ、Geminiモデルが画像を解析・解釈し、テキストを生成します。これにより、画像とテキストの両方を入力として活用し、視覚コンテンツに基づくテキスト生成をシームレスに体験できます。さらに、PreviewAnyやBatchImagesNodeノードで複数出力の可視化・管理も容易です。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

api_google_gemini.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run "Google Gemini" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("api_google_gemini_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("2", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("20")[0].toFile("output.png"); // SaveText

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates