Google Gemini

Ce workflow ComfyUI exploite le modèle Gemini de Google pour démontrer les capacités de l’IA multimodale à générer un texte cohérent et pertinent selon le contexte. Le workflow utilise plusieurs nœuds, dont GeminiNode, qui sert de cœur de traitement, et LoadImage, qui permet d’importer des images à analyser par le modèle Gemini. En intégrant ces composants, le workflow montre comment les capacités avancées de raisonnement de Gemini s’appliquent aussi bien au texte qu’aux images, offrant une expérience fluide pour générer du texte à partir de contenu visuel. Les nœuds PreviewAny et BatchImagesNode facilitent la visualisation et la gestion de multiples sorties, simplifiant la revue et la gestion du contenu généré.

API

Utiliser ce workflow depuis le code

Chaque workflow Comfy est un graphe JSON. Le contenu ci-dessous est ce workflow, exactement comme ComfyUI l’exécute — récupérez-le depuis l’URL, gardez-le dans le contrôle de version, ou chargez-le dans ComfyUI et exécutez-le nœud par nœud.

api_google_gemini.json
Récupération du JSON du workflow…

Exécutez-le depuis TypeScript ou Python avec le Comfy SDK. Le même code cible Comfy Cloud ou un ComfyUI auto-hébergé — seule l’URL de base change.

// Install (beta)
npm i @comfyorg/sdk

// Run "Google Gemini" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("api_google_gemini_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("2", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("20")[0].toFile("output.png"); // SaveText

Le SDK prend un workflow au format API : ouvrez ce workflow dans ComfyUI et utilisez Fichier → Exporter le workflow (API).

L’accès à l’API Comfy Cloud nécessite un forfait avec clé API.

FAQ

Questions Fréquentes

Voir tous les workflows
Showing 30 of 30 templates