Google Gemini

Este workflow ComfyUI utiliza o modelo Gemini do Google para demonstrar as capacidades da IA multimodal na geração de texto coerente e relevante ao contexto. O workflow utiliza vários nós, incluindo o GeminiNode, que serve como unidade central de processamento, e o LoadImage, que permite ao usuário inserir imagens para análise e interpretação pelo modelo Gemini. Ao integrar esses componentes, o workflow mostra como as capacidades avançadas de raciocínio do Gemini podem ser aplicadas tanto a entradas de texto quanto de imagem, proporcionando uma experiência fluida para gerar texto com base em conteúdo visual. Além disso, os nós PreviewAny e BatchImagesNode facilitam a visualização e o gerenciamento de múltiplas saídas, tornando mais fácil lidar e revisar o conteúdo gerado.

API

Use este workflow a partir do código

Todo workflow Comfy é um grafo JSON. O payload abaixo é este workflow, exatamente como o ComfyUI executa — obtenha-o pela URL, mantenha-o no controle de versão ou carregue-o no ComfyUI e execute nó por nó.

api_google_gemini.json
Buscando workflow JSON…

Execute a partir de TypeScript ou Python com o Comfy SDK. O mesmo código serve para o Comfy Cloud ou um ComfyUI hospedado por você — apenas a URL base muda.

// Install (beta)
npm i @comfyorg/sdk

// Run "Google Gemini" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("api_google_gemini_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("2", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("20")[0].toFile("output.png"); // SaveText

O SDK utiliza um workflow no formato API: abra este workflow no ComfyUI e use Arquivo → Exportar Workflow (API).

O acesso à API do Comfy Cloud requer um plano com chave de API.

FAQ

Perguntas Frequentes

Ver todos os workflows
Showing 30 of 30 templates