Agentes de IA

Easy captioning de photos con Gemini 1.5

16 nodos 220 131 Automatic trigger
Descargar

Descripción del flujo de trabajo

Una automatización que utiliza Gemini 1.5 para generar e insertar títulos inteligentes en imágenes. El flujo analiza el contenido visual, produce descripciones contextuales y aplica los títulos automáticamente, eliminando anotaciones manuales.

Cómo funciona

  1. 1.Activar la automatización manualmente y cargar la imagen a procesar
  2. 2.Enviar la imagen a Gemini 1.5 para análisis de contenido y generación de títulos
  3. 3.Procesar y estructurar la respuesta del modelo en datos organizados
  4. 4.Editar e incrustar el título generado directamente en la imagen
  5. 5.Fusionar resultados y transmitir mediante solicitud HTTP para almacenamiento o procesamiento posterior

Casos de uso

  • Procesar en lote bibliotecas de imágenes con títulos generados automáticamente
  • Mejorar la búsqueda y accesibilidad de colecciones de imágenes
  • Optimizar flujos de contenido para marketing, redes sociales y gestión de activos digitales

Requisitos

  • Clave API válida de Google Cloud con acceso a Gemini habilitado
  • Imágenes en formatos estándar (JPG, PNG) dentro de los límites de tamaño del modelo
  • Comprensión básica de parámetros de cadena LLM e ingeniería de prompts

Valor del servicio

Ideal como servicio de automatización inteligente que combina integraciones e inteligencia artificial para producir resultados listos para usar.

Aplicaciones utilizadas

Gemini Output Parser LLM Chain

Detalles

Disparador Automatic trigger
Nodos 16
Aplicaciones 3
Vistas 220
Descargas 131

Cómo usar

  1. 1.Haz clic en "Descargar plantilla"
  2. 2.Abre tu panel de n8n
  3. 3.Ve a Workflows > Import from File
  4. 4.Selecciona el archivo descargado y configura las credenciales

Nodos utilizados (16)

/

When clicking ‘Test workflow’

Manual Trigger

#1

Google Gemini Chat Model

Gemini Model

#2

Structured Output Parser

Output Parser Structured

#3

Get Info

Edit Image

#4

Resize For AI

Edit Image

#5

Calculate Positioning

Code

#6

Apply Caption to Image

Edit Image

#7

Sticky Note

Sticky Note

#8

Merge Image & Caption

Merge

#9

Merge Caption & Positions

Merge

#10

Get Image

HTTP Request

#11

Sticky Note1

Sticky Note

#12

Sticky Note2

Sticky Note

#13

Sticky Note3

Sticky Note

#14

Sticky Note4

Sticky Note

#15

Image Captioning Agent

LLM Chain

#16