Recursos · Integración n8n

Nodo Google Gemini n8nConfigura Google Gemini en n8n.

El nodo Google Gemini n8n mete texto, imagen, audio, vídeo y documentos dentro de un flujo de trabajo. Expone 15 operaciones sobre 7 recursos, desde un prompt hasta los stores de File Search para RAG. Una credential de Google AI vale para todas. Pensado para quien necesita a Gemini en un punto concreto del proceso.

Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth

Por qué automatizar

¿Para qué sirve el nodo Google Gemini n8n?

Este nodo conecta un flujo de trabajo con los modelos de Google Gemini y entrega la respuesta como un dato más de n8n. No hay nada conversacional: cada item entrante dispara una ejecución, sin puertos de subnodo debajo que conectar. El panel solo muestra los campos necesarios una vez elegido el recurso (Text, Image, Audio, Video, Document, Media File, File Search) y la operación correspondiente.

Primer uso: texto. text.message manda un prompt, con un System Message por encima si hace falta, y devuelve una respuesta. Es la pieza que resume una incidencia, clasifica una solicitud que entra o reescribe un párrafo antes del nodo siguiente. Con Output Content as JSON activado, la respuesta encaja directamente en una fila de hoja de cálculo o en una llamada de API.

Segundo uso: leer archivos. image.analyze, audio.analyze, video.analyze y document.analyze reciben una URL o un campo binario del nodo anterior y responden a una pregunta sobre él. Una factura en PDF que llega a Gmail se convierte en campos legibles, se escribe en Google Sheets y se avisa en Slack. La transcripción tiene operación propia, audio.transcribe, con Start Time y End Time para quedarse solo con el tramo que interesa.

Tercer uso: crear y recuperar. image.generate y video.generate producen un archivo a partir de un prompt, image.edit retoca imágenes que tú aportas, y el recurso File Search monta stores para RAG, es decir, una generación en la que el modelo responde con los documentos que has subido y no solo con lo que aprendió al entrenarse.

¿Cuándo conviene otra cosa? Este nodo responde una vez por item y ahí termina. Si el modelo tiene que elegir herramientas, llamarlas, leer el resultado y seguir, o mantener el hilo de una conversación, lo que toca es el nodo AI Agent con un subnodo de modelo conectado debajo, entendiendo por subnodo un nodo que se enchufa a un puerto de un nodo raíz en vez de ejecutarse solo. Para comparar proveedores en el mismo terreno, el nodo OpenAI cubre operaciones de medios parecidas, y Perplexity apunta más a preguntas con búsqueda.

Límites que conviene saber antes de montar nada. Code Execution y Duration (Seconds) solo funcionan con determinados modelos. fileSearch.listStores pagina sus resultados: sin Page Token, el flujo nunca pasa de la primera página. video.download solo acepta una URL devuelta por la propia API de Gemini, y por eso la generación ofrece Return As en url. Google factura sus llamadas de API según sus condiciones; n8n no añade nada encima.

Conexión

¿Qué hay que conectar antes de la primera ejecución?

  1. 01

    Crea la credential de Google AI

    El acceso del nodo depende de una credential de Google AI, el registro donde n8n guarda tu clave de API de Google. Se crea desde el menú Credentials y se guarda una sola vez: todos los flujos que hablan con Gemini la reutilizan después, así que rotar la clave se resuelve en un único sitio en vez de nodo por nodo.

  2. 02

    O activa los Gateway credits en n8n Cloud

    n8n Cloud deja otra puerta abierta: marcando Use Gateway credits en el campo de credential del nodo, todo funciona sin cuenta de Google ni clave propia. Útil para una primera prueba o un flujo que debe salir antes de que nadie abra la consola de API de Google. El resto de la configuración no cambia.

  3. 03

    Elige la credential y fija el modelo

    En el nodo, seleccionas la credential guardada y después el recurso y la operación que toca. Las operaciones de análisis y de generación piden un Model, campo obligatorio: dejarlo vacío corta la ejecución antes de la llamada. Conviene probar el paso una vez con un dato real para verificar que la respuesta vuelve.

Acciones

¿Qué operaciones de Google Gemini ejecuta n8n?

El nodo Google Gemini expone 15 operaciones en 7 recursos. Para cada una: el nodo tal como lo configuras en n8n, los campos obligatorios y nuestras notas de campo.

Matriz recursos × operaciones
RecursoAnalyze AudioCreate File Search StoreDelete File Search StoreDownload VideoEdit ImageGenerate an ImageList File Search StoresMessage a ModelTranscribe a RecordingUpload Media FileUpload to File Search Store
Audio
Document
File Search
Image
Media File
Text
Video

Audio

2 operaciones
01

Analyze audio

audio.analyze

Lo que ves en n8n

Notas y casos de uso

Manda uno o varios archivos de audio al modelo junto con una pregunta y recupera su respuesta en texto. Sirve para saber qué contiene una grabación sin leer una transcripción entera.

Parámetros clave

  • Model: el modelo de Gemini que atiende la petición, campo obligatorio, elegido de la lista o puesto por expresión.
  • Input Type: url para rellenar URL(s), binary para Input Data Field Name(s), separando varios valores por comas.
  • Length of Description (Max Tokens): menos tokens dan una descripción de audio más corta y con menos detalle.
Casos de uso
una nota de voz de un comercial entra en binario y el nodo resume en dos líneas lo que pidió el cliente.
02

Transcribe a recording

audio.transcribe

Lo que ves en n8n

Notas y casos de uso

Convierte el audio en texto. Aquí no hay pregunta que formular, a diferencia del análisis: la salida es el contenido hablado, listo para guardar, buscar o pasar a una segunda llamada.

Parámetros clave

  • Model: obligatorio, es quien realiza la transcripción.
  • URL(s): una o varias direcciones de audio separadas por comas, o Input Data Field Name(s) cuando el archivo llega en binario.
  • Start Time y End Time: límites en formato MM:SS o HH:MM:SS, suficiente para reducir un seminario largo al tramo que importa.
Casos de uso
transcribir los primeros minutos de una entrevista y dejar el texto junto a la ficha del candidato.

Document

1 operación
03

Analyze document

document.analyze

Lo que ves en n8n

Notas y casos de uso

Entrega un documento al modelo y le plantea una pregunta encima. El PDF deja de ser un adjunto opaco y pasa a ser campos que el resto del flujo puede usar.

Parámetros clave

  • Text Input: la pregunta, por ejemplo qué contiene el documento o qué importes aparecen.
  • URL(s): las direcciones de los documentos, a menudo {{ $json.fileUrl }} heredado del nodo anterior.
  • Simplify Output: marcado, el nodo devuelve una respuesta aligerada en lugar de la carga bruta.
Casos de uso
llega un contrato de proveedor por correo, el nodo saca la fecha de renovación y un paso posterior la archiva.

File Search

4 operaciones
04

Create a File Search store

fileSearch.createStore

Lo que ves en n8n

Notas y casos de uso

Crea un store de File Search vacío, el contenedor que Gemini usa para RAG: el modelo responde con los documentos depositados y no solo con su entrenamiento.

Parámetros clave

  • Display Name: obligatorio, un nombre legible para una persona, que es lo que te permitirá reconocer el store más adelante en el listado.
Casos de uso
un store por línea de producto, creado una sola vez al principio y alimentado después por la operación de subida a medida que se publica documentación.
05

Delete a File Search store

fileSearch.deleteStore

Lo que ves en n8n

Notas y casos de uso

Elimina un store y, si lo pides, todo lo que hay dentro. Es la contraparte de limpieza de la creación, útil cuando los stores se montan por proyecto y desaparecen al cerrarlo.

Parámetros clave

  • File Search Store Name: obligatorio, el nombre completo en formato fileSearchStores/..., no el nombre de pantalla.
  • Force Delete: activado, se van también los documentos y objetos relacionados; desactivado, el borrado falla mientras el store contenga documentos.
Casos de uso
un cierre de cuenta que retira el store montado para ese cliente.
06

List all File Search stores

fileSearch.listStores

Lo que ves en n8n

Notas y casos de uso

Devuelve los stores de File Search que pertenecen a la cuenta. Así es como un flujo encuentra el nombre completo de un store antes de subir un archivo o borrarlo.

Parámetros clave

  • Page Size: cuántos stores vuelven por página, con un máximo de 20.
  • Page Token: el token de la página anterior, necesario para pedir la siguiente; sin él te quedas siempre en la primera.
Casos de uso
un inventario semanal que lista los stores existentes y publica el recuento en un canal del equipo.
07

Upload a file to a File Search store

fileSearch.uploadToStore

Lo que ves en n8n

Notas y casos de uso

Deposita un archivo en un store ya creado para que el modelo pueda citarlo después. Es la operación que hace que un montaje RAG sirva de algo.

Parámetros clave

  • File Search Store Name: obligatorio, el nombre completo fileSearchStores/... del store de destino.
  • File Display Name: obligatorio, y conviene cuidarlo porque aparece en las citas.
  • Input Type: url para apuntar a URL, binary para leer el archivo desde Input Data Field Name.
Casos de uso
cada artículo de ayuda nuevo entra en el store de soporte el mismo día de su publicación.

Image

3 operaciones
08

Analyze an image

image.analyze

Lo que ves en n8n

Notas y casos de uso

Plantea una pregunta sobre una o varias imágenes y devuelve la respuesta en texto. Es la manera en que un flujo lee una captura, una foto o una página escaneada.

Parámetros clave

  • Text Input: lo que preguntas, por ejemplo qué muestra la imagen o si aparece una etiqueta.
  • URL(s): las direcciones de las imágenes, varias separadas por comas, o Input Data Field Name(s) para campos binarios.
  • Length of Description (Max Tokens): pone techo a la respuesta, con menos tokens para una descripción de imagen más breve.
Casos de uso
las fotos que sube un vendedor se describen solas y el texto acaba como atributo alt.
09

Generate an image

image.generate

Lo que ves en n8n

Notas y casos de uso

Fabrica imágenes a partir de una descripción escrita y las devuelve como datos binarios que el flujo guarda o envía. Aquí no entra ningún archivo, solo el prompt.

Parámetros clave

  • Prompt: la descripción de la imagen que quieres, cuanto más concreta mejor.
  • Number of Images: cuántas variantes vuelven en una misma ejecución.
  • Put Output in Field: el nombre del campo de salida que lleva el archivo binario, que leerá el nodo siguiente.
Casos de uso
una fila del calendario editorial dispara un visual que aterriza en la carpeta que revisa el diseñador.
10

Edit an image

image.edit

Lo que ves en n8n

Notas y casos de uso

Retoma imágenes que ya tienes y las modifica siguiendo una instrucción. El punto de partida no es una página en blanco, sino tu propio material.

Parámetros clave

  • Prompt: la instrucción de edición, por ejemplo combinar la primera imagen con la segunda.
  • Images: la colección donde añades uno o varios campos binarios que acompañan al prompt.
  • Binary Field Name: el campo con los datos de imagen, que hay que indicar cuando el nombre por defecto no coincide con lo que produjo el nodo anterior.
Casos de uso
colocar una foto de producto sobre un fondo de temporada antes de mandarla a la cuenta publicitaria.

Media File

1 operación
11

Upload a media file

file.upload

Lo que ves en n8n

Notas y casos de uso

Sube un archivo a la API de Google Gemini y lo deja allí para usarlo más tarde, lo que evita reenviar el mismo archivo pesado en cada llamada.

Parámetros clave

  • Input Type: url para traerlo desde URL, binary para tomarlo del propio flujo.
  • Input Data Field Name: la propiedad binaria que contiene el archivo, normalmente data cuando viene de un nodo de descarga.
Casos de uso
una grabación larga se sube una vez al empezar el lote y luego la reutilizan los pasos de análisis.

Text

1 operación
12

Message a model

text.message

Lo que ves en n8n

Notas y casos de uso

La operación de texto: una respuesta de un modelo Gemini, con el juego de opciones más amplio del nodo.

Parámetros clave

  • Messages: la conversación que envías, cada entrada con un Prompt y un Role, user para preguntar, model para imponer un tono o una personalidad.
  • System Message: las instrucciones fijas que valen para toda la llamada.
  • Output Randomness (Temperature): bájala para respuestas repetibles, súbela cuando buscas variedad.
  • Thinking Budget: 0 corta el razonamiento automático, -1 lo deja dinámico.
Casos de uso
clasificar mensajes entrantes en unas pocas categorías antes de enrutarlos, con Output Content as JSON marcado para que la rama lea un campo limpio.

Video

3 operaciones
13

Analyze video

video.analyze

Lo que ves en n8n

Notas y casos de uso

Responde preguntas sobre el contenido de un vídeo, con lo que un archivo que nadie tiene tiempo de mirar se vuelve un par de frases aprovechables.

Parámetros clave

  • Text Input: la pregunta que se le hace al modelo sobre las imágenes.
  • URL(s): las direcciones de los vídeos, separadas por comas para tratar varios, o Input Data Field Name(s) en entrada binaria.
  • Simplify Output: marcado, la respuesta vuelve aligerada en lugar de en bruto.
Casos de uso
un lote semanal de clips enviados por usuarios se resume y solo los que encajan con una palabra clave llegan a una persona.
14

Generate a video

video.generate

Lo que ves en n8n

Notas y casos de uso

Construye un vídeo desde un prompt escrito. La generación tarda más que una imagen, de ahí que la operación te deje escoger cómo vuelve el resultado.

Parámetros clave

  • Prompt: la descripción del plano que buscas.
  • Return As: video para un archivo binario dentro del flujo, url para una dirección que descargarás más tarde.
  • Aspect Ratio: 16:9 para pantallas, 9:16 para vertical de formato corto.
  • Person Generation: dont_allow, allow_adult o allow_all, según lo que la marca acepte mostrar.
Casos de uso
teasers verticales sacados de un claim de campaña y puestos en cola para revisión.
15

Download a video

video.download

Lo que ves en n8n

Notas y casos de uso

Recoge un vídeo generado en la API de Google Gemini a partir de la dirección que ella misma devolvió, y trae el archivo al flujo en binario.

Parámetros clave

  • URL: la dirección de la API de Gemini desde la que descargar, casi siempre {{ $json.url }} arrastrado del paso de generación.
  • Put Output in Field: el campo de salida que recibe los datos binarios del archivo.
Casos de uso
la segunda mitad de un encadenado en dos tiempos, donde la generación devuelve una URL y esta operación va a por el archivo cuando ya está listo.
Necesitas ayuda

¿Necesitas ayuda para automatizar Google Gemini con n8n?

El equipo te responde directamente.

Cada mensaje lo lee una persona.

FAQ

Google Gemini y n8n: preguntas frecuentes

01¿El nodo Google Gemini viene incluido en n8n?
Sí, sin nada que instalar ni pagar de más por parte de n8n: este nodo forma parte del paquete de IA de n8n y se comporta igual tanto en n8n Cloud como en una instancia autoalojada bajo Community Edition con licencia Sustainable Use, con Docker o npm. El único gasto real está en Google: el proveedor cobra sus propias llamadas de API según sus condiciones, algo que se resuelve directamente con él y sin relación con dónde corre n8n. El nodo se comporta igual sea cual sea la opción de alojamiento elegida.
02¿Qué hay que autenticar para usar el nodo Google Gemini n8n?
Una credential de Google AI, montada una vez en el menú Credentials y reutilizada después por todos los flujos que llaman a Gemini. El nodo no tiene selector Authentication: basta con ese campo de credential antes de elegir el recurso y luego la operación. n8n Cloud suma una alternativa, Use Gateway credits, que evita la cuenta de Google y la clave propia; una instancia autoalojada no tiene esa opción y guarda su propia clave de API de Google en la credential, que hay que rellenar antes de la primera ejecución.
03¿Qué límites tiene el nodo Google Gemini?
La página describe la versión 1 del nodo, la más alta del catálogo, y un flujo antiguo puede mostrar menos opciones. Algunos ajustes dependen del modelo elegido y no del nodo en sí: Code Execution y Duration (Seconds) solo funcionan con ciertos modelos. Los resultados de File Search vienen paginados, con un máximo de 20 stores por página en List File Search Stores y el Page Token necesario para seguir. Delete File Search Store falla si el store todavía tiene documentos y Force Delete no está activo, y Download a video solo acepta una URL que haya devuelto la propia API de Gemini.
04¿Cuándo usar este nodo en lugar del nodo AI Agent?
Este nodo encaja cuando la tarea cabe en una llamada y una respuesta: resumir un documento, transcribir una grabación, generar una imagen. Se ejecuta una vez por item entrante y ahí termina. En cuanto el modelo tiene que elegir entre herramientas, llamarlas, leer lo que devuelven y seguir, o mantener memoria de una conversación, entra en juego el nodo AI Agent, con Gemini enganchado debajo a través del subnodo Google Gemini Chat Model. Este nodo se queda entonces como la vía directa a sus 15 operaciones.
05¿n8n o Make para trabajar con Google Gemini?
El criterio que de verdad decide es el alojamiento y el modelo de coste, más que el editor visual, porque los dos manejan bien las ramificaciones. Make solo existe alojado y factura por operación, cómodo con volúmenes bajos y previsibles cuando nadie quiere ocuparse de infraestructura. n8n, en cambio, se autoaloja o corre en n8n Cloud con el mismo flujo en ambos casos, lo que deja archivos y prompts en servidores propios: una ventaja clara cuando los documentos tratados son sensibles.
Hack'celeration Lab

Recibe nuestros tips de integración cada semana.

Sin spam. Cancela cuando quieras.