- Inicio
- Recursos
- Integraciones
- Google Gemini
Nodo Google Gemini n8nConfigura Google Gemini en n8n.
El nodo Google Gemini n8n mete texto, imagen, audio, vídeo y documentos dentro de un flujo de trabajo. Expone 15 operaciones sobre 7 recursos, desde un prompt hasta los stores de File Search para RAG. Una credential de Google AI vale para todas. Pensado para quien necesita a Gemini en un punto concreto del proceso.
Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth
¿Para qué sirve el nodo Google Gemini n8n?
Este nodo conecta un flujo de trabajo con los modelos de Google Gemini y entrega la respuesta como un dato más de n8n. No hay nada conversacional: cada item entrante dispara una ejecución, sin puertos de subnodo debajo que conectar. El panel solo muestra los campos necesarios una vez elegido el recurso (Text, Image, Audio, Video, Document, Media File, File Search) y la operación correspondiente.
Primer uso: texto. text.message manda un prompt, con un System Message por encima si hace falta, y devuelve una respuesta. Es la pieza que resume una incidencia, clasifica una solicitud que entra o reescribe un párrafo antes del nodo siguiente. Con Output Content as JSON activado, la respuesta encaja directamente en una fila de hoja de cálculo o en una llamada de API.
Segundo uso: leer archivos. image.analyze, audio.analyze, video.analyze y document.analyze reciben una URL o un campo binario del nodo anterior y responden a una pregunta sobre él. Una factura en PDF que llega a Gmail se convierte en campos legibles, se escribe en Google Sheets y se avisa en Slack. La transcripción tiene operación propia, audio.transcribe, con Start Time y End Time para quedarse solo con el tramo que interesa.
Tercer uso: crear y recuperar. image.generate y video.generate producen un archivo a partir de un prompt, image.edit retoca imágenes que tú aportas, y el recurso File Search monta stores para RAG, es decir, una generación en la que el modelo responde con los documentos que has subido y no solo con lo que aprendió al entrenarse.
¿Cuándo conviene otra cosa? Este nodo responde una vez por item y ahí termina. Si el modelo tiene que elegir herramientas, llamarlas, leer el resultado y seguir, o mantener el hilo de una conversación, lo que toca es el nodo AI Agent con un subnodo de modelo conectado debajo, entendiendo por subnodo un nodo que se enchufa a un puerto de un nodo raíz en vez de ejecutarse solo. Para comparar proveedores en el mismo terreno, el nodo OpenAI cubre operaciones de medios parecidas, y Perplexity apunta más a preguntas con búsqueda.
Límites que conviene saber antes de montar nada. Code Execution y Duration (Seconds) solo funcionan con determinados modelos. fileSearch.listStores pagina sus resultados: sin Page Token, el flujo nunca pasa de la primera página. video.download solo acepta una URL devuelta por la propia API de Gemini, y por eso la generación ofrece Return As en url. Google factura sus llamadas de API según sus condiciones; n8n no añade nada encima.
¿Qué hay que conectar antes de la primera ejecución?
- 01
Crea la credential de Google AI
El acceso del nodo depende de una credential de Google AI, el registro donde n8n guarda tu clave de API de Google. Se crea desde el menú Credentials y se guarda una sola vez: todos los flujos que hablan con Gemini la reutilizan después, así que rotar la clave se resuelve en un único sitio en vez de nodo por nodo.
- 02
O activa los Gateway credits en n8n Cloud
n8n Cloud deja otra puerta abierta: marcando Use Gateway credits en el campo de credential del nodo, todo funciona sin cuenta de Google ni clave propia. Útil para una primera prueba o un flujo que debe salir antes de que nadie abra la consola de API de Google. El resto de la configuración no cambia.
- 03
Elige la credential y fija el modelo
En el nodo, seleccionas la credential guardada y después el recurso y la operación que toca. Las operaciones de análisis y de generación piden un Model, campo obligatorio: dejarlo vacío corta la ejecución antes de la llamada. Conviene probar el paso una vez con un dato real para verificar que la respuesta vuelve.
¿Qué operaciones de Google Gemini ejecuta n8n?
El nodo Google Gemini expone 15 operaciones en 7 recursos. Para cada una: el nodo tal como lo configuras en n8n, los campos obligatorios y nuestras notas de campo.
| Recurso | Analyze Audio | Create File Search Store | Delete File Search Store | Download Video | Edit Image | Generate an Image | List File Search Stores | Message a Model | Transcribe a Recording | Upload Media File | Upload to File Search Store |
|---|---|---|---|---|---|---|---|---|---|---|---|
| Audio | ✓ | ✓ | |||||||||
| Document | ✓ | ||||||||||
| File Search | ✓ | ✓ | ✓ | ✓ | |||||||
| Image | ✓ | ✓ | ✓ | ||||||||
| Media File | ✓ | ||||||||||
| Text | ✓ | ||||||||||
| Video | ✓ | ✓ | ✓ |
Índice de operaciones
Audio
2 operacionesAnalyze audio
audio.analyzeLo que ves en n8n
Notas y casos de uso
Manda uno o varios archivos de audio al modelo junto con una pregunta y recupera su respuesta en texto. Sirve para saber qué contiene una grabación sin leer una transcripción entera.
Parámetros clave
- Model: el modelo de Gemini que atiende la petición, campo obligatorio, elegido de la lista o puesto por expresión.
- Input Type:
urlpara rellenar URL(s),binarypara Input Data Field Name(s), separando varios valores por comas. - Length of Description (Max Tokens): menos tokens dan una descripción de audio más corta y con menos detalle.
Transcribe a recording
audio.transcribeLo que ves en n8n
Notas y casos de uso
Convierte el audio en texto. Aquí no hay pregunta que formular, a diferencia del análisis: la salida es el contenido hablado, listo para guardar, buscar o pasar a una segunda llamada.
Parámetros clave
- Model: obligatorio, es quien realiza la transcripción.
- URL(s): una o varias direcciones de audio separadas por comas, o Input Data Field Name(s) cuando el archivo llega en binario.
- Start Time y End Time: límites en formato
MM:SSoHH:MM:SS, suficiente para reducir un seminario largo al tramo que importa.
Document
1 operaciónAnalyze document
document.analyzeLo que ves en n8n
Notas y casos de uso
Entrega un documento al modelo y le plantea una pregunta encima. El PDF deja de ser un adjunto opaco y pasa a ser campos que el resto del flujo puede usar.
Parámetros clave
- Text Input: la pregunta, por ejemplo qué contiene el documento o qué importes aparecen.
- URL(s): las direcciones de los documentos, a menudo
{{ $json.fileUrl }}heredado del nodo anterior. - Simplify Output: marcado, el nodo devuelve una respuesta aligerada en lugar de la carga bruta.
File Search
4 operacionesCreate a File Search store
fileSearch.createStoreLo que ves en n8n
Notas y casos de uso
Crea un store de File Search vacío, el contenedor que Gemini usa para RAG: el modelo responde con los documentos depositados y no solo con su entrenamiento.
Parámetros clave
- Display Name: obligatorio, un nombre legible para una persona, que es lo que te permitirá reconocer el store más adelante en el listado.
Delete a File Search store
fileSearch.deleteStoreLo que ves en n8n
Notas y casos de uso
Elimina un store y, si lo pides, todo lo que hay dentro. Es la contraparte de limpieza de la creación, útil cuando los stores se montan por proyecto y desaparecen al cerrarlo.
Parámetros clave
- File Search Store Name: obligatorio, el nombre completo en formato
fileSearchStores/..., no el nombre de pantalla. - Force Delete: activado, se van también los documentos y objetos relacionados; desactivado, el borrado falla mientras el store contenga documentos.
List all File Search stores
fileSearch.listStoresLo que ves en n8n
Notas y casos de uso
Devuelve los stores de File Search que pertenecen a la cuenta. Así es como un flujo encuentra el nombre completo de un store antes de subir un archivo o borrarlo.
Parámetros clave
- Page Size: cuántos stores vuelven por página, con un máximo de 20.
- Page Token: el token de la página anterior, necesario para pedir la siguiente; sin él te quedas siempre en la primera.
Upload a file to a File Search store
fileSearch.uploadToStoreLo que ves en n8n
Notas y casos de uso
Deposita un archivo en un store ya creado para que el modelo pueda citarlo después. Es la operación que hace que un montaje RAG sirva de algo.
Parámetros clave
- File Search Store Name: obligatorio, el nombre completo
fileSearchStores/...del store de destino. - File Display Name: obligatorio, y conviene cuidarlo porque aparece en las citas.
- Input Type:
urlpara apuntar a URL,binarypara leer el archivo desde Input Data Field Name.
Image
3 operacionesAnalyze an image
image.analyzeLo que ves en n8n
Notas y casos de uso
Plantea una pregunta sobre una o varias imágenes y devuelve la respuesta en texto. Es la manera en que un flujo lee una captura, una foto o una página escaneada.
Parámetros clave
- Text Input: lo que preguntas, por ejemplo qué muestra la imagen o si aparece una etiqueta.
- URL(s): las direcciones de las imágenes, varias separadas por comas, o Input Data Field Name(s) para campos binarios.
- Length of Description (Max Tokens): pone techo a la respuesta, con menos tokens para una descripción de imagen más breve.
Generate an image
image.generateLo que ves en n8n
Notas y casos de uso
Fabrica imágenes a partir de una descripción escrita y las devuelve como datos binarios que el flujo guarda o envía. Aquí no entra ningún archivo, solo el prompt.
Parámetros clave
- Prompt: la descripción de la imagen que quieres, cuanto más concreta mejor.
- Number of Images: cuántas variantes vuelven en una misma ejecución.
- Put Output in Field: el nombre del campo de salida que lleva el archivo binario, que leerá el nodo siguiente.
Edit an image
image.editLo que ves en n8n
Notas y casos de uso
Retoma imágenes que ya tienes y las modifica siguiendo una instrucción. El punto de partida no es una página en blanco, sino tu propio material.
Parámetros clave
- Prompt: la instrucción de edición, por ejemplo combinar la primera imagen con la segunda.
- Images: la colección donde añades uno o varios campos binarios que acompañan al prompt.
- Binary Field Name: el campo con los datos de imagen, que hay que indicar cuando el nombre por defecto no coincide con lo que produjo el nodo anterior.
Media File
1 operaciónUpload a media file
file.uploadLo que ves en n8n
Notas y casos de uso
Sube un archivo a la API de Google Gemini y lo deja allí para usarlo más tarde, lo que evita reenviar el mismo archivo pesado en cada llamada.
Parámetros clave
- Input Type:
urlpara traerlo desde URL,binarypara tomarlo del propio flujo. - Input Data Field Name: la propiedad binaria que contiene el archivo, normalmente
datacuando viene de un nodo de descarga.
Text
1 operaciónMessage a model
text.messageLo que ves en n8n
Notas y casos de uso
La operación de texto: una respuesta de un modelo Gemini, con el juego de opciones más amplio del nodo.
Parámetros clave
- Messages: la conversación que envías, cada entrada con un Prompt y un Role,
userpara preguntar,modelpara imponer un tono o una personalidad. - System Message: las instrucciones fijas que valen para toda la llamada.
- Output Randomness (Temperature): bájala para respuestas repetibles, súbela cuando buscas variedad.
- Thinking Budget:
0corta el razonamiento automático,-1lo deja dinámico.
Video
3 operacionesAnalyze video
video.analyzeLo que ves en n8n
Notas y casos de uso
Responde preguntas sobre el contenido de un vídeo, con lo que un archivo que nadie tiene tiempo de mirar se vuelve un par de frases aprovechables.
Parámetros clave
- Text Input: la pregunta que se le hace al modelo sobre las imágenes.
- URL(s): las direcciones de los vídeos, separadas por comas para tratar varios, o Input Data Field Name(s) en entrada binaria.
- Simplify Output: marcado, la respuesta vuelve aligerada en lugar de en bruto.
Generate a video
video.generateLo que ves en n8n
Notas y casos de uso
Construye un vídeo desde un prompt escrito. La generación tarda más que una imagen, de ahí que la operación te deje escoger cómo vuelve el resultado.
Parámetros clave
- Prompt: la descripción del plano que buscas.
- Return As:
videopara un archivo binario dentro del flujo,urlpara una dirección que descargarás más tarde. - Aspect Ratio:
16:9para pantallas,9:16para vertical de formato corto. - Person Generation:
dont_allow,allow_adultoallow_all, según lo que la marca acepte mostrar.
Download a video
video.downloadLo que ves en n8n
Notas y casos de uso
Recoge un vídeo generado en la API de Google Gemini a partir de la dirección que ella misma devolvió, y trae el archivo al flujo en binario.
Parámetros clave
- URL: la dirección de la API de Gemini desde la que descargar, casi siempre
{{ $json.url }}arrastrado del paso de generación. - Put Output in Field: el campo de salida que recibe los datos binarios del archivo.
¿Necesitas ayuda para automatizar Google Gemini con n8n?
El equipo te responde directamente.
Cada mensaje lo lee una persona.
Google Gemini y n8n: preguntas frecuentes
01¿El nodo Google Gemini viene incluido en n8n?
02¿Qué hay que autenticar para usar el nodo Google Gemini n8n?
03¿Qué límites tiene el nodo Google Gemini?
04¿Cuándo usar este nodo en lugar del nodo AI Agent?
05¿n8n o Make para trabajar con Google Gemini?
Recibe nuestros tips de integración cada semana.
Sin spam. Cancela cuando quieras.

