Ressources · Intégration n8n

Nœud Google Gemini n8nConfigurer Google Gemini dans n8n.

Le nœud Google Gemini n8n amène le texte, l'image, l'audio, la vidéo et les documents dans un workflow. Il expose 15 opérations sur 7 ressources, du prompt simple aux stores File Search pour le RAG. Un seul credential Google AI suffit pour toutes. Utile dès que Gemini doit tenir un rôle précis dans une automatisation.

Avis vérifiés sur Trustpilot · Agence IA, automatisation & growth

Pourquoi automatiser

À quoi sert le nœud Google Gemini n8n ?

Ce nœud fait le lien entre un workflow et les modèles Google Gemini, en rendant la réponse comme une donnée n8n classique. Aucune conversation là-dedans : chaque item entrant déclenche une exécution, sans port de sous-nœud à raccorder en dessous. Le panneau se limite aux champs utiles une fois la ressource choisie (Text, Image, Audio, Video, Document, Media File, File Search) puis l'opération qui va avec.

Premier usage, le texte pur. text.message envoie un prompt, éventuellement encadré par un System Message, et renvoie une réponse. C'est la brique qui sert à résumer un ticket, trier une demande entrante ou reformuler un paragraphe avant le nœud suivant. Avec Output Content as JSON activé, la réponse se range directement dans une ligne de tableur ou un appel d'API.

Deuxième usage, la lecture de médias. image.analyze, audio.analyze, video.analyze et document.analyze prennent une URL ou un champ binaire venu du nœud précédent et répondent à une question posée dessus. Un devis PDF reçu dans Gmail devient trois champs lisibles, écrits dans Google Sheets puis annoncés dans Slack. La transcription a son opération à part, audio.transcribe, avec Start Time et End Time pour ne garder que le passage utile d'un long enregistrement.

Troisième usage, produire et retrouver. image.generate et video.generate fabriquent un fichier à partir d'un prompt, image.edit retravaille des visuels que tu fournis, et la ressource File Search construit des stores pour le RAG, c'est-à-dire une génération où le modèle répond à partir des documents que tu as déposés plutôt que de sa seule mémoire d'entraînement.

Quand vaut-il mieux autre chose ? Ce nœud répond une fois par item, puis s'arrête. Si le modèle doit choisir des outils, les appeler, lire le retour et continuer, ou garder le fil d'une conversation, c'est le nœud AI Agent qu'il faut, avec un sous-nœud modèle branché dessous, un sous-nœud étant un nœud qui se raccorde à un port d'un nœud racine au lieu de tourner seul. Pour comparer les fournisseurs sur le même terrain, le nœud OpenAI couvre des opérations médias proches, et Perplexity vise plutôt les requêtes orientées recherche.

Les limites à connaître avant de construire. Code Execution et Duration (Seconds) ne sont pris en charge que par certains modèles. fileSearch.listStores pagine ses résultats : sans Page Token, le workflow ne voit jamais que la première page. video.download n'accepte qu'une URL renvoyée par l'API Gemini, d'où l'option Return As réglée sur url dans la génération. Enfin, Google facture ses propres appels d'API selon ses conditions ; n8n n'ajoute rien par-dessus.

Connexion

Que faut-il brancher avant la première exécution ?

  1. 01

    Créer le credential Google AI

    L'accès du nœud passe par un credential Google AI, l'enregistrement où n8n conserve ta clé d'API Google. Dans le menu Credentials, tu le crées puis tu l'enregistres une bonne fois : tous les workflows qui parlent à Gemini le réutilisent ensuite, ce qui ramène une rotation de clé à un seul endroit à modifier plutôt qu'à rouvrir chaque nœud.

  2. 02

    Ou activer les Gateway credits sur n8n Cloud

    n8n Cloud garde une seconde possibilité : cocher Use Gateway credits dans le champ credential du nœud fait tourner l'ensemble sans compte Google ni clé personnelle. C'est utile pour un premier essai ou un workflow à livrer avant même qu'une console d'API Google ait été ouverte. Le reste de la configuration ne change pas.

  3. 03

    Choisir le credential puis fixer le modèle

    Dans le nœud, tu sélectionnes le credential enregistré, puis la ressource et l'opération recherchées. Les opérations d'analyse et de génération réclament un Model ; le champ étant requis, le laisser vide bloque l'exécution avant l'appel. Un essai sur une vraie donnée confirme ensuite que la réponse revient bien.

Actions

Quelles opérations Google Gemini n8n sait-il lancer ?

Le nœud Google Gemini expose 15 opérations sur 7 ressources. Pour chacune : le nœud tel que tu le configures dans n8n, les champs obligatoires, et nos notes de terrain.

Matrice ressources × opérations
RessourceAnalyze AudioCreate File Search StoreDelete File Search StoreDownload VideoEdit ImageGenerate an ImageList File Search StoresMessage a ModelTranscribe a RecordingUpload Media FileUpload to File Search Store
Audio
Document
File Search
Image
Media File
Text
Video

Audio

2 opérations
01

Analyze audio

audio.analyze

Ce que tu vois dans n8n

Notes & cas d'usage

Envoie un ou plusieurs fichiers audio au modèle avec une question, et récupère sa réponse en texte. Pratique quand tu veux savoir ce que contient un enregistrement sans lire une transcription entière.

Paramètres clés

  • Model : le modèle Gemini qui traite la demande, champ requis, choisi dans la liste ou posé par expression.
  • Input Type : url pour renseigner URL(s), binary pour Input Data Field Name(s), plusieurs valeurs séparées par des virgules.
  • Length of Description (Max Tokens) : moins de tokens donne une description audio plus courte et moins détaillée.
Cas d'usage
un mémo vocal laissé par un commercial arrive en binaire, le nœud répond en deux lignes ce que le client a demandé.
02

Transcribe a recording

audio.transcribe

Ce que tu vois dans n8n

Notes & cas d'usage

Transforme l'audio en texte. Aucune question à poser ici, contrairement à l'analyse : la sortie est le contenu parlé lui-même, prêt à être stocké, cherché ou renvoyé vers un second appel.

Paramètres clés

  • Model : requis, c'est lui qui effectue la transcription.
  • URL(s) : une ou plusieurs adresses audio séparées par des virgules, ou Input Data Field Name(s) quand le fichier arrive en binaire.
  • Start Time et End Time : bornes au format MM:SS ou HH:MM:SS, de quoi réduire un webinaire entier au passage qui compte.
Cas d'usage
transcrire les premières minutes d'un entretien et ranger le texte à côté de la fiche candidat.

Document

1 opération
03

Analyze document

document.analyze

Ce que tu vois dans n8n

Notes & cas d'usage

Donne un document au modèle et lui pose une question dessus. Le PDF cesse d'être une pièce jointe opaque : il devient des champs exploitables par la suite du workflow.

Paramètres clés

  • Text Input : la question posée, par exemple ce que contient le document ou quels montants y figurent.
  • URL(s) : les adresses des documents, souvent {{ $json.fileUrl }} repris du nœud d'avant.
  • Simplify Output : coché, le nœud renvoie une réponse allégée au lieu de la charge brute.
Cas d'usage
un contrat fournisseur arrive par mail, le nœud en sort la date de reconduction, un nœud plus loin la classe.

File Search

4 opérations
04

Create a File Search store

fileSearch.createStore

Ce que tu vois dans n8n

Notes & cas d'usage

Crée un store File Search vide, le conteneur que Gemini utilise pour le RAG : le modèle répond à partir des documents déposés plutôt que de son seul entraînement.

Paramètres clés

  • Display Name : requis, un nom lisible par un humain, c'est ce qui permet de reconnaître le store plus tard dans la liste.
Cas d'usage
un store par gamme de produits, créé une fois à l'installation, rempli ensuite au fil des publications par l'opération d'upload.
05

Delete a File Search store

fileSearch.deleteStore

Ce que tu vois dans n8n

Notes & cas d'usage

Supprime un store, et si tu le demandes, tout ce qu'il contient. C'est le pendant ménage de la création, utile quand les stores se montent par projet et disparaissent à la fin.

Paramètres clés

  • File Search Store Name : requis, le nom complet au format fileSearchStores/..., pas le nom d'affichage.
  • Force Delete : activé, les documents et objets liés partent aussi ; désactivé, la suppression échoue tant que le store contient des documents.
Cas d'usage
une fin de mission qui nettoie le store monté pour ce compte.
06

List all File Search stores

fileSearch.listStores

Ce que tu vois dans n8n

Notes & cas d'usage

Renvoie les stores File Search détenus par le compte. C'est ainsi qu'un workflow retrouve le nom complet d'un store avant d'y déposer un fichier ou de le supprimer.

Paramètres clés

  • Page Size : combien de stores reviennent par page, dans la limite de 20.
  • Page Token : le jeton issu de la page précédente, à fournir pour obtenir la suivante ; sans lui, tu restes bloqué sur la première page.
Cas d'usage
un inventaire hebdomadaire qui liste les stores existants et publie le récapitulatif dans un canal d'équipe.
07

Upload a file to a File Search store

fileSearch.uploadToStore

Ce que tu vois dans n8n

Notes & cas d'usage

Dépose un fichier dans un store existant pour que le modèle puisse le citer ensuite. C'est l'opération qui rend un montage RAG réellement utile, une fois le store créé.

Paramètres clés

  • File Search Store Name : requis, le nom complet fileSearchStores/... du store visé.
  • File Display Name : requis, et à soigner puisqu'il apparaît dans les citations.
  • Input Type : url pour pointer URL, binary pour lire le fichier depuis Input Data Field Name.
Cas d'usage
chaque nouvel article d'aide publié rejoint le store support dans la foulée.

Image

3 opérations
08

Analyze an image

image.analyze

Ce que tu vois dans n8n

Notes & cas d'usage

Pose une question sur une ou plusieurs images et renvoie la réponse en texte. C'est la façon dont un workflow lit une capture d'écran, une photo ou une page scannée.

Paramètres clés

  • Text Input : ce que tu demandes, par exemple ce que montre le visuel ou si une étiquette est présente.
  • URL(s) : les adresses des images, plusieurs séparées par des virgules, ou Input Data Field Name(s) pour des champs binaires.
  • Length of Description (Max Tokens) : plafonne la réponse, moins de tokens donnant une description d'image plus brève.
Cas d'usage
les photos déposées par un vendeur sont décrites automatiquement, et le texte sert d'attribut alt.
09

Generate an image

image.generate

Ce que tu vois dans n8n

Notes & cas d'usage

Fabrique des images à partir d'une description écrite et les rend en données binaires que le workflow stocke ou envoie. Aucun fichier en entrée ici, seulement le prompt.

Paramètres clés

  • Prompt : la description du visuel voulu, la plus concrète possible.
  • Number of Images : le nombre de variantes produites en une exécution.
  • Put Output in Field : le nom du champ de sortie qui portera le fichier binaire, lu ensuite par le nœud suivant.
Cas d'usage
une ligne de calendrier éditorial déclenche un visuel, déposé dans le dossier que le graphiste relit.
10

Edit an image

image.edit

Ce que tu vois dans n8n

Notes & cas d'usage

Reprend des images que tu possèdes déjà et les modifie selon une consigne. Le point de départ n'est donc pas une page blanche mais ton propre visuel.

Paramètres clés

  • Prompt : la consigne de retouche, par exemple combiner la première image avec la seconde.
  • Images : la collection où tu ajoutes un ou plusieurs champs binaires à joindre au prompt.
  • Binary Field Name : le champ qui contient les données d'image, à préciser quand le nom par défaut ne correspond pas à ce que le nœud précédent a produit.
Cas d'usage
poser un packshot sur un fond saisonnier avant envoi vers le compte publicitaire.

Media File

1 opération
11

Upload a media file

file.upload

Ce que tu vois dans n8n

Notes & cas d'usage

Pousse un fichier vers l'API Google Gemini et l'y conserve pour un usage ultérieur, ce qui évite de renvoyer le même gros média à chaque appel.

Paramètres clés

  • Input Type : url pour récupérer depuis URL, binary pour prendre le fichier dans le workflow.
  • Input Data Field Name : la propriété binaire qui contient le fichier, souvent data quand il sort d'un nœud de téléchargement.
Cas d'usage
un enregistrement long chargé une seule fois en début de lot, puis réutilisé par les étapes d'analyse qui suivent.

Text

1 opération
12

Message a model

text.message

Ce que tu vois dans n8n

Notes & cas d'usage

L'opération texte : une réponse d'un modèle Gemini, avec le jeu d'options le plus large du nœud.

Paramètres clés

  • Messages : la conversation envoyée, chaque entrée portant un Prompt et un Role, user pour poser la question, model pour imposer un ton ou une personnalité.
  • System Message : les consignes permanentes valables pour tout l'appel.
  • Output Randomness (Temperature) : à baisser pour des réponses reproductibles, à monter quand la variété est recherchée.
  • Thinking Budget : 0 coupe le raisonnement automatique, -1 le laisse dynamique.
Cas d'usage
trier les messages entrants en quelques catégories avant routage, avec Output Content as JSON coché pour que la branche lise un champ propre.

Video

3 opérations
13

Analyze video

video.analyze

Ce que tu vois dans n8n

Notes & cas d'usage

Répond à des questions sur le contenu d'une vidéo, ce qui transforme un fichier que personne n'a le temps de regarder en quelques phrases exploitables.

Paramètres clés

  • Text Input : la question posée au modèle sur les images.
  • URL(s) : les adresses des vidéos, séparées par des virgules pour en traiter plusieurs, ou Input Data Field Name(s) en entrée binaire.
  • Simplify Output : coché, la réponse revient allégée plutôt que brute.
Cas d'usage
un lot hebdomadaire de clips envoyés par des utilisateurs est résumé, et seuls ceux qui correspondent à un mot-clé remontent à un humain.
14

Generate a video

video.generate

Ce que tu vois dans n8n

Notes & cas d'usage

Construit une vidéo depuis un prompt écrit. La génération prend plus de temps qu'une image, d'où le choix laissé sur la forme du résultat.

Paramètres clés

  • Prompt : la description du plan souhaité.
  • Return As : video pour un fichier binaire dans le workflow, url pour une adresse à télécharger plus tard.
  • Aspect Ratio : 16:9 pour les écrans, 9:16 pour le format vertical court.
  • Person Generation : dont_allow, allow_adult ou allow_all, selon ce que la marque accepte de montrer.
Cas d'usage
des teasers verticaux produits depuis une accroche de campagne, mis en file pour relecture.
15

Download a video

video.download

Ce que tu vois dans n8n

Notes & cas d'usage

Récupère une vidéo générée auprès de l'API Google Gemini à partir de l'adresse qu'elle a renvoyée, et ramène le fichier dans le workflow en binaire.

Paramètres clés

  • URL : l'adresse de l'API Gemini où télécharger, en général {{ $json.url }} repris de l'étape de génération.
  • Put Output in Field : le champ de sortie qui reçoit les données binaires du fichier.
Cas d'usage
la seconde moitié d'un enchaînement en deux temps, où la génération rend une URL et cette opération va chercher le fichier une fois prêt.
Besoin d'aide

Besoin d'aide pour automatiser Google Gemini avec n8n ?

L'équipe te répond directement.

Chaque message est lu par une personne.

FAQ

Google Gemini et n8n : les questions fréquentes

01Le nœud Google Gemini est-il inclus dans n8n ?
Oui, sans rien à installer ni à payer côté n8n : ce nœud appartient au paquet IA de n8n et se comporte pareil, que ce soit sur n8n Cloud ou sur une instance auto-hébergée en Community Edition sous licence Sustainable Use, avec Docker ou npm. La seule dépense réelle vient de Google : le fournisseur facture ses propres appels d'API selon ses conditions, une affaire réglée directement avec lui et sans lien avec l'endroit où n8n tourne. Rien dans le comportement du nœud ne dépend de ce choix d'hébergement.
02Que faut-il authentifier pour utiliser le nœud Google Gemini n8n ?
Un credential Google AI, monté une seule fois dans le menu Credentials et réutilisé ensuite par tous les workflows qui font appel à Gemini. Aucun sélecteur Authentication sur le nœud : le champ credential suffit avant de passer au choix de la ressource puis de l'opération. n8n Cloud ajoute une alternative, Use Gateway credits, qui évite le compte Google et la clé personnelle ; une instance auto-hébergée n'a pas cette option et garde sa propre clé d'API Google dans le credential, à renseigner avant la première exécution.
03Quelles sont les limites du nœud Google Gemini ?
La page couvre la version 1 du nœud, la plus haute au catalogue, un workflow ancien pouvant en montrer moins. Certains réglages dépendent du modèle choisi plutôt que du nœud lui-même : Code Execution et Duration (Seconds) ne fonctionnent que sur certains modèles. Les résultats File Search sont paginés, avec un maximum de 20 stores par page pour List File Search Stores et le Page Token nécessaire pour continuer. Delete File Search Store échoue sur un store qui contient encore des documents sans Force Delete activé, et Download a video n'accepte qu'une URL renvoyée par l'API Gemini elle-même.
04Quand prendre ce nœud plutôt que le nœud AI Agent ?
Ce nœud convient à une tâche qui tient en un appel et une réponse : résumer un document, transcrire un enregistrement, produire une image. Il s'exécute une fois par item entrant, puis s'arrête là. Dès que le modèle doit choisir entre plusieurs outils, les appeler, lire ce qu'ils renvoient et poursuivre, ou garder la mémoire d'une conversation, c'est le nœud AI Agent qui prend le relais, avec Gemini branché dessous via le sous-nœud Google Gemini Chat Model. Ce nœud-ci garde alors le rôle de voie directe pour les 15 opérations qu'il propose.
05n8n ou Make pour travailler avec Google Gemini ?
Le vrai critère porte sur l'hébergement et le modèle de coût, plus que sur l'éditeur visuel lui-même, les deux gérant bien les branchements. Make reste hébergé uniquement et facture à l'opération, un choix confortable sur des volumes faibles et prévisibles quand personne ne veut gérer d'infrastructure. n8n, lui, s'auto-héberge ou tourne sur n8n Cloud avec le même workflow des deux côtés, ce qui permet de garder fichiers médias et prompts sur des serveurs maîtrisés : un vrai plus dès que les documents traités sont sensibles.
Hack'celeration Lab

Reçois nos tips intégration chaque semaine.

Pas de spam. Désinscription à tout moment.