- Accueil
- Ressources
- Intégrations
- Google Gemini
Nœud Google Gemini n8nConfigurer Google Gemini dans n8n.
Le nœud Google Gemini n8n amène le texte, l'image, l'audio, la vidéo et les documents dans un workflow. Il expose 15 opérations sur 7 ressources, du prompt simple aux stores File Search pour le RAG. Un seul credential Google AI suffit pour toutes. Utile dès que Gemini doit tenir un rôle précis dans une automatisation.
Avis vérifiés sur Trustpilot · Agence IA, automatisation & growth
À quoi sert le nœud Google Gemini n8n ?
Ce nœud fait le lien entre un workflow et les modèles Google Gemini, en rendant la réponse comme une donnée n8n classique. Aucune conversation là-dedans : chaque item entrant déclenche une exécution, sans port de sous-nœud à raccorder en dessous. Le panneau se limite aux champs utiles une fois la ressource choisie (Text, Image, Audio, Video, Document, Media File, File Search) puis l'opération qui va avec.
Premier usage, le texte pur. text.message envoie un prompt, éventuellement encadré par un System Message, et renvoie une réponse. C'est la brique qui sert à résumer un ticket, trier une demande entrante ou reformuler un paragraphe avant le nœud suivant. Avec Output Content as JSON activé, la réponse se range directement dans une ligne de tableur ou un appel d'API.
Deuxième usage, la lecture de médias. image.analyze, audio.analyze, video.analyze et document.analyze prennent une URL ou un champ binaire venu du nœud précédent et répondent à une question posée dessus. Un devis PDF reçu dans Gmail devient trois champs lisibles, écrits dans Google Sheets puis annoncés dans Slack. La transcription a son opération à part, audio.transcribe, avec Start Time et End Time pour ne garder que le passage utile d'un long enregistrement.
Troisième usage, produire et retrouver. image.generate et video.generate fabriquent un fichier à partir d'un prompt, image.edit retravaille des visuels que tu fournis, et la ressource File Search construit des stores pour le RAG, c'est-à-dire une génération où le modèle répond à partir des documents que tu as déposés plutôt que de sa seule mémoire d'entraînement.
Quand vaut-il mieux autre chose ? Ce nœud répond une fois par item, puis s'arrête. Si le modèle doit choisir des outils, les appeler, lire le retour et continuer, ou garder le fil d'une conversation, c'est le nœud AI Agent qu'il faut, avec un sous-nœud modèle branché dessous, un sous-nœud étant un nœud qui se raccorde à un port d'un nœud racine au lieu de tourner seul. Pour comparer les fournisseurs sur le même terrain, le nœud OpenAI couvre des opérations médias proches, et Perplexity vise plutôt les requêtes orientées recherche.
Les limites à connaître avant de construire. Code Execution et Duration (Seconds) ne sont pris en charge que par certains modèles. fileSearch.listStores pagine ses résultats : sans Page Token, le workflow ne voit jamais que la première page. video.download n'accepte qu'une URL renvoyée par l'API Gemini, d'où l'option Return As réglée sur url dans la génération. Enfin, Google facture ses propres appels d'API selon ses conditions ; n8n n'ajoute rien par-dessus.
Que faut-il brancher avant la première exécution ?
- 01
Créer le credential Google AI
L'accès du nœud passe par un credential Google AI, l'enregistrement où n8n conserve ta clé d'API Google. Dans le menu Credentials, tu le crées puis tu l'enregistres une bonne fois : tous les workflows qui parlent à Gemini le réutilisent ensuite, ce qui ramène une rotation de clé à un seul endroit à modifier plutôt qu'à rouvrir chaque nœud.
- 02
Ou activer les Gateway credits sur n8n Cloud
n8n Cloud garde une seconde possibilité : cocher Use Gateway credits dans le champ credential du nœud fait tourner l'ensemble sans compte Google ni clé personnelle. C'est utile pour un premier essai ou un workflow à livrer avant même qu'une console d'API Google ait été ouverte. Le reste de la configuration ne change pas.
- 03
Choisir le credential puis fixer le modèle
Dans le nœud, tu sélectionnes le credential enregistré, puis la ressource et l'opération recherchées. Les opérations d'analyse et de génération réclament un Model ; le champ étant requis, le laisser vide bloque l'exécution avant l'appel. Un essai sur une vraie donnée confirme ensuite que la réponse revient bien.
Quelles opérations Google Gemini n8n sait-il lancer ?
Le nœud Google Gemini expose 15 opérations sur 7 ressources. Pour chacune : le nœud tel que tu le configures dans n8n, les champs obligatoires, et nos notes de terrain.
| Ressource | Analyze Audio | Create File Search Store | Delete File Search Store | Download Video | Edit Image | Generate an Image | List File Search Stores | Message a Model | Transcribe a Recording | Upload Media File | Upload to File Search Store |
|---|---|---|---|---|---|---|---|---|---|---|---|
| Audio | ✓ | ✓ | |||||||||
| Document | ✓ | ||||||||||
| File Search | ✓ | ✓ | ✓ | ✓ | |||||||
| Image | ✓ | ✓ | ✓ | ||||||||
| Media File | ✓ | ||||||||||
| Text | ✓ | ||||||||||
| Video | ✓ | ✓ | ✓ |
Sommaire des opérations
Audio
2 opérationsAnalyze audio
audio.analyzeCe que tu vois dans n8n
Notes & cas d'usage
Envoie un ou plusieurs fichiers audio au modèle avec une question, et récupère sa réponse en texte. Pratique quand tu veux savoir ce que contient un enregistrement sans lire une transcription entière.
Paramètres clés
- Model : le modèle Gemini qui traite la demande, champ requis, choisi dans la liste ou posé par expression.
- Input Type :
urlpour renseigner URL(s),binarypour Input Data Field Name(s), plusieurs valeurs séparées par des virgules. - Length of Description (Max Tokens) : moins de tokens donne une description audio plus courte et moins détaillée.
Transcribe a recording
audio.transcribeCe que tu vois dans n8n
Notes & cas d'usage
Transforme l'audio en texte. Aucune question à poser ici, contrairement à l'analyse : la sortie est le contenu parlé lui-même, prêt à être stocké, cherché ou renvoyé vers un second appel.
Paramètres clés
- Model : requis, c'est lui qui effectue la transcription.
- URL(s) : une ou plusieurs adresses audio séparées par des virgules, ou Input Data Field Name(s) quand le fichier arrive en binaire.
- Start Time et End Time : bornes au format
MM:SSouHH:MM:SS, de quoi réduire un webinaire entier au passage qui compte.
Document
1 opérationAnalyze document
document.analyzeCe que tu vois dans n8n
Notes & cas d'usage
Donne un document au modèle et lui pose une question dessus. Le PDF cesse d'être une pièce jointe opaque : il devient des champs exploitables par la suite du workflow.
Paramètres clés
- Text Input : la question posée, par exemple ce que contient le document ou quels montants y figurent.
- URL(s) : les adresses des documents, souvent
{{ $json.fileUrl }}repris du nœud d'avant. - Simplify Output : coché, le nœud renvoie une réponse allégée au lieu de la charge brute.
File Search
4 opérationsCreate a File Search store
fileSearch.createStoreCe que tu vois dans n8n
Notes & cas d'usage
Crée un store File Search vide, le conteneur que Gemini utilise pour le RAG : le modèle répond à partir des documents déposés plutôt que de son seul entraînement.
Paramètres clés
- Display Name : requis, un nom lisible par un humain, c'est ce qui permet de reconnaître le store plus tard dans la liste.
Delete a File Search store
fileSearch.deleteStoreCe que tu vois dans n8n
Notes & cas d'usage
Supprime un store, et si tu le demandes, tout ce qu'il contient. C'est le pendant ménage de la création, utile quand les stores se montent par projet et disparaissent à la fin.
Paramètres clés
- File Search Store Name : requis, le nom complet au format
fileSearchStores/..., pas le nom d'affichage. - Force Delete : activé, les documents et objets liés partent aussi ; désactivé, la suppression échoue tant que le store contient des documents.
List all File Search stores
fileSearch.listStoresCe que tu vois dans n8n
Notes & cas d'usage
Renvoie les stores File Search détenus par le compte. C'est ainsi qu'un workflow retrouve le nom complet d'un store avant d'y déposer un fichier ou de le supprimer.
Paramètres clés
- Page Size : combien de stores reviennent par page, dans la limite de 20.
- Page Token : le jeton issu de la page précédente, à fournir pour obtenir la suivante ; sans lui, tu restes bloqué sur la première page.
Upload a file to a File Search store
fileSearch.uploadToStoreCe que tu vois dans n8n
Notes & cas d'usage
Dépose un fichier dans un store existant pour que le modèle puisse le citer ensuite. C'est l'opération qui rend un montage RAG réellement utile, une fois le store créé.
Paramètres clés
- File Search Store Name : requis, le nom complet
fileSearchStores/...du store visé. - File Display Name : requis, et à soigner puisqu'il apparaît dans les citations.
- Input Type :
urlpour pointer URL,binarypour lire le fichier depuis Input Data Field Name.
Image
3 opérationsAnalyze an image
image.analyzeCe que tu vois dans n8n
Notes & cas d'usage
Pose une question sur une ou plusieurs images et renvoie la réponse en texte. C'est la façon dont un workflow lit une capture d'écran, une photo ou une page scannée.
Paramètres clés
- Text Input : ce que tu demandes, par exemple ce que montre le visuel ou si une étiquette est présente.
- URL(s) : les adresses des images, plusieurs séparées par des virgules, ou Input Data Field Name(s) pour des champs binaires.
- Length of Description (Max Tokens) : plafonne la réponse, moins de tokens donnant une description d'image plus brève.
Generate an image
image.generateCe que tu vois dans n8n
Notes & cas d'usage
Fabrique des images à partir d'une description écrite et les rend en données binaires que le workflow stocke ou envoie. Aucun fichier en entrée ici, seulement le prompt.
Paramètres clés
- Prompt : la description du visuel voulu, la plus concrète possible.
- Number of Images : le nombre de variantes produites en une exécution.
- Put Output in Field : le nom du champ de sortie qui portera le fichier binaire, lu ensuite par le nœud suivant.
Edit an image
image.editCe que tu vois dans n8n
Notes & cas d'usage
Reprend des images que tu possèdes déjà et les modifie selon une consigne. Le point de départ n'est donc pas une page blanche mais ton propre visuel.
Paramètres clés
- Prompt : la consigne de retouche, par exemple combiner la première image avec la seconde.
- Images : la collection où tu ajoutes un ou plusieurs champs binaires à joindre au prompt.
- Binary Field Name : le champ qui contient les données d'image, à préciser quand le nom par défaut ne correspond pas à ce que le nœud précédent a produit.
Media File
1 opérationUpload a media file
file.uploadCe que tu vois dans n8n
Notes & cas d'usage
Pousse un fichier vers l'API Google Gemini et l'y conserve pour un usage ultérieur, ce qui évite de renvoyer le même gros média à chaque appel.
Paramètres clés
- Input Type :
urlpour récupérer depuis URL,binarypour prendre le fichier dans le workflow. - Input Data Field Name : la propriété binaire qui contient le fichier, souvent
dataquand il sort d'un nœud de téléchargement.
Text
1 opérationMessage a model
text.messageCe que tu vois dans n8n
Notes & cas d'usage
L'opération texte : une réponse d'un modèle Gemini, avec le jeu d'options le plus large du nœud.
Paramètres clés
- Messages : la conversation envoyée, chaque entrée portant un Prompt et un Role,
userpour poser la question,modelpour imposer un ton ou une personnalité. - System Message : les consignes permanentes valables pour tout l'appel.
- Output Randomness (Temperature) : à baisser pour des réponses reproductibles, à monter quand la variété est recherchée.
- Thinking Budget :
0coupe le raisonnement automatique,-1le laisse dynamique.
Video
3 opérationsAnalyze video
video.analyzeCe que tu vois dans n8n
Notes & cas d'usage
Répond à des questions sur le contenu d'une vidéo, ce qui transforme un fichier que personne n'a le temps de regarder en quelques phrases exploitables.
Paramètres clés
- Text Input : la question posée au modèle sur les images.
- URL(s) : les adresses des vidéos, séparées par des virgules pour en traiter plusieurs, ou Input Data Field Name(s) en entrée binaire.
- Simplify Output : coché, la réponse revient allégée plutôt que brute.
Generate a video
video.generateCe que tu vois dans n8n
Notes & cas d'usage
Construit une vidéo depuis un prompt écrit. La génération prend plus de temps qu'une image, d'où le choix laissé sur la forme du résultat.
Paramètres clés
- Prompt : la description du plan souhaité.
- Return As :
videopour un fichier binaire dans le workflow,urlpour une adresse à télécharger plus tard. - Aspect Ratio :
16:9pour les écrans,9:16pour le format vertical court. - Person Generation :
dont_allow,allow_adultouallow_all, selon ce que la marque accepte de montrer.
Download a video
video.downloadCe que tu vois dans n8n
Notes & cas d'usage
Récupère une vidéo générée auprès de l'API Google Gemini à partir de l'adresse qu'elle a renvoyée, et ramène le fichier dans le workflow en binaire.
Paramètres clés
- URL : l'adresse de l'API Gemini où télécharger, en général
{{ $json.url }}repris de l'étape de génération. - Put Output in Field : le champ de sortie qui reçoit les données binaires du fichier.
Besoin d'aide pour automatiser Google Gemini avec n8n ?
L'équipe te répond directement.
Chaque message est lu par une personne.
Google Gemini et n8n : les questions fréquentes
01Le nœud Google Gemini est-il inclus dans n8n ?
02Que faut-il authentifier pour utiliser le nœud Google Gemini n8n ?
03Quelles sont les limites du nœud Google Gemini ?
04Quand prendre ce nœud plutôt que le nœud AI Agent ?
05n8n ou Make pour travailler avec Google Gemini ?
Reçois nos tips intégration chaque semaine.
Pas de spam. Désinscription à tout moment.


