- Accueil
- Ressources
- Intégrations
- NVIDIA Nemotron Embeddings
Nœud NVIDIA Nemotron Embeddings n8nConfigurer NVIDIA Nemotron Embeddings dans n8n.
Le nœud NVIDIA Nemotron Embeddings n8n transforme du texte en vecteurs, la matière première d'une recherche sémantique. C'est un sous-nœud : pas d'entrée principale, jamais d'exécution seul, il se branche sur un port. Cinq paramètres pilotent le modèle, les lots, le nettoyage, la taille et le délai.
Avis vérifiés sur Trustpilot · Agence IA, automatisation & growth
À quoi sert le nœud NVIDIA Nemotron Embeddings n8n ?
Il interroge un modèle d'embeddings NeMo Retriever, hébergé par NVIDIA sur build.nvidia.com ou tournant dans un conteneur NIM chez toi, et renvoie la version numérique de ton texte. Côté n8n, c'est un sous-nœud : un petit nœud qu'on accroche à un plus gros, au lieu de le poser dans le fil des items. Le nœud racine choisit ce qu'il faut vectoriser, celui-ci choisit avec quel modèle et sous quelle forme partent les requêtes.
Premier terrain, la base de connaissance interne. Des lignes de procédure sortent d'un nœud Google Sheets, arrivent dans un vector store en mode indexation, et ce store réclame un vecteur par ligne à notre sous-nœud. Le modèle se choisit une fois dans Model, dans la liste ou en tapant l'identifiant servi par ton conteneur NIM, et il vaut pour toute l'exécution.
Deuxième terrain, la partie recherche d'un assistant de support. Un AI Agent interroge le store, le store fait vectoriser la question ici, et les passages les plus proches reviennent en contexte. Le nœud positionne input_type tout seul, passage à l'indexation et query à la recherche : aucune bascule à gérer entre les deux.
Troisième terrain, le déploiement privé. Tu pointes le credential (l'identifiant enregistré dans n8n) vers un NIM posé sur ton infrastructure, rien n'en sort, et le workflow reste rigoureusement le même que sa version cloud. C'est aussi là que Dimensions prend son sens : un modèle Matryoshka sait rendre des vecteurs plus courts, pratique pour une base qu'on veut garder légère.
Quand préférer autre chose ? Quand un autre fournisseur est déjà câblé chez toi pour d'autres raisons, un credential OpenAI par exemple, une deuxième clé à gérer n'apporte pas grand-chose. NVIDIA facture les appels qu'il sert selon ses propres conditions, n8n n'ajoute rien par-dessus.
Deux limites à connaître avant de construire. Le nœud est en version 1 et expose cinq paramètres, pas un de plus : ni relance automatique, ni en-tête personnalisé, ni réglage à la requête. Et comme il n'a pas d'entrée principale, impossible de le tester isolément, on lance le nœud racine et on regarde ce que le store recrache. L'Avis n8n traite la plateforme elle-même, la Formation n8n déroule une chaîne d'indexation complète.
Quel credential faut-il créer ?
- 01
Ouvrir un compte NVIDIA build
L'accès cloud passe par build.nvidia.com, donc tout commence là. Connexion, ouverture d'un modèle Nemotron dans le catalogue, puis Get API Key. La clé appartient au compte et pas à un modèle précis : une seule suffit pour tous les modèles NeMo Retriever que tu sélectionneras ensuite dans le nœud. Avec un conteneur NIM auto-hébergé, cette étape saute.
- 02
Créer le credential NVIDIA Nemotron dans n8n
Dans le menu Credentials, crée le credential NVIDIA Nemotron. Il demande une Base URL, l'adresse compatible avec la spécification OpenAI, et une API Key. La Base URL par défaut est
https://integrate.api.nvidia.com/v1, celle sur laquelle répondent les modèles cloud. Colle la clé copiée dans API Key. Créé une fois, ce credential se réutilise dans tous les workflows. - 03
Ou viser ton NIM avec le même credential
Un seul credential couvre les deux modes de déploiement. Pour un conteneur à toi, remplace la Base URL par l'adresse de ton NIM en gardant le chemin
/v1, du typehttp://localhost:8000/v1. Si ce conteneur exige une authentification, colle son jeton dans API Key. Sinon, laisse le champ vide : c'est le seul cas où la clé devient facultative.
Sur quel port se branche ce sous-nœud ?
n8n répartit le travail IA entre un nœud racine, qui reçoit les items du workflow, et des sous-nœuds accrochés à ses ports, un type de sous-nœud par port. Notre nœud est un sous-nœud, et le port ci-dessous est sa seule porte d'entrée dans un workflow.
Sortie (où il se branche)
- Embeddings
ai_embedding
01Embeddings
Le port ai_embedding est celui que ce nœud alimente. Un nœud racine qui range ou interroge des vecteurs le propose, et tant que la liaison n'existe pas, le nœud n'a rien à traiter. Le branchement n'est possible que là où ce port est offert, jamais sur un port de modèle de chat ou de mémoire.
Paramètres clés
- Required : privé d'entrée principale, le nœud ne s'exécute que lorsqu'un nœud racine lui réclame des vecteurs.
Que changent les 5 paramètres ?
Le nœud NVIDIA Nemotron Embeddings compte 5 paramètres. Pour chacun : le nœud tel que tu le configures dans n8n, ce que le paramètre change, et nos notes de terrain.
Sommaire des paramètres
Model
modelCe que tu vois dans n8n
Notes & cas d'usage
Seul paramètre obligatoire : il désigne le modèle d'embeddings NeMo Retriever qui produit les vecteurs. C'est un sélecteur de ressource, donc soit tu prends dans la liste chargée via le credential, soit tu tapes directement un identifiant, la manière de viser un modèle servi par un NIM.
Paramètres clés
- Model : requis. Le nœud règle
input_typede lui-même,passageà l'indexation etqueryà la recherche.
Batch Size
options.batchSizeCe que tu vois dans n8n
Notes & cas d'usage
Le regroupement compte dès qu'une exécution dépasse la poignée de lignes. Cette option fixe le nombre maximum de documents empaquetés dans chaque requête au modèle, ce qui décide si un gros import part en quelques appels ou en centaines.
Paramètres clés
- Batch Size : un nombre, le plafond par requête. À baisser quand un import volumineux commence à échouer, à monter quand l'indexation traîne.
Strip New Lines
options.stripNewLinesCe que tu vois dans n8n
Notes & cas d'usage
Un texte brut arrive rarement propre. Activée, cette case supprime les retours à la ligne du texte d'entrée avant l'envoi, ce qui vaut le coup sur du contenu qui traîne une mise en forme dont personne n'a besoin.
Paramètres clés
- Strip New Lines : une case à cocher. Garde le même réglage à l'indexation et à la recherche, pour que les deux côtés voient le texte sous la même forme.
Dimensions
options.dimensionsCe que tu vois dans n8n
Notes & cas d'usage
La longueur des vecteurs se négocie sur certains modèles. Saisir un nombre ici réclame des embeddings de cette taille en sortie ; laisser le champ vide conserve ce que le modèle renvoie par défaut.
Paramètres clés
- Dimensions : un nombre, honoré uniquement par les modèles à embeddings dynamiques (Matryoshka). Sur les autres, mieux vaut ne pas y toucher.
Timeout
options.timeoutCe que tu vois dans n8n
Notes & cas d'usage
Une requête qui ne répond jamais coûte plus cher qu'une requête en erreur. Cette valeur plafonne la durée d'un appel, exprimée en secondes, et -1 retire le plafond.
Paramètres clés
- Timeout : un nombre de secondes. Un NIM qui vient de démarrer est la raison habituelle de le remonter.
Besoin d'aide pour automatiser NVIDIA Nemotron Embeddings avec n8n ?
L'équipe te répond directement.
Chaque message est lu par une personne.
Les questions qui reviennent sur ce nœud
01Le nœud NVIDIA Nemotron Embeddings est-il inclus dans n8n ?
02Que faut-il pour qu'il fonctionne ?
03Quelles sont les limites du nœud ?
04Que faut-il brancher au minimum sur le nœud NVIDIA Nemotron Embeddings n8n ?
05n8n ou Make pour ce type de chaîne d'embeddings ?
Reçois nos tips intégration chaque semaine.
Pas de spam. Désinscription à tout moment.

