- Accueil
- Ressources
- Intégrations
- Vercel AI Gateway Chat Model
Nœud Vercel AI Gateway Chat Model n8nConfigurer Vercel AI Gateway Chat Model dans n8n.
Ce nœud ne fait qu'une chose : fournir un modèle de chat à un nœud qui raisonne. Le nœud Vercel AI Gateway Chat Model n8n est un sous-nœud, un nœud auxiliaire qui se raccorde à un plus gros au lieu de tourner seul. Il expose 9 paramètres et se clipse sur le port Model.
Avis vérifiés sur Trustpilot · Agence IA, automatisation & growth
À quoi sert le nœud Vercel AI Gateway Chat Model n8n ?
Il apporte le modèle de langage qu'un nœud racine utilise pour générer du texte. Dans l'architecture IA de n8n, un nœud racine comme AI Agent reçoit les items du workflow sur son entrée principale, et des sous-nœuds viennent se brancher sur ses ports : un modèle, une mémoire, un output parser. Celui-ci occupe l'emplacement du modèle, en passant les appels par Vercel AI Gateway plutôt que directement chez un fournisseur.
Premier réflexe à prendre : ce nœud ne s'exécute jamais tout seul. Il n'a pas d'entrée principale. Pose un AI Agent sur le canevas, un port Model vide apparaît dessous. C'est là que ce nœud se raccroche, et tant que rien n'y est branché, l'agent refuse de démarrer.
Trois situations parlantes. Une PME qui reçoit des demandes de devis par Gmail : l'agent lit le mail, le modèle rédige la réponse, et c'est Sampling Temperature qui décide si le brouillon reste sobre ou part en improvisation. Un catalogue produits à nettoyer dans Google Sheets : là, il faut une sortie que la ligne suivante sache relire, donc Response Format réglé sur json_object. Un résumé d'activité poussé chaque matin dans Slack : Maximum Number of Tokens évite le pavé que personne ne lira.
Choisir ce nœud plutôt qu'un nœud de fournisseur, c'est une question de routage, pas de qualité. Si ton trafic passe déjà par AI Gateway, ce nœud garde ce chemin et charge la liste des modèles depuis la passerelle. Si tu appelles un seul fournisseur en direct, le chemin court reste son nœud dédié : OpenAI, Anthropic ou Google Gemini ont chacun leur sous-nœud de modèle de chat.
Deux limites à connaître avant de construire. La liste déroulante des modèles est chargée dynamiquement depuis AI Gateway : elle montre ce que ton compte peut atteindre, rien d'autre. Un workflow exporté vers une autre instance peut donc pointer vers un modèle absent de la liste là-bas. Et le nœud n'a qu'une version, la 1 : aucun vieux workflow ne viendra t'afficher un panneau avec moins d'options.
Côté facture, rien ne bouge du côté de n8n. C'est le fournisseur du modèle qui facture ses propres appels d'API, selon ses conditions.
Qu'est-ce qu'il faut avant que le nœud tourne ?
- 01
Créer le credential une fois
Ouvre le menu Credentials de n8n et ajoute le credential Vercel attendu par le nœud. Un credential, c'est l'accès stocké par n8n au niveau de l'instance : tous les workflows de cette instance le réutilisent au lieu d'en garder chacun une copie. Fais-le avant d'ouvrir le panneau du nœud, les listes déroulantes auront déjà de quoi répondre.
- 02
Raccorder le nœud à un nœud racine
Tire le nœud jusqu'au port Model d'un agent, d'une chaîne ou d'un autre nœud racine qui accepte un modèle de langage. Cette liaison est le chemin d'exécution : le sous-nœud n'ayant pas d'entrée principale, il ne se déclenche que lorsque le nœud du dessus réclame une complétion. Posé dans le vide, il reste gris et ne tourne jamais.
- 03
Choisir le modèle
Ouvre le nœud et sélectionne une valeur dans Model. n8n interroge AI Gateway et affiche les modèles accessibles à ton compte, d'où des listes qui diffèrent d'une instance à l'autre. Laisse la section Options tranquille au premier essai, tu y reviendras avec les paramètres dont tu as vraiment besoin.
Où ce nœud se branche-t-il ?
n8n répartit le travail IA entre un nœud racine qui porte la logique et des sous-nœuds qui fournissent les briques, un type de brique par port.
Sortie (où il se branche)
- Model
ai_languageModel
01Model
C'est le seul port du nœud, et c'est une sortie : le nœud remonte un modèle de chat vers le nœud racine qui en réclame un. Le type de port s'appelle ai_languageModel, donc tout nœud racine qui déclare ce port accepte ce sous-nœud sans réglage supplémentaire.
Paramètres clés
- Required : sans modèle sur ce port, le nœud racine ne démarre pas.
- AI Agent : l'hôte habituel, quand le workflow a besoin d'outils et d'une boucle.
- Basic LLM Chain : un prompt, une réponse, pas d'outils.
- Text Classifier : range chaque item entrant dans une catégorie.
Quels paramètres régler vraiment ?
Le nœud Vercel AI Gateway Chat Model compte 9 paramètres. Pour chacun : le nœud tel que tu le configures dans n8n, ce que le paramètre change, et nos notes de terrain.
Sommaire des paramètres
Model
modelCe que tu vois dans n8n
Notes & cas d'usage
Désigne le modèle qui génère la complétion. n8n charge la liste depuis AI Gateway au moment où tu ouvres le menu déroulant : ce que tu vois reflète ton compte, pas un catalogue figé livré avec le nœud.
Paramètres clés
- Model : la liste déroulante elle-même, remplie dynamiquement depuis la passerelle ; seuls les modèles disponibles pour ton compte apparaissent.
Frequency Penalty
options.frequencyPenaltyCe que tu vois dans n8n
Notes & cas d'usage
Monte-le quand le modèle repique la même formulation d'une phrase à l'autre. Les valeurs positives pénalisent les tokens selon le nombre de fois où ils sont déjà apparus, un token étant le morceau de texte qu'un modèle lit et écrit un par un.
Paramètres clés
- Frequency Penalty : un nombre ; plus il est élevé, moins le modèle se répète.
Maximum Number of Tokens
options.maxTokensCe que tu vois dans n8n
Notes & cas d'usage
Plafonne la longueur de la complétion. Tu fixes la valeur, le modèle s'arrête là : c'est la façon la plus simple de tenir dans un champ de message qui a sa propre limite de taille.
Paramètres clés
- Maximum Number of Tokens : un nombre qui fixe la longueur de sortie ; la plupart des modèles ont une longueur de contexte de
2048tokens, sauf les plus récents qui montent à32,768.
Response Format
options.responseFormatCe que tu vois dans n8n
Notes & cas d'usage
Deux choix seulement, mais ils changent ce que le nœud suivant saura faire de la réponse. Texte pour de la prose, JSON dès qu'un nœud en aval doit lire des champs plutôt que des phrases.
Paramètres clés
- Text (
text) : une réponse en texte classique. - JSON (
json_object) : active le mode JSON, censé garantir que le message généré est du JSON valide.
Presence Penalty
options.presencePenaltyCe que tu vois dans n8n
Notes & cas d'usage
Pousse le modèle vers des sujets qu'il n'a pas encore abordés. Les valeurs positives pénalisent les tokens selon leur simple présence dans le texte, ce qui augmente les chances que la réponse passe à autre chose.
Paramètres clés
- Presence Penalty : un nombre ; plus il est élevé, plus le modèle part sur de nouveaux sujets.
Sampling Temperature
options.temperatureCe que tu vois dans n8n
Notes & cas d'usage
Le hasard se règle ici. En baissant la valeur, les complétions deviennent moins aléatoires, et à mesure que la température approche de zéro le modèle devient déterministe et répétitif. Parfait dans certains workflows, inutilisable dans d'autres.
Paramètres clés
- Sampling Temperature : un nombre ; une température haute diversifie l'échantillonnage mais augmente le risque d'hallucinations.
Timeout
options.timeoutCe que tu vois dans n8n
Notes & cas d'usage
Chaque requête reçoit un plafond de temps. Celui-ci s'exprime en millisecondes et définit la durée maximale qu'une requête a le droit de prendre avant que le nœud abandonne.
Paramètres clés
- Timeout : un nombre, en millisecondes, qui borne une requête.
Max Retries
options.maxRetriesCe que tu vois dans n8n
Notes & cas d'usage
Quand un appel échoue, le nœud peut retenter de lui-même avant que l'exécution s'arrête. La valeur saisie correspond au nombre maximum de relances, pas au nombre total d'appels.
Paramètres clés
- Max Retries : un nombre, le maximum de relances par requête.
Top P
options.topPCe que tu vois dans n8n
Notes & cas d'usage
L'échantillonnage par noyau est l'autre manière de doser la diversité. Une valeur de 0.5 signifie que la moitié des options pondérées par vraisemblance sont prises en compte ; en descendant, le modèle ignore les moins probables.
Paramètres clés
- Top P : un nombre ; la recommandation générale est de modifier celui-ci ou la température, pas les deux.
Besoin d'aide pour automatiser Vercel AI Gateway Chat Model avec n8n ?
L'équipe te répond directement.
Chaque message est lu par une personne.
Les questions qui suivent
01Le nœud Vercel AI Gateway Chat Model n8n est-il inclus dans n8n ?
02Qu'est-ce qu'il faut pour qu'il fonctionne ?
03Quelles sont les limites du nœud ?
04Que faut-il brancher au minimum ?
05n8n ou Make pour ce type de workflow IA ?
Reçois nos tips intégration chaque semaine.
Pas de spam. Désinscription à tout moment.
