Recursos · Integración n8n

Nodo Vercel AI Gateway Chat Model n8nConfigura Vercel AI Gateway Chat Model en n8n.

Este nodo hace una sola cosa: entregar un modelo de chat a un nodo que razona. El nodo Vercel AI Gateway Chat Model n8n es un subnodo, un nodo auxiliar que se acopla a otro más grande en lugar de ejecutarse solo. Expone 9 parámetros y encaja en el puerto Model.

Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth

Por qué automatizar

¿Qué hace el nodo Vercel AI Gateway Chat Model n8n?

Aporta el modelo de lenguaje que un nodo raíz usa para generar texto. En la arquitectura de IA de n8n, un nodo raíz como AI Agent recibe los items del flujo por su entrada principal, y los subnodos se acoplan a sus puertos: un modelo, una memoria, un output parser. Este ocupa la plaza del modelo y enruta las llamadas por Vercel AI Gateway en vez de ir directo a un proveedor.

Lo primero que conviene asumir: este nodo nunca se ejecuta por su cuenta. No tiene entrada principal. Coloca un AI Agent en el lienzo y verás debajo un puerto Model vacío. Ahí se engancha este nodo, y mientras siga vacío el agente no arranca.

Tres situaciones reales. Una tienda que recibe incidencias por Gmail: el agente lee el mensaje, el modelo redacta el borrador, y Sampling Temperature decide si ese borrador se mantiene sobrio o se pone creativo donde no toca. Un inventario que hay que ordenar en Google Sheets: aquí la salida tiene que ser legible por el nodo siguiente, así que Response Format va en json_object. Un resumen de ventas que cae cada mañana en Slack: Maximum Number of Tokens evita el ladrillo que nadie abrirá.

Elegir este nodo frente al nodo de un proveedor concreto es una decisión de enrutado, no de calidad. Si tu tráfico ya pasa por AI Gateway, este nodo mantiene ese camino y carga la lista de modelos desde la pasarela. Si llamas a un solo proveedor en directo, el camino corto sigue siendo su nodo dedicado: OpenAI, Anthropic o Google Gemini tienen cada uno su subnodo de modelo de chat.

Dos límites antes de construir. El desplegable de modelos se carga de forma dinámica desde AI Gateway: muestra lo que tu cuenta alcanza y nada más. Un flujo exportado a otra instancia puede apuntar a un modelo que allí no aparece. Y el nodo solo tiene una versión, la 1, así que ningún flujo antiguo te mostrará un panel con menos opciones.

La factura no cambia de sitio. n8n no añade nada al nodo; el proveedor del modelo cobra sus propias llamadas de API según sus condiciones.

Conexión

¿Qué hace falta antes de ejecutarlo?

  1. 01

    Crea el credential una vez

    Abre el menú Credentials de n8n y añade el credential de Vercel que el nodo pide. Un credential es el acceso que n8n guarda a nivel de instancia: todos los flujos de esa instancia lo reutilizan en lugar de guardar cada uno su copia. Hazlo antes de abrir el panel del nodo y los desplegables ya tendrán con quién hablar.

  2. 02

    Engancha el nodo a un nodo raíz

    Arrastra el nodo hasta el puerto Model de un agente, una cadena u otro nodo raíz que acepte un modelo de lenguaje. Esa unión es la ruta de ejecución: como el subnodo no tiene entrada principal, solo se dispara cuando el nodo de arriba pide una completación. Suelto en el lienzo se queda gris y no se ejecuta nunca.

  3. 03

    Elige el modelo

    Abre el nodo y selecciona un valor en Model. n8n consulta AI Gateway y lista los modelos que tu cuenta alcanza, por eso la lista cambia de una instancia a otra. Deja la sección Options en paz en la primera prueba y vuelve después con los parámetros que de verdad necesites.

Conexiones

¿Dónde se conecta este nodo?

n8n reparte el trabajo de IA entre un nodo raíz que lleva la lógica y subnodos que aportan las piezas, un tipo de pieza por puerto.

Salida (dónde se conecta)

  • Modelai_languageModel
01ModelEs el único puerto del nodo, y es de salida: el nodo entrega un modelo de chat hacia arriba, al nodo raíz que lo reclama. El tipo de puerto se llama ai_languageModel, así que cualquier nodo raíz que declare ese puerto acepta este subnodo sin ajustes extra.

Es el único puerto del nodo, y es de salida: el nodo entrega un modelo de chat hacia arriba, al nodo raíz que lo reclama. El tipo de puerto se llama ai_languageModel, así que cualquier nodo raíz que declare ese puerto acepta este subnodo sin ajustes extra.

Parámetros clave

  • Required: sin modelo en este puerto, el nodo raíz no arranca.
  • AI Agent: el anfitrión habitual, cuando el flujo necesita herramientas y un bucle.
  • Question and Answer Chain: responde preguntas a partir de un contexto.
  • Sentiment Analysis: clasifica el tono de cada item entrante.
Casos de uso
el mismo nodo puede servir a un AI Agent Tool en una rama y a una Summarization Chain en otra, porque cada raíz lo llama a su ritmo.
Parámetros

¿Qué parámetros se tocan de verdad?

El nodo Vercel AI Gateway Chat Model tiene 9 parámetros. Para cada uno: el nodo tal como lo configuras en n8n, qué cambia el parámetro y nuestras notas de campo.

01

Model

model

Lo que ves en n8n

Notas y casos de uso

Señala el modelo que genera la completación. n8n carga la lista desde AI Gateway justo cuando abres el desplegable, así que lo que ves refleja tu cuenta y no un catálogo fijo incluido en el nodo.

Parámetros clave

  • Model: el propio desplegable, rellenado de forma dinámica desde la pasarela; solo aparecen los modelos disponibles para tu cuenta.
Casos de uso
cambiar de modelo en una cadena que redacta fichas de producto sin tocar nada más del flujo, porque el resto de ajustes se queda donde está.
02

Frequency Penalty

options.frequencyPenalty

Lo que ves en n8n

Notas y casos de uso

Súbelo cuando el modelo repite la misma línea palabra por palabra. Los valores positivos penalizan los tokens según las veces que ya han aparecido en el texto, siendo un token el trozo de texto que un modelo lee y escribe de uno en uno.

Parámetros clave

  • Frequency Penalty: un número; cuanto más alto, menos se repite el modelo.
Casos de uso
un generador de descripciones que arranca todos los párrafos igual pide exactamente este ajuste.
03

Maximum Number of Tokens

options.maxTokens

Lo que ves en n8n

Notas y casos de uso

Pone techo a la longitud de la completación. Fijas el valor y el modelo se detiene ahí, que es la forma más simple de caber en un campo de mensaje con su propio límite de tamaño.

Parámetros clave

  • Maximum Number of Tokens: un número que fija la longitud de salida; la mayoría de modelos tienen una longitud de contexto de 2048 tokens, salvo los más recientes que llegan a 32,768.
Casos de uso
un resumen diario que debe caber en un solo mensaje de chat y no en tres pantallas.
04

Response Format

options.responseFormat

Lo que ves en n8n

Notas y casos de uso

Solo hay dos opciones, pero cambian lo que el nodo siguiente puede hacer con la respuesta. Texto para prosa, JSON en cuanto un nodo posterior tenga que leer campos en vez de frases.

Parámetros clave

  • Text (text): una respuesta de texto normal.
  • JSON (json_object): activa el modo JSON, que debería garantizar que el mensaje generado sea JSON válido.
Casos de uso
sacar un nombre y un importe de un correo entrante antes de escribirlos en una fila de hoja de cálculo.
05

Presence Penalty

options.presencePenalty

Lo que ves en n8n

Notas y casos de uso

Empuja al modelo hacia temas que todavía no ha tocado. Los valores positivos penalizan los tokens por el simple hecho de aparecer ya en el texto, lo que aumenta la probabilidad de que la respuesta pase a otra cosa.

Parámetros clave

  • Presence Penalty: un número; cuanto más alto, más probable es que el modelo hable de temas nuevos.
Casos de uso
una fase de lluvia de ideas que se queda dando vueltas al mismo ángulo y necesita abrirse.
06

Sampling Temperature

options.temperature

Lo que ves en n8n

Notas y casos de uso

El azar se regula aquí. Al bajar el valor las completaciones son menos aleatorias, y a medida que la temperatura se acerca a cero el modelo se vuelve determinista y repetitivo. Ideal en unos flujos, inservible en otros.

Parámetros clave

  • Sampling Temperature: un número; una temperatura alta diversifica el muestreo pero aumenta el riesgo de alucinaciones.
Casos de uso
una fase de clasificación que debe devolver la misma etiqueta para la misma entrada en cada ejecución.
07

Timeout

options.timeout

Lo que ves en n8n

Notas y casos de uso

Cada petición recibe un techo de tiempo. Este se expresa en milisegundos y define la duración máxima que una petición puede tardar antes de que el nodo la abandone.

Parámetros clave

  • Timeout: un número, en milisegundos, que limita una petición.
Casos de uso
un flujo disparado por un formulario, donde quien mira el indicador de carga prefiere un fallo rápido a una respuesta que se eterniza.
08

Max Retries

options.maxRetries

Lo que ves en n8n

Notas y casos de uso

Cuando una llamada falla, el nodo puede reintentarla por su cuenta antes de que la ejecución se detenga. El valor que escribes es el número máximo de reintentos, no el total de llamadas.

Parámetros clave

  • Max Retries: un número, el máximo de reintentos por petición.
Casos de uso
un proceso nocturno sin nadie delante, donde una llamada fallida no debería tumbar una ejecución que ya lleva cientos de items.
09

Top P

options.topP

Lo que ves en n8n

Notas y casos de uso

El muestreo por núcleo es la otra manera de dosificar la diversidad. Un valor de 0.5 significa que se consideran la mitad de las opciones ponderadas por probabilidad; al bajarlo, el modelo ignora las menos probables.

Parámetros clave

  • Top P: un número; la recomendación general es mover este o la temperatura, pero no los dos.
Casos de uso
afinar una fase de redacción cuya temperatura ya está fijada y que prefieres no volver a tocar.
Necesitas ayuda

¿Necesitas ayuda para automatizar Vercel AI Gateway Chat Model con n8n?

El equipo te responde directamente.

Cada mensaje lo lee una persona.

FAQ

Lo que se pregunta después

01¿El nodo Vercel AI Gateway Chat Model n8n viene incluido en n8n?
Sí. Forma parte del paquete de IA que se entrega con n8n: nada que instalar y ningún coste extra por parte de n8n, tanto en n8n Cloud como en una instancia autoalojada en Community Edition bajo licencia Sustainable Use. El nodo es el mismo en ambos casos, y el flujo que montas alrededor también. Lo que sí cuesta es el proveedor del modelo, que cobra sus propias llamadas de API según sus condiciones. n8n no añade nada encima, ni en la edición autoalojada ni en la nube.
02¿Qué hace falta para que funcione?
Un credential y un nodo anfitrión. El credential se crea una sola vez desde el menú Credentials de n8n y luego se reutiliza en todos los flujos de esa instancia, así que no repites el mismo dato en cada sitio. El anfitrión es cualquier nodo raíz con puerto Model: un agente, una cadena, un extractor. Sin esa unión el subnodo no tiene entrada principal y no se ejecutará jamás. Con las dos piezas puestas, solo queda rellenar el campo Model.
03¿Qué límites tiene el nodo?
Genera completaciones y poco más. No lleva memoria dentro, no llama herramientas por sí mismo, no carga documentos: todo eso vive en otros subnodos conectados a otros puertos del mismo nodo raíz. La lista de modelos es la que AI Gateway expone a tu cuenta, de modo que un flujo movido a otra instancia puede apuntar a un modelo que allí no existe. Además el nodo tiene una sola versión, así que los parámetros visibles son todos los que hay.
04¿Qué hay que conectar como mínimo?
Un nodo raíz y un modelo, que es este nodo. Empieza por Basic LLM Chain si solo quieres que un prompt vuelva con una respuesta: una pasada y se acabó. Pasa a AI Agent cuando el flujo tenga que llamar herramientas o repetir una decisión. En el propio nodo, elige un valor en Model y deja la sección Options intacta la primera vez. Sampling Temperature o Response Format vienen después, cuando ya has visto qué salida da por defecto y sabes qué quieres corregir en ella.
05¿n8n o Make para este tipo de flujo con IA?
Depende de dónde quieras que viva el flujo. Make lo aloja Make, sin opción de autoalojamiento y con facturación por operación, algo cómodo para equipos que no quieren administrar nada. n8n se instala con Docker o npm en tu propia máquina, o se usa en n8n Cloud, y el flujo se comporta igual en los dos casos. Si tus llamadas de IA tocan datos de clientes que prefieres mantener en casa, el autoalojamiento zanja la duda. Si no, Make es una respuesta honesta.
Hack'celeration Lab

Recibe nuestros tips de integración cada semana.

Sin spam. Cancela cuando quieras.