Recursos · Integración n8n

Nodo Hugging Face Inference Model n8nConfigura Hugging Face Inference Model en n8n.

Un modelo abierto entra en el flujo en cuanto queda enganchado a una cadena. El nodo Hugging Face Inference Model n8n reúne 8 parámetros, desde el nombre del modelo hasta Top P, y no tiene entrada principal. Alimenta de texto generado al nodo raíz que lleva el puerto Model.

Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth

Por qué automatizar

¿Qué hace el nodo Hugging Face Inference Model n8n?

Es un subnodo, es decir, un nodo que nunca se ejecuta por su cuenta y no sirve de nada hasta que se engancha al puerto de otro más grande. Lo colocas en el lienzo, lo unes al puerto Model de una cadena y cada prompt que esa cadena envía viaja a un punto de inferencia de Hugging Face en lugar de a un modelo comercial alojado. El nodo guarda la elección del modelo y los ajustes de muestreo. La cadena de arriba guarda el prompt.

Primer caso: resumir texto libre. Llega una fila de Google Sheets con un comentario de cliente interminable, la cadena pide tres líneas de resumen y el nodo las devuelve con Maximum Number of Tokens ajustado a la baja para que la respuesta no se alargue. Todo corre sobre un modelo que has elegido tú, no sobre el que venía puesto.

Segundo caso: clasificar antes de repartir. Los mensajes de soporte entran por Gmail, la cadena pide al modelo una etiqueta para cada uno y Sampling Temperature se queda cerca de cero para que el mismo mensaje reciba la misma etiqueta dos veces seguidas. Esa etiqueta decide después si el flujo avisa por Slack o escribe en la hoja.

Tercer caso: redactar contra un punto de inferencia propio. Un equipo que ha afinado su modelo apunta Custom Inference Endpoint a ese despliegue, no toca nada más y obtiene borradores con el vocabulario de su propio corpus. El resto del flujo sigue igual.

¿Cuándo conviene otra cosa? Este nodo no admite herramientas, así que no funciona con el nodo AI Agent. Un agente que necesita llamar a herramientas pide un modelo de chat que las soporte, y para eso están los nodos de OpenAI o de Anthropic. Aquí la documentación manda a Basic LLM Chain, y este nodo se queda en trabajo de completado.

Dos límites antes de montar nada. El nodo está en versión 1, así que el panel que ves es el que se describe en esta página, sin opciones escondidas. Y el proveedor del modelo factura sus propias llamadas de API según sus condiciones, sin que n8n añada nada encima. Una generación larga se paga igual en algún sitio.

Conexión

¿Cómo se autentica el nodo?

  1. 01

    Abrir el menú Credentials

    En n8n, un credential es un juego de datos de autenticación guardado una sola vez y reutilizado por todos los flujos que lo necesiten. Entra por el menú Credentials para crear el credential de Hugging Face, en vez de escribir nada dentro del propio nodo. Esa misma entrada servirá para todas las cadenas que montes después, tanto en n8n Cloud como en una instancia autoalojada.

  2. 02

    Rellenar el credential de Hugging Face

    Sigue los datos de autenticación que n8n documenta para Hugging Face y guarda el credential con un nombre que reconozcas dentro de seis meses. Un huggingface-prod funciona mejor que un credential 1 cuando tres personas comparten la instancia y dos están mirando la misma ejecución fallida.

  3. 03

    Seleccionar el credential en el nodo

    De vuelta al lienzo, abre el nodo Hugging Face Inference Model y elige el credential en la lista de arriba del panel. Después arrastra una conexión del nodo al puerto Model de un nodo raíz. Un subnodo sin conectar se queda ahí sin ejecutarse nunca, y ese es el motivo número uno por el que una cadena avisa de que no encuentra ningún modelo.

Conexiones

¿Dónde se engancha este nodo?

n8n parte el trabajo de IA en dos: un nodo raíz recibe los items del flujo por su entrada principal y los subnodos se cuelgan de sus puertos, un tipo por puerto. Este es un subnodo con una única salida, así que la única duda de cableado es qué nodo raíz la recoge.

Salida (dónde se conecta)

  • Modelai_languageModel
01ModelEl puerto Model es el punto donde un nodo raíz reclama el modelo de lenguaje con el que va a hablar. Arrastra desde este nodo hasta ese puerto y la cadena deja de ser una cáscara vacía.

El puerto Model es el punto donde un nodo raíz reclama el modelo de lenguaje con el que va a hablar. Arrastra desde este nodo hasta ese puerto y la cadena deja de ser una cáscara vacía.

Parámetros clave

  • Required: un nodo raíz con puerto Model no devuelve nada mientras no tenga un subnodo de modelo enganchado.
  • Basic LLM Chain: el nodo raíz de prompt y respuesta, el que la documentación oficial recomienda para este modelo.
  • Summarization Chain: recibe una entrada larga y devuelve una versión condensada.
  • Question and Answer Chain: responde a una pregunta sobre el contenido que le pasas.
Casos de uso
un credential, una elección de modelo y el mismo nodo reaprovechado por una cadena de resumen y otra de clasificación dentro del mismo flujo.
Parámetros

¿Qué parámetros importan en el panel?

El nodo Hugging Face Inference Model tiene 8 parámetros. Para cada uno: el nodo tal como lo configuras en n8n, qué cambia el parámetro y nuestras notas de campo.

01

Model

model

Lo que ves en n8n

Notas y casos de uso

Indica el modelo que genera el completado. Lo demás del panel solo moldea su comportamiento, así que este es el primer campo que se rellena y el que se cambia cuando la calidad se tuerce.

Parámetros clave

  • Model: un campo de texto con el identificador del modelo; déjalo fijo para un modelo único, o gobiérnalo con una expresión {{ $json.model }} cuando un nodo anterior decida el modelo item por item.
Casos de uso
un flujo que manda los borradores cortos a un modelo pequeño y los resúmenes largos a uno mayor, con la propia fila llevando el nombre.
02

Custom Inference Endpoint

options.endpointUrl

Lo que ves en n8n

Notas y casos de uso

Dirige el nodo a una URL de inferencia propia en lugar del servicio por defecto. Déjalo vacío en el uso normal y rellénalo solo cuando el modelo viva en una infraestructura que controlas.

Parámetros clave

  • Custom Inference Endpoint: la URL del punto de inferencia personalizado, escrita entera o traída de un nodo anterior con {{ $json.endpoint }} cuando pruebas y producción no apuntan al mismo sitio.
Casos de uso
un modelo afinado y desplegado en un punto privado, llamado por la misma cadena que ya corría contra el compartido, sin tocar nada más.
03

Frequency Penalty

options.frequencyPenalty

Lo que ves en n8n

Notas y casos de uso

Los valores positivos penalizan los tokens nuevos según la frecuencia con la que ya aparecen en el texto, lo que reduce la probabilidad de que el modelo repita la misma línea palabra por palabra. Se toca cuando un texto generado empieza a dar vueltas sobre sí mismo.

Parámetros clave

  • Frequency Penalty: un número; súbelo cuando una respuesta larga recicle las mismas fórmulas, y déjalo quieto en salidas cortas y factuales donde la repetición no molesta.
Casos de uso
fichas de producto generadas en serie, donde los tres mismos adjetivos en todas las filas se notan antes que cualquier otra cosa.
04

Maximum Number of Tokens

options.maxTokens

Lo que ves en n8n

Notas y casos de uso

Pone un techo a los tokens que puede usar el completado. Un token es un trozo de texto, más o menos una palabra corta o un fragmento, y este ajuste decide si la respuesta cabe en una frase o en una página.

Parámetros clave

  • Maximum Number of Tokens: un número limitado por la longitud de contexto del modelo, que en la mayoría es de 2048 tokens, con los más recientes bastante por encima.
Casos de uso
una cadena que redacta avisos internos, con el techo bajo para que un resumen no llegue como un muro de texto que nadie lee.
05

Presence Penalty

options.presencePenalty

Lo que ves en n8n

Notas y casos de uso

Aquí la penalización salta en cuanto un token ha aparecido una vez, lo que empuja al modelo a abrir temas nuevos. Palanca distinta de Frequency Penalty: aquella pelea contra la repetición, esta contra quedarse clavado en un solo tema.

Parámetros clave

  • Presence Penalty: un número; súbelo cuando una lluvia de ideas gire siempre alrededor de la misma, y déjalo en reposo cuando la consigna sea no salirse del tema.
Casos de uso
generar enfoques para una campaña, donde cinco variantes del mismo enfoque tiran por tierra el motivo de haber preguntado.
06

Sampling Temperature

options.temperature

Lo que ves en n8n

Notas y casos de uso

Controla el azar. Bajarla produce completados menos aleatorios, y cuando la temperatura se acerca a cero el modelo se vuelve determinista y repetitivo. Es el primer parámetro que se toca cuando un flujo necesita respuestas reproducibles.

Parámetros clave

  • Sampling Temperature: un número; cerca de 0 para clasificar o extraer, donde la misma entrada debe dar la misma salida, y más alto cuando toca escribir algo nuevo.
Casos de uso
una cadena de triaje que etiqueta tickets entrantes, donde una etiqueta que cambia entre dos pasadas deja el reparto sin ninguna garantía.
07

Top K

options.topK

Lo que ves en n8n

Notas y casos de uso

Fija cuántos tokens candidatos considera el modelo dentro de la operación de muestreo para crear el texto siguiente. Estrechar ese grupo mantiene la salida pegada a la continuación más previsible.

Parámetros clave

  • Top K: un número que marca el tamaño de ese grupo de candidatos; un valor pequeño aprieta la generación, uno grande deja volver a los tokens menos probables.
Casos de uso
reescribir texto libre desordenado siguiendo una plantilla de frase fija, donde salirse de la redacción esperada rompe lo que la interpreta más adelante.
08

Top P

options.topP

Lo que ves en n8n

Notas y casos de uso

Regula la diversidad mediante muestreo de núcleo: 0.5 significa que se consideran la mitad de las opciones ponderadas por probabilidad. La recomendación oficial es tocar este parámetro o la temperatura, pero no los dos a la vez.

Parámetros clave

  • Top P: un número; bájalo para ignorar las opciones menos probables, y elige entre él y Sampling Temperature en lugar de ajustar ambos.
Casos de uso
un equipo que ya tiene una temperatura de confianza y quiere un punto más de control sin volver a abrir aquel ajuste.
Necesitas ayuda

¿Necesitas ayuda para automatizar Hugging Face Inference Model con n8n?

El equipo te responde directamente.

Cada mensaje lo lee una persona.

FAQ

Lo que se pregunta después

01¿El nodo Hugging Face Inference Model n8n es gratuito?
Sí. Forma parte del paquete de IA de n8n, publicado como @n8n/n8n-nodes-langchain, y está disponible tanto en n8n Cloud como en una instancia autoalojada con la Community Edition bajo licencia Sustainable Use. No hay nada que instalar ni sobrecoste por el nodo en el lado de n8n. Lo que sí cuesta es el proveedor del modelo, que factura sus propias llamadas de API según sus condiciones. Conviene tenerlo claro al comparar un modelo abierto llamado desde este nodo con un modelo comercial alojado: la parte de n8n de la factura es la misma en ambos casos.
02¿Qué hace falta para que el nodo funcione?
Dos cosas. Un credential de Hugging Face, creado una vez desde el menú Credentials y reutilizado por todos los flujos de la instancia, y un nodo raíz al que engancharse. Este nodo es un subnodo: no tiene entrada principal, no se ejecuta solo y no pasa nada hasta que su salida llega al puerto Model de algo como Basic LLM Chain. Un credential sin conexión deja un nodo inerte, y una conexión sin credential deja una cadena que falla en la primera llamada. Prepara las dos cosas antes de ejecutar.
03¿Qué límites tiene este nodo?
El principal es que no admite herramientas. Por eso no funciona con el nodo AI Agent, y la documentación manda usar Basic LLM Chain en su lugar. El nodo está en versión 1, así que el panel contiene el selector de modelo y las 7 opciones descritas arriba, nada más. Un flujo antiguo puede seguir mostrando una versión anterior con menos opciones. Y el techo de tokens es del modelo, no de n8n: la mayoría tiene una longitud de contexto de 2048 tokens, y los más recientes van mucho más lejos.
04¿Qué hay que conectar como mínimo y por qué subnodo empezar?
Como mínimo, un credential y un nodo raíz. Empieza por Basic LLM Chain, el nodo raíz más simple del conjunto: recibe un prompt, lo manda al modelo colgado de su puerto Model y devuelve la respuesta. Cuando eso funcione de principio a fin, mover el mismo nodo de modelo a una Summarization Chain o a una Question and Answer Chain es cuestión de arrastrar el ratón, porque el tipo de puerto no cambia. Deja los agentes para más adelante, ya que este nodo de modelo no puede servir a uno.
05¿n8n o Make para trabajar con modelos abiertos?
Depende de dónde tengan que quedarse los datos. n8n se autoaloja con Docker o npm, así que los prompts y los completados se quedan en una infraestructura que controlas, y el mismo flujo corre igual en n8n Cloud. Make solo existe alojado, sin opción de autoalojamiento, y factura por operación, lo que cambia la cuenta en una cadena de mucho volumen. Su editor visual es una ventaja real en procesos lineales. Para un flujo de IA hecho de un nodo raíz y varios subnodos, el modelo de n8n encaja mejor con la forma del trabajo.
Hack'celeration Lab

Recibe nuestros tips de integración cada semana.

Sin spam. Cancela cuando quieras.