Recursos · Integración n8n

Nodo Default Data Loader n8nConfigura Default Data Loader en n8n.

Un modelo no lee archivos, lee documentos, y esa conversión es justo lo que hace este nodo. El nodo Default Data Loader n8n toma el JSON o el archivo binario del paso anterior, lo pasa por un divisor de texto y entrega los fragmentos a la cadena que tiene encima. Seis parámetros y un puerto obligatorio.

Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth

Por qué automatizar

¿Para qué sirve el nodo Default Data Loader n8n?

Default Data Loader es un subnodo, es decir, un nodo que nunca se ejecuta por su cuenta: se arrastra sobre el puerto de un nodo raíz y lo alimenta. Lee el dato del paso anterior del flujo, ya sea el JSON del item que entra o un archivo binario adjunto, y lo convierte en documentos, el formato troceado que los nodos de IA saben leer. Su descripción dentro de n8n lo resume en una línea: cargar el dato del paso anterior.

Primer caso, actas y normativa interna. El archivo entra en el flujo, Type of Data se pone en Binary, Data Format en PDF y Split Pages in PDF genera un documento por página. Así un artículo concreto sigue ligado a la página donde aparece, en vez de diluirse en un bloque único de texto.

Segundo caso, sin archivo de por medio. Filas traídas de Google Sheets o correos recogidos en Gmail llegan como JSON plano. Type of Data se queda en JSON, Mode en Load Specific Data y JSON Pointers conserva solo los campos que interesan: el cuerpo del mensaje entra en el índice y los identificadores internos se quedan fuera.

Tercer caso, un inventario exportado en CSV. CSV Separator se ajusta al carácter que usa de verdad la exportación y CSV Column apunta a la única columna con prosa, la descripción. Las referencias y los importes no se convierten en documentos. Con un par de propiedades en Metadata, la recuperación posterior podrá filtrar por ellas.

Cuándo conviene otra cosa. Este nodo prepara, no consulta nada ni habla con ningún modelo. Un asistente que responde preguntas necesita un nodo raíz como AI Agent con un modelo de chat conectado, por ejemplo OpenAI, y el loader solo aparece en el lado de la indexación. Si el texto ya está en un campo del item y no hay ningún archivo que interpretar, el modo JSON con Load All Input Data sobra y basta.

Los límites, sin rodeos. Seis parámetros y ninguno más: ni vista previa de los fragmentos generados, ni paso de limpieza, ni deduplicación entre ejecuciones. El troceado pertenece al subnodo conectado al puerto, no a este panel. Y si Data Format impone un formato y el archivo que llega no encaja, el nodo da error en lugar de adivinar. Para montar una cadena entera con las manos, está el Curso n8n, y la Reseña n8n entra en el terreno del alojamiento y del coste.

Conexiones

¿Qué se conecta a este nodo?

n8n distingue los nodos raíz, que viven en el flujo principal, de los subnodos, que se enganchan a sus puertos: el loader recibe un subnodo por debajo y se engancha a un nodo raíz por encima.

Puertos (qué se conecta)

  • Text Splitterai_textSplitterobligatorio

Salida (dónde se conecta)

  • Documentai_document
01Text SplitterEl divisor corta el texto largo en fragmentos antes de que se conviertan en documentos. Si el puerto está vacío, el loader no tiene a quién delegar ese corte y la ejecución se detiene.

El divisor corta el texto largo en fragmentos antes de que se conviertan en documentos. Si el puerto está vacío, el loader no tiene a quién delegar ese corte y la ejecución se detiene.

Parámetros clave

  • Required: el puerto necesita un subnodo para que el loader funcione.
  • Recursive Character Text Splitter: el punto de partida habitual, corta primero por párrafos y frases antes de recurrir a los caracteres sueltos.
  • Character Text Splitter: corta por un único separador elegido, predecible en textos regulares.
  • Token Splitter: corta por tokens, la unidad con la que un modelo cuenta lo que recibe.
Casos de uso
un manual en PDF pasa por el divisor recursivo para no romper los párrafos, mientras que una exportación de registros, una línea por entrada, encaja con el divisor por caracteres.
02DocumentEste es el lado de salida. El loader no se coloca en el flujo principal: se conecta hacia arriba, y los documentos que fabrica los consume el nodo raíz situado encima.

Este es el lado de salida. El loader no se coloca en el flujo principal: se conecta hacia arriba, y los documentos que fabrica los consume el nodo raíz situado encima.

Parámetros clave

  • Required: mientras ningún nodo raíz acepte esos documentos, el loader no produce nada aprovechable.
  • Summarization Chain: el nodo raíz que recibe esta salida, lee los documentos y devuelve un resumen.
Casos de uso
un informe semanal llega como archivo, el loader lo convierte en documentos y la cadena de resumen de arriba devuelve la versión breve que se publica en Slack.
Parámetros

¿Qué hace cada parámetro?

El nodo Default Data Loader tiene 6 parámetros. Para cada uno: el nodo tal como lo configuras en n8n, qué cambia el parámetro y nuestras notas de campo.

01

Type of Data

dataType

Lo que ves en n8n

Notas y casos de uso

Esta primera decisión reconfigura todo el panel que viene debajo.

Parámetros clave

  • Type of Data: json procesa el JSON del paso anterior, binary un archivo adjunto.
  • Mode: allInputData usa todo lo que entra en el agente o la cadena padre, expressionData carga un subconjunto, specificField un campo binario concreto.
  • Data Format: auto detecta por tipo mime, o eliges pdfLoader, csvLoader, docxLoader, epubLoader, jsonLoader o textLoader.
  • Data: el contenido JSON, arrastrado desde el panel de entrada o escrito {{ $json.body }}.
  • Input Data Field Name: el campo que contiene el archivo binario.
Casos de uso
una factura adjunta a un correo entrante va por Binary con Data Format en PDF, y un texto que ya viaja dentro del item va por JSON.
02

JSON Pointers

options.pointers

Lo que ves en n8n

Notas y casos de uso

Cargar un objeto JSON entero casi siempre arrastra ruido. Esta opción limita la lectura a rutas concretas dentro del objeto: solo lo que señalas se convierte en texto del documento.

Parámetros clave

  • JSON Pointers: los punteros que se extraen del JSON, con la forma /text, o varios a la vez con /text, /meta/title.
Casos de uso
una ficha de artículo lleva título, cuerpo y una pila de campos de seguimiento; señalar título y cuerpo deja documentos legibles y descarta lo demás.
03

CSV Separator

options.separator

Lo que ves en n8n

Notas y casos de uso

El CSV solo es estándar sobre el papel. Una exportación generada en un entorno europeo suele salir con punto y coma donde el loader espera una coma, y cada fila acaba aplastada en una sola celda ilegible.

Parámetros clave

  • CSV Separator: el separador que se usa para el CSV, ajustado al carácter que trae el archivo.
Casos de uso
una exportación salida de un programa de contabilidad usa punto y coma, así que el separador se alinea con eso antes de que nada intente leer una columna.
04

CSV Column

options.column

Lo que ves en n8n

Notas y casos de uso

Una hoja de cálculo suele tener una columna de texto y diez de identificadores, fechas y totales. Nombrar esa columna evita que las cifras acaben convertidas en documentos.

Parámetros clave

  • CSV Column: la columna que se extrae del CSV, indicada por el nombre de su encabezado.
Casos de uso
una exportación de encuesta pone la respuesta abierta junto a ocho columnas de puntuación; extraer solo la respuesta deja documentos que se leen como frases y no como una tabla.
05

Split Pages in PDF

options.splitPages

Lo que ves en n8n

Notas y casos de uso

Un PDF puede salir como un bloque largo de texto o como un documento por página. Esta casilla lo decide, y de ella depende la precisión de todo lo que luego lea el resultado.

Parámetros clave

  • Split Pages in PDF: si las páginas del PDF se dividen o no en documentos separados.
Casos de uso
en un contrato donde una cláusula debe seguir ligada al sitio donde aparece, el corte por página conserva esa referencia; en una nota de dos páginas que se lee de un tirón, no aporta nada.
06

Metadata

options.metadata

Lo que ves en n8n

Notas y casos de uso

Un documento suelto no dice nada de su origen. Metadata engancha propiedades a cada uno, y son esas propiedades las que permiten filtrar más tarde durante la recuperación.

Parámetros clave

  • Metadata: los metadatos que acompañan a cada documento, añadidos propiedad a propiedad con el botón Add property.
  • Name: el nombre de la propiedad, obligatorio en cada entrada.
  • Value: su valor, a menudo una expresión del tipo {{ $json.source }}.
Casos de uso
etiquetar cada documento con su idioma y su departamento permite que una búsqueda posterior responda desde el subconjunto correcto y no desde todo el índice.
Necesitas ayuda

¿Necesitas ayuda para automatizar Default Data Loader con n8n?

El equipo te responde directamente.

Cada mensaje lo lee una persona.

FAQ

Default Data Loader y n8n, preguntas frecuentes

01¿El nodo Default Data Loader n8n es gratis?
Sí. Forma parte del paquete de IA de n8n, @n8n/n8n-nodes-langchain, que viene incluido con n8n. No hay nada que instalar ni ningún sobrecoste del lado de n8n, tanto en n8n Cloud como en una instancia autoalojada con la Community Edition bajo licencia Sustainable Use. Un flujo se comporta igual en los dos sitios, así que lo montado en Cloud se traslada a un servidor propio sin tocar el loader. El único coste que aparece en una cadena así viene de fuera: el proveedor del modelo conectado más adelante factura sus propias llamadas de API según sus condiciones, y n8n no añade nada encima.
02¿Qué credenciales hacen falta para este nodo?
Ninguna. El nodo no tiene credential, es decir, el identificador guardado en n8n para conectarse a un servicio, ni selector Authentication. No hay cuenta que enlazar ni clave que pegar antes de usarlo. Entre los nodos de IA no es lo habitual, así que conviene saberlo: la autenticación vive en el subnodo del modelo conectado más adelante en la cadena, que lleva la clave del proveedor. Lo que el loader sí exige es un Text Splitter en su puerto obligatorio y datos que lleguen de verdad del paso anterior. Una ejecución que falla aquí viene de un puerto vacío, de un campo obligatorio en blanco o de un archivo con el formato equivocado, nunca de un problema de acceso.
03¿Qué límites tiene este nodo?
Prepara documentos y ahí se queda. No consulta nada, no calcula vectores y no lleva ningún modelo dentro. La versión 1 del nodo expone seis parámetros, así que el margen es estrecho a propósito: sin vista previa de los fragmentos producidos, sin pasada de limpieza, sin deduplicación entre ejecuciones. El troceado se delega en el divisor conectado al puerto, o sea que sus ajustes viven en ese subnodo y no en este panel. Hay un comportamiento que pilla desprevenido: con un Data Format fijado y un archivo cuyo tipo mime no coincide, el nodo da error en lugar de buscar una alternativa.
04¿Qué hay que conectar como mínimo y por qué subnodo empezar?
Un subnodo debajo y un nodo raíz encima. Debajo, el puerto Text Splitter es obligatorio, y el Recursive Character Text Splitter es la primera elección razonable porque busca cortes naturales antes de recurrir a un conteo bruto de caracteres. Encima, la Summarization Chain acepta la salida Document. Con ese triángulo funcionando, mover una pieza cada vez resulta sencillo: cambiar al Token Splitter si un modelo rechaza entradas demasiado largas, o al Character Text Splitter cuando el texto ya trae su propio separador.
05¿n8n o Make para cargar documentos en una cadena de IA?
Depende de dónde puedan estar esos documentos. n8n se autoaloja con Docker o npm, o funciona en n8n Cloud, así que un contrato o una exportación se procesan en una máquina bajo tu control. Make solo es alojado, sin opción de autoalojamiento, y factura por operación, algo que pesa cuando un único archivo se convierte en muchísimos documentos. La lógica visual también difiere: n8n engancha subnodos a los puertos de un nodo raíz, una forma de trabajar que encaja o no encaja. Cargar un archivo real en ambas plataformas suele resolver la duda.
Hack'celeration Lab

Recibe nuestros tips de integración cada semana.

Sin spam. Cancela cuando quieras.