Recursos · Integración n8n

Nodo Extract from File n8nConfigura Extract from File en n8n.

Un archivo que entra en un flujo de trabajo llega como datos binarios y ningún nodo posterior sabe leerlo. El nodo Extract from File n8n lo convierte en items JSON. En la versión 1 trae 12 operaciones, del CSV al base64, y todas arrancan con el mismo campo obligatorio.

Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth

Por qué automatizar

¿Qué resuelve el nodo Extract from File n8n?

Convierte datos binarios, es decir un archivo guardado dentro de un item como bytes en bruto y no como campos legibles, en JSON. La descripción del nodo lo dice en una línea: convertir datos binarios en JSON. A partir de ahí el resto del flujo ve campos normales, que puede filtrar, comparar o copiar donde haga falta. El nodo se ejecuta sobre cada item entrante, así que cuatro adjuntos dan cuatro extracciones en la misma ejecución.

Primer escenario, la contabilidad. Muchos sistemas solo exportan XML, y Extract from XML saca ese contenido a un campo de salida que tú nombras. Con las líneas ya en JSON, un nodo If separa los documentos que cuadran de los que no, y solo estos últimos acaban en una revisión humana.

Segundo escenario, los contratos firmados. El archivo entra por un Webhook cuando alguien te lo manda, Extract from PDF extrae su contenido y sus metadatos, y Password permite abrirlo aunque venga cifrado. El texto recuperado se compara con la referencia esperada y el aviso sale por Slack al canal del equipo.

Tercer escenario, los registros técnicos. Un archivo descargado con un nodo HTTP Request pasa por Extract from text file, que extrae el contenido tal cual, y Destination Output Field decide dónde aparece. Después basta con guardar el resultado en Google Sheets para tener el histórico que nadie mantenía a mano.

Conviene saber cuándo este nodo no es la respuesta. Lee un archivo, nunca escribe uno: para el camino contrario, volver de JSON a un archivo binario, n8n trae el nodo Convert to File. Y el archivo tiene que entrar antes en el flujo, tarea de un nodo Webhook para lo que te envían, de un HTTP Request para lo que vas a buscar, o de una fuente local.

Dos límites antes de montar nada. Solo están cubiertos los formatos que aparecen en el desplegable de operaciones, y Destination Output Field existe únicamente en cuatro de ellas. El nodo tampoco abre un flujo: siempre lo precede un disparador, un Schedule Trigger, un Webhook o el trigger de una herramienta. Si quieres ver cómo encajan estas piezas, el curso n8n las recorre en orden.

Acciones

¿Qué operación lee tu archivo?

El nodo Extract from File expone 12 operaciones. Para cada una: el nodo tal como lo configuras en n8n, los campos obligatorios y nuestras notas de campo.

01

Extract from CSV

csv

Lo que ves en n8n

Notas y casos de uso

Transforma un archivo CSV en items de salida. Los valores separados por comas salen de cualquier herramienta del mercado, y esta es la operación que más se usa del nodo.

Parámetros clave

  • Input Binary Field: obligatorio, el nombre del campo de entrada que contiene el archivo a procesar. Apunta al campo que dejó el nodo anterior, casi siempre {{ $json.data }}.
  • Delimiter: define el separador de campos, normalmente la coma. Hay que tocarlo cuando la exportación usa punto y coma.
  • Header Row: indica si la primera fila del archivo contiene los nombres de las columnas. Sin activarlo, las columnas vuelven numeradas.
Casos de uso
una exportación de productos que llega cada noche se convierte en items comparables con el catálogo.
02

Extract from HTML

html

Lo que ves en n8n

Notas y casos de uso

Toma una tabla contenida en un archivo HTML y la convierte en items de salida. Sirve cuando un programa publica su informe como página web en lugar de un archivo de datos.

Parámetros clave

  • Input Binary Field: obligatorio, el campo de entrada que lleva el archivo HTML a procesar.
  • Header Row: según si la primera fila lleva o no los nombres de columna, las claves salen como etiquetas o como posiciones.
  • Include Empty Cells: activado, las celdas vacías se conservan rellenas con una cadena vacía, así todas las filas mantienen la misma forma.
Casos de uso
un resumen mensual guardado en HTML vuelve a ser un conjunto de filas que se pueden sumar.
03

Extract from ICS

fromIcs

Lo que ves en n8n

Notas y casos de uso

Lee un archivo iCalendar y lo convierte en items de salida. Las invitaciones viajan como adjunto .ics, y así es como un flujo accede a lo que hay dentro.

Parámetros clave

  • Destination Output Field: obligatorio aquí, es el nombre del campo de salida que contendrá los datos extraídos, con e.g data como marcador.
  • Keep Source: elige entre json, binary o both para arrastrar el item de entrada junto a la extracción.
Casos de uso
una invitación recibida por correo se lee antes de decidir si hay que avisar a alguien.
04

Extract from JSON

fromJson

Lo que ves en n8n

Notas y casos de uso

Recupera los datos JSON encerrados en un archivo binario. El contenido ya viene estructurado, pero mientras siga dentro de un archivo el flujo solo ve bytes. Esta operación lo desenvuelve.

Parámetros clave

  • Destination Output Field: obligatorio, nombra el campo de salida que contendrá los datos extraídos.
  • File Encoding: indica la codificación del archivo, UTF-8 por defecto. La lista va de ascii a windows1258.
Casos de uso
un volcado de API descargado como archivo vuelve a ser una serie de items sin escribir código.
05

Extract from ODS

ods

Lo que ves en n8n

Notas y casos de uso

Transforma un archivo ODS en items de salida. Las hojas de cálculo en formato open document salen de suites ofimáticas que no son Excel, y el nodo las lee con el mismo juego de opciones.

Parámetros clave

  • Sheet Name: nombre de la hoja que se va a leer dentro del documento, marcador e.g. mySheet. Sin él dependes de la pestaña que aparezca primero.
  • Range: el rango que se lee de la tabla. Un número se toma como fila inicial, una cadena como rango en notación A1.
Casos de uso
un archivo de presupuesto donde solo importa una pestaña se lee hasta el bloque de celdas exacto.
06

Extract from PDF

pdf

Lo que ves en n8n

Notas y casos de uso

Extrae el contenido y los metadatos de un archivo PDF. Contratos, facturas e informes llegan sin parar en este formato, y su texto queda fuera de alcance hasta que esta operación se ejecuta.

Parámetros clave

  • Max Pages: número máximo de páginas a incluir. Útil en documentos largos donde el dato vive en las primeras hojas.
  • Join Pages: activado, une el texto de todas las páginas; desactivado, devuelve un array con el texto de cada página.
  • Password: se rellena si el PDF está cifrado, y sin ella el archivo sigue cerrado.
Casos de uso
un presupuesto firmado se relee y su referencia se comprueba antes de dar la venta por cerrada.
07

Extract from RTF

rtf

Lo que ves en n8n

Notas y casos de uso

Convierte una tabla contenida en un archivo de texto enriquecido en items de salida. Algunos parques de software antiguos siguen generando RTF, y el nodo lo trata como cualquier otra fuente tabular.

Parámetros clave

  • Read As String: en ciertos casos y formatos hace falta leer como cadena para que los caracteres especiales se interpreten bien. Los acentos y las eñes son el motivo habitual.
  • RAW Data: devuelve los datos en bruto en vez de analizarlos, que es como se descubre qué contiene de verdad el archivo cuando el resultado no cuadra.
Casos de uso
un informe generado por una herramienta interna antigua se convierte en filas sin teclear nada.
08

Extract from text file

text

Lo que ves en n8n

Notas y casos de uso

Extrae el contenido de un archivo de texto. Ninguna estructura, ninguna columna, solo los caracteres, colocados en el campo que tú indiques.

Parámetros clave

  • Destination Output Field: obligatorio, el nombre del campo de salida que contendrá los datos extraídos, marcador e.g data.
  • Strip BOM: quita la marca de orden de bytes del archivo, lo que ayuda en un entorno donde la presencia del BOM provoca incoherencias.
Casos de uso
un archivo de registro recogido de madrugada se lee y se recorre buscando la línea que explica un fallo.
09

Extract from XML

xml

Lo que ves en n8n

Notas y casos de uso

Muchos programas de contabilidad y de logística no exportan otra cosa que XML. Esta operación extrae el contenido de ese archivo y hace que su salida sirva dentro de un flujo.

Parámetros clave

  • Input Binary Field: obligatorio, el campo que lleva el archivo XML, marcador e.g data.
  • Destination Output Field: también obligatorio, decide bajo qué clave aparece el árbol extraído en el item de salida.
Casos de uso
un albarán exportado por un sistema de almacén se lee y sus líneas se contrastan con el pedido original.
10

Extract from XLS

xls

Lo que ves en n8n

Notas y casos de uso

Transforma un archivo de Excel en items de salida, en el formato XLS antiguo. Los archivos que llevan años circulando suelen seguir guardados así.

Parámetros clave

  • Sheet Name: nombre de la hoja que se va a leer. Conviene indicarlo en cuanto el archivo tiene más de una pestaña.
  • Max Number of Rows to Load: detiene el tratamiento tras el número de filas pedido. Pon -1 para cargarlas todas, o el marcador e.g. 10 para una prueba rápida.
Casos de uso
un histórico de tarifas se prueba sobre sus primeras filas antes de pasar el archivo entero.
11

Extract from XLSX

xlsx

Lo que ves en n8n

Notas y casos de uso

Mismo tratamiento para el formato Excel actual: el archivo XLSX pasa a ser items de salida. Es la operación que sustituye a la exportación semanal que alguien abría a mano.

Parámetros clave

  • Header Row: indica si la primera fila del archivo lleva los nombres de columna, para que los items vuelvan ordenados por título.
  • Starting Line: empieza a tratar registros desde la línea pedida, contando desde 0, marcador e.g. 0. Se usa cuando el archivo abre con un logotipo y tres filas vacías.
Casos de uso
una exportación comercial cuya tabla real empieza a media hoja se lee desde la línea correcta.
12

Move file to base64 string

binaryToPropery

Lo que ves en n8n

Notas y casos de uso

Convierte un archivo en una cadena codificada en base64, una forma de transportar bytes como texto. Aquí no se analiza nada: el archivo pasa a ser un valor que cabe en un campo.

Parámetros clave

  • Input Binary Field: obligatorio, el campo que guarda el archivo en ese momento.
  • Destination Output Field: obligatorio, el campo de salida que contendrá los datos extraídos, que aquí son la cadena misma.
  • Keep Source: json, binary o both, según lo que el nodo siguiente todavía necesite del item de entrada.
Casos de uso
un adjunto se codifica antes de entregarlo a una API que solo acepta una cadena en el cuerpo de la petición.
Necesitas ayuda

¿Necesitas ayuda para automatizar Extract from File con n8n?

El equipo te responde directamente.

Cada mensaje lo lee una persona.

FAQ

Lo que se pregunta la gente antes de montarlo

01¿Extract from File es gratis en n8n?
Sí. Es un nodo core, incluido con n8n, así que no hay nada que instalar ni ningún coste extra por el lado de n8n. Funciona igual en n8n Cloud, la oferta alojada por n8n, y en una instancia que alojes tú con Docker o npm, en Community Edition bajo licencia Sustainable Use. Un flujo montado en un sitio es el mismo flujo en el otro. Lo único que cambia entre ambos montajes es dónde se procesan los archivos, algo que pesa en cuanto los documentos llevan datos que prefieres mantener en tus propios servidores.
02¿Qué credenciales necesita Extract from File?
Ninguna, y eso juega a su favor. El nodo no tiene credential, es decir ningún juego de claves guardado en n8n, ni selector Authentication: no hay nada que configurar del lado de la cuenta antes de usarlo. Lo que sí necesita es un archivo ya presente en el item entrante, en el campo que indiques bajo Input Binary Field. Ese archivo llega gracias a un nodo colocado antes: un Webhook para lo que te envían, un HTTP Request para lo que vas a buscar, o una fuente local. Con el campo vacío, el parámetro requerido bloquea la ejecución.
03¿Qué límites tiene Extract from File?
El nodo lee los formatos que aparecen en el desplegable de operaciones y nada más, en la versión máxima leída en el catálogo, la versión 1. Destination Output Field solo está disponible en cuatro operaciones: Extract From JSON, Extract From ICS, Extract From Text File y Move File to Base64 String. Tampoco tiene trigger propio, ese mecanismo que arranca un flujo, así que nunca empieza nada por su cuenta. Y un flujo antiguo puede mostrar una versión anterior con menos opciones, porque un nodo no cambia de versión solo.
04¿Nodo Extract from File n8n o Convert to File?
Van en direcciones opuestas, así que la pregunta real es hacia dónde circula el dato. Extract from File toma un archivo en formato binario y lo convierte en JSON, que el resto del flujo ya puede manipular. Convert to File hace el recorrido inverso y devuelve el JSON a un tipo de archivo binario. Muchos flujos usan los dos: leer la hoja de cálculo que llega, trabajar los items y reconstruir un archivo al final. Si lo único que necesitas es mover los bytes como texto sin analizarlos, Move File to Base64 String se queda dentro de este nodo.
05¿n8n o Make para leer archivos en un flujo?
Los dos saben hacerlo, y la diferencia honesta está en el alojamiento, el control de los datos y el modelo de coste. Make es una plataforma de automatización alojada, sin opción de autoalojamiento, facturada por operación, lo que resulta previsible mientras los volúmenes sean bajos. n8n corre en n8n Cloud o en tu propio servidor con Docker o npm, así que un archivo de nóminas o de clientes nunca sale de tu infraestructura si eso es un requisito. En coste, facturar por operación y pagar un servidor no se comportan igual cuando un flujo procesa archivos cada hora. La lógica visual también difiere, y ahí pesa sobre todo la costumbre.
Hack'celeration Lab

Recibe nuestros tips de integración cada semana.

Sin spam. Cancela cuando quieras.