Nodo de n8n para conversión de archivos y datos web#
@enconvert/n8n-nodes-enconvert es el community node oficial de n8n para EnConvert. Un solo node cubre dieciséis operaciones repartidas en seis recursos: convertir archivos entre formatos, comprimir imágenes, extraer páginas web a markdown, obtener campos estructurados de una página, buscar en la web y rastrear un sitio entero hasta convertirlo en pasajes listos para incrustar en un vector store. Devuelve datos binary reales de n8n, así que una captura de pantalla o un PDF convertido pasa directamente a un adjunto de Gmail o a una subida a Google Drive sin necesidad de un node HTTP Request adicional.
@enconvert/n8n-nodes-enconvert · Fuente: enconvert/n8n-nodes-enconvert · Licencia: MIT
Qué hace el node#
n8n incluye dos nodes de archivos propios. Extract From File lee CSV, HTML, JSON, ICS, ODS, texto de PDF, RTF, TXT, XLS y XLSX. Convert to File escribe ese mismo conjunto de vuelta. Ninguno de los dos lee Word, PowerPoint ni EPUB, ninguno renderiza una página web y, en n8n Cloud, no puedes instalar las herramientas de línea de comandos que normalmente cubrirían esos huecos.
Este node cubre exactamente ese terreno:
| Lo que necesitas | Lo que te da el node |
|---|---|
| Word, PowerPoint, Excel, EPUB o RTF como texto | File > Convert to Markdown, que devuelve el texto en el item |
| Casi cualquier cosa como PDF | File > Convert to PDF, con tamaño de página, márgenes, encabezado y pie |
| Una página web como markdown limpio | Web Page > Scrape, unas seis veces más pequeño que el HTML crudo |
| Una captura o el PDF de una página como archivo real | Web Page > Scrape, adjunto como binary de n8n |
| Campos concretos de una página | Web Page > Extract, descritos en lenguaje natural |
| Un sitio entero en un vector store | Website > Crawl, un item por pasaje |
Todo se ejecuta contra la misma API REST documentada en el resto de este sitio, así que tu cuota del panel, los límites de frecuencia y las funciones de tu plan se aplican exactamente igual que en cualquier otra parte.
Instalación#
Los community nodes de n8n se instalan desde el editor. Abre Settings → Community nodes → Install y escribe el nombre del paquete:
@enconvert/n8n-nodes-enconvert
En n8n autoalojado también puedes instalarlo desde la línea de comandos, dentro de tu directorio de datos de n8n:
npm install @enconvert/n8n-nodes-enconvert
Reinicia n8n después de instalarlo. El node aparece en el panel de nodes como EnConvert, y cada operación se puede buscar por separado, así que escribir «docx», «screenshot» o «crawl» también lo saca a la luz.
Añade tu credencial de EnConvert#
- Genera una clave de API privada en el panel. Las claves privadas empiezan por
sk_. - En n8n, abre el node, haz clic en Create new credential y elige EnConvert API.
- Pega la clave, haz clic en Save y luego en Test.
La prueba de la credencial llama a GET /v1/whoami, que solo acepta claves privadas. Eso significa que una clave pública pk_ falla aquí, en el momento en que la pegas, en lugar de fallar más tarde durante la ejecución de un workflow con un mensaje confuso.
| Campo | Obligatorio | Predeterminado | Propósito |
|---|---|---|---|
| API Key | Sí | -- | Tu clave privada (sk_...) |
| Base URL | No | https://api.enconvert.com |
Cámbialo solo si te dieron un endpoint distinto |
pk_ están pensadas para widgets de navegador y todas las operaciones de este node las rechazan. Tienes más información en Claves privadas.
Operaciones#
File#
| Operación | Qué hace |
|---|---|
| Convert to PDF | Convierte un documento, una hoja de cálculo, una presentación, una página web, una imagen o un archivo de texto en un PDF. El tamaño de página, la orientación, los márgenes, la escala, la escala de grises, el encabezado y el pie se aplican a HTML, markdown, texto, EPUB, imágenes y SVG. Los archivos de Office llevan su propia configuración de página, así que solo les afecta Grayscale, y el node informa de qué ajustes omitió en lugar de hacer fallar la ejecución. |
| Convert to Markdown | Convierte archivos de Word, PowerPoint, Excel, PDF, EPUB, RTF, HTML y texto en markdown. Por defecto devuelve el texto en el item, de modo que alimenta directamente a un node de IA. Construido sobre Anything to Markdown. |
| Convert Data | Convierte entre JSON, CSV, XML, YAML, TOML y HTML. Al convertir a JSON obtienes un objeto ya parseado en data, listo para expresiones como {{ $json.data.total }}. |
| Split Into Chunks | Sube el archivo de cada item de entrada como un único trabajo y devuelve pasajes solapados listos para incrustar. Hasta 200 archivos por ejecución. |
Image#
| Operación | Qué hace |
|---|---|
| Convert Format | Convierte entre JPEG, PNG, WebP, HEIC y SVG, y rasteriza una página de PDF a JPEG. Width y Height fijan el lienzo cuando la entrada es un SVG. |
| Compress | Reduce el peso de un PNG, JPEG o WebP hasta acercarlo a un tamaño objetivo en KB. El formato nunca cambia. El objetivo se aplica con el mejor esfuerzo: un presupuesto inalcanzable devuelve el archivo más pequeño que se logró en lugar de un error, así que comprueba el tamaño que recibes. |
Web Page#
| Operación | Qué hace |
|---|---|
| Scrape | Renderiza una página y devuelve markdown, HTML limpio, HTML crudo, enlaces, imágenes y datos estructurados dentro del item, además de capturas de pantalla y PDF como binary. Los resultados se cachean durante alrededor de una hora y un acierto de caché no cuesta nada. Construido sobre Perceive. |
| Scrape Many | Renderiza hasta 1000 páginas en una sola ejecución. El campo URLs acepta una lista que escribas tú o una expresión que resuelva a un array, así que encadena directamente desde Website > Map. Si pones Output Mode en un único archivo ZIP con la salida en PDF, archivas un conjunto de páginas de una sola vez. |
| Extract | Obtiene campos con nombre de una o varias páginas. Describe lo que quieres en lenguaje natural, enumera los campos por nombre o aporta un JSON Schema. Los selectores CSS opcionales responden todo lo que pueden antes de que algo llegue a la extracción por IA, lo que abarata las páginas con una maquetación fija. Construido sobre Distill. |
Website#
| Operación | Qué hace |
|---|---|
| Map | Lista las direcciones de un sitio sin renderizar ninguna. Es rápido y no consume nada de tu asignación de páginas. Construido sobre Discover. |
| Crawl | Lee un sitio entero y devuelve pasajes listos para incrustar, cada uno con su URL de origen, su título y su ruta de encabezados. Se ejecuta sin cookies ni inicio de sesión por diseño. Construido sobre Ingest. |
Search#
| Operación | Qué hace |
|---|---|
| Search | Busca en la web, en noticias, imágenes, artículos académicos, patentes o mapas y devuelve un item por resultado. Scrape Top Results además renderiza los primeros resultados y adjunta su markdown, así que una sola ejecución te da la página de resultados y el contenido de las páginas a la vez. Construido sobre Lookup. |
Job#
| Operación | Qué hace |
|---|---|
| Get | Busca cualquier trabajo de EnConvert por su ID. El node elige el endpoint correcto a partir del prefijo, así que los IDs de scrape (per_), de scrape de varias páginas (batch_), de crawl (ing_) y de conversión de archivos funcionan todos en el mismo campo. |
| Get Many | Lista tus trabajos de crawl recientes, con Return All o un límite. |
| Cancel | Detiene un crawl o un scrape de varias páginas en curso. |
| Retry Webhook | Vuelve a enviar el webhook de finalización de un crawl terminado. |
Cómo elegir la forma en que vuelven los resultados#
Todas las operaciones de File e Image ofrecen tres formas bajo Response Format:
| Valor | Qué llega al item |
|---|---|
| File | El archivo convertido como binary de n8n, listo para Gmail, Drive, S3 o Write to Disk |
| Text | El contenido como texto en text. Al convertir a JSON obtienes en su lugar un objeto parseado en data |
| URL Only | Solo un enlace de descarga en downloadUrl, sin transferir nada |
Convert to PDF y las dos operaciones de Image usan File por defecto. Convert to Markdown y Convert Data usan Text, porque una cadena markdown o un objeto ya parseado es casi siempre lo que quiere el siguiente node del workflow.
Operaciones que se ejecutan como trabajos#
Scrape Many, Crawl y Split Into Chunks envían trabajo que puede tardar minutos. Por defecto el node espera y te entrega el resultado terminado. Tres ajustes bajo Options controlan ese comportamiento:
| Opción | Predeterminado | Qué hace |
|---|---|---|
| Wait for Completion | Activado | Desactívalo para recibir el ID del trabajo de inmediato y continuar en otra parte |
| Max Wait Time (Seconds) | 120 | Cuánto tiempo seguir esperando antes de renunciar a la espera |
| Poll Interval (Seconds) | 3 | Cada cuánto comprobar |
Si se agota la espera, el trabajo no se pierde. El error indica el ID del trabajo, y Job > Get recupera el resultado terminado cuando vuelvas a por él.
Formatos admitidos#
Convert to PDF acepta bmp csv doc docx epub gif heic heif htm html jpeg jpg markdown md mdown mkd numbers odp ods odt ots pages pdf png ppt pptx rtf svg text tif tiff txt webp xhtml xls xlsx.
Convert to Markdown acepta csv doc docx epub htm html markdown md mdown mkd odp ods odt pdf ppt pptx rtf text txt xhtml xls xlsx.
Convert Data cubre JSON hacia y desde XML, YAML, TOML y CSV, CSV hacia y desde XML, y markdown a HTML.
Convert Format cubre JPEG, PNG, WebP, HEIC y SVG en cualquier combinación, además de PDF a JPEG. Width y Height solo se aplican cuando la entrada es un SVG, cada uno acepta de 1 a 10000, y el producto de ambos no puede superar los 25 millones.
Compress acepta png jpg jpeg webp.
El node comprueba el par antes de enviar nada. Si pides una combinación que no existe, te lo dice en el editor y te indica a qué formatos se puede convertir realmente ese archivo. Las páginas escaneadas como imágenes y sin capa de texto no se leen, porque el node no hace OCR.
Workflows de ejemplo#
Documento de Word a un resumen con IA#
Google Drive (Download) -> EnConvert -> Basic LLM Chain
File · Convert to Markdown
Response Format: Text
El markdown llega a {{ $json.text }}. Este es el camino que Extract From File no puede tomar, porque no lee .docx.
Factura HTML a un PDF adjunto#
Set (build the HTML) -> Convert to File -> EnConvert -> Gmail (Send)
(Text to File) File · Convert to PDF
PDF Options: A4, margins
Sitio web a un vector store#
EnConvert -> Embeddings -> Pinecone
Website · Crawl
Mode: Sitemap, Max Pages: 200
Output: Chunks
Cada item lleva content, sourceUrl, title, headingsPath, wordCount y chunkIndex, que es exactamente la forma que esperan un Default Data Loader y un node de vector store. Un solo node sustituye al pipeline habitual de crawl, chunk, bucle y código.
Precios de la competencia a una hoja de cálculo#
EnConvert -> EnConvert -> Google Sheets
Website · Map Web Page · Extract
Mode: Sitemap Source: Specific URLs
Define Fields By: Description
"the plan name and the monthly price"
Map es el primer paso barato aquí. Lista las direcciones del sitio sin renderizarlas, así que solo gastas asignación de páginas en las páginas que realmente quieres.
Captura de pantalla diaria a Slack#
Schedule Trigger -> EnConvert -> Slack (Upload file)
Web Page · Scrape
Outputs: Screenshot
El PNG llega como binary en screenshot. No hace falta un segundo node para descargarlo.
Usar el node como herramienta de AI Agent#
Todas las operaciones están disponibles como herramienta para el node AI Agent de n8n. Las operaciones web son las que mejor le encajan a un agente, porque un agente puede aportar una URL o una consulta de búsqueda, pero no tiene forma de entregar un archivo.
Las cuatro que vale la pena exponer a un agente son Web Page > Scrape, Search > Search, Web Page > Extract y Website > Map. Juntas permiten que un agente encuentre páginas, las lea como markdown y saque de ellas datos estructurados, que es el bucle que necesitan la mayoría de los agentes de investigación y de generación de leads.
Solución de problemas#
El node no aparece después de instalarlo. Reinicia n8n. Los community nodes se cargan al arrancar. En n8n Cloud, comprueba que el paquete llegara a instalarse, ya que Cloud solo acepta nodes verificados.
EnConvert rejected the API key.
La clave es incorrecta, o es una clave pública pk_. Abre la credencial y ejecuta Test. Genera una clave privada en el panel.
This operation is not included in your EnConvert plan.
Scrape, Extract, Search, Map y Crawl están limitadas por plan, y cada una tiene su asignación mensual. Reintentar no sirve de nada. Consulta tu uso y tu plan en la página de precios.
Could not tell what kind of file is in "data".
El archivo entrante no lleva extensión en el nombre, algo que pasa con las descargas del node HTTP Request. Indica de qué se trata con Input File Format, bajo Options, por ejemplo docx.
This operation expects the node's input data to contain a binary file.
El node anterior no devolvió ningún archivo, o usó otro nombre de campo. Revisa Input Binary Field, que en la mayoría de los nodes de n8n es data.
Una conversión grande falla dentro de n8n. Cambia Response Format a URL Only. Los items de n8n tienen un tope de 16 MB por defecto y ese límite es fijo en Cloud.
Un crawl agota el tiempo de espera. Sube Max Wait Time, o desactiva Wait for Completion y recoge el resultado más tarde con Job > Get, usando el ID del trabajo que aparece en el mensaje de error.
Fuente y enlaces#
- npm: @enconvert/n8n-nodes-enconvert
- GitHub: enconvert/n8n-nodes-enconvert
- Licencia: MIT
- Community nodes de n8n: docs.n8n.io
- API subyacente: Introducción
Preguntas frecuentes#
¿Cómo convierto un archivo DOCX a PDF en n8n?#
Añade el node de EnConvert, elige el recurso File y la operación Convert to PDF, y apunta Input Binary Field al campo que contiene el archivo, que en la mayoría de los nodes es data. El PDF vuelve como binary en el mismo item, listo para adjuntarlo a un correo o subirlo a un almacenamiento. Los archivos de Word llevan su propia configuración de página, así que el tamaño de página y los márgenes no se les aplican, y el node te dice qué ajustes omitió.
¿Cómo extraigo el texto de un documento de Word en n8n?#
Usa File > Convert to Markdown con Response Format en Text. El texto aterriza en {{ $json.text }}. El node Extract From File integrado en n8n no puede hacerlo, porque lee CSV, HTML, JSON, ICS, ODS, texto de PDF, RTF, TXT, XLS y XLSX, pero no .doc, .docx ni .pptx.
¿Puedo usar este node en n8n Cloud?#
n8n Cloud solo instala community nodes que hayan superado su revisión de verificación. Hasta que este node complete esa revisión, instálalo en una instancia autoalojada o llama a la API directamente desde el node HTTP Request, que funciona en cualquier plan. Cloud es justo donde el node más rinde, ya que sus usuarios no pueden instalar herramientas del sistema ni paquetes npm para convertir archivos localmente.
¿Cómo extraigo una página web a markdown en n8n?#
Usa Web Page > Scrape con Markdown seleccionado bajo Outputs. El markdown llega a {{ $json.markdown }}. El markdown es unas seis veces más pequeño que el HTML crudo de la misma página, lo que recorta el coste en tokens de cada node de IA posterior y le deja al modelo mucho menos texto de relleno con el que confundirse.
¿Cómo hago una captura de pantalla de un sitio web en n8n?#
Usa Web Page > Scrape y selecciona Screenshot o Full-Page Screenshot bajo Outputs. El PNG llega como binary de n8n en screenshot, así que puedes subirlo a Slack o adjuntarlo a un correo directamente. La mayoría de los nodes de scraping devuelven un enlace en su lugar, lo que te obliga a añadir un node HTTP Request para descargar la imagen antes de poder usarla.
¿Cómo cargo un sitio web entero en un vector store con n8n?#
Usa Website > Crawl con Output en Chunks. El node devuelve un item por pasaje, cada uno con content, sourceUrl, title, headingsPath y chunkIndex, que encaja directamente en un Default Data Loader, un node de Embeddings y un vector store como Pinecone, Qdrant o Supabase. Sustituye al pipeline habitual de crawl por sitemap, scraper, node Code y bucle.
¿Por qué mi conversión devuelve un enlace en lugar del archivo?#
Response Format está en URL Only. Cámbialo a File para recibir binary de n8n. Lo contrario también resulta útil: los resultados de más de 16 MB no pueden viajar dentro de un item de n8n en Cloud, así que URL Only es la forma de manejar archivos grandes. Los enlaces de descarga siguen siendo válidos durante 15 minutos.
¿Qué pasa si un crawl tarda más que el tiempo de espera?#
El trabajo sigue ejecutándose en EnConvert. El node lanza un error que contiene el ID del trabajo, y Job > Get recupera el resultado terminado más tarde. Para crawls largos, configura un Webhook URL, desactiva Wait for Completion y deja que EnConvert llame a un node Webhook de n8n cuando termine.
¿Funciona el node con el node AI Agent de n8n?#
Sí, todas las operaciones se exponen como herramienta de agente. Las operaciones web son las que mejor encajan con un agente, porque un agente puede pasar una URL o una consulta de búsqueda, pero no puede entregar un archivo. Scrape, Search, Extract y Map son las cuatro que hacen que un agente resulte realmente útil para investigación y generación de leads.