---
seo_title: Nodo de n8n para convertir archivos y hacer scraping web | EnConvert
meta_desc: Instala el community node de EnConvert para n8n: convierte DOCX, PDF e imágenes, extrae páginas a markdown y rastrea sitios en chunks listos para RAG.
keywords: nodo n8n para convertir archivos, n8n docx a pdf, convertir archivos en n8n, extraer texto de un docx en n8n, nodo de web scraping para n8n, n8n scrapear url a markdown, captura de pantalla de una web en n8n, n8n rag vector store sitio web, community node n8n conversión de archivos, nodo n8n de enconvert, herramienta de scraping para ai agent en n8n
---

# Nodo de n8n para conversión de archivos y datos web

`@enconvert/n8n-nodes-enconvert` es el community node oficial de [n8n](https://n8n.io) para EnConvert. Un solo node cubre dieciséis operaciones repartidas en seis recursos: convertir archivos entre formatos, comprimir imágenes, extraer páginas web a markdown, obtener campos estructurados de una página, buscar en la web y rastrear un sitio entero hasta convertirlo en pasajes listos para incrustar en un vector store. Devuelve datos binary reales de n8n, así que una captura de pantalla o un PDF convertido pasa directamente a un adjunto de Gmail o a una subida a Google Drive sin necesidad de un node HTTP Request adicional.

<div class="alert alert-info">
<strong>npm:</strong> <code>@enconvert/n8n-nodes-enconvert</code> · <strong>Fuente:</strong> <a href="https://github.com/enconvert/n8n-nodes-enconvert">enconvert/n8n-nodes-enconvert</a> · <strong>Licencia:</strong> MIT
</div>

---

## Qué hace el node

n8n incluye dos nodes de archivos propios. `Extract From File` lee CSV, HTML, JSON, ICS, ODS, texto de PDF, RTF, TXT, XLS y XLSX. `Convert to File` escribe ese mismo conjunto de vuelta. Ninguno de los dos lee Word, PowerPoint ni EPUB, ninguno renderiza una página web y, en n8n Cloud, no puedes instalar las herramientas de línea de comandos que normalmente cubrirían esos huecos.

Este node cubre exactamente ese terreno:

| Lo que necesitas | Lo que te da el node |
|----------|--------------------|
| Word, PowerPoint, Excel, EPUB o RTF como texto | `File > Convert to Markdown`, que devuelve el texto en el item |
| Casi cualquier cosa como PDF | `File > Convert to PDF`, con tamaño de página, márgenes, encabezado y pie |
| Una página web como markdown limpio | `Web Page > Scrape`, unas seis veces más pequeño que el HTML crudo |
| Una captura o el PDF de una página como archivo real | `Web Page > Scrape`, adjunto como binary de n8n |
| Campos concretos de una página | `Web Page > Extract`, descritos en lenguaje natural |
| Un sitio entero en un vector store | `Website > Crawl`, un item por pasaje |

Todo se ejecuta contra la misma API REST documentada en el resto de este sitio, así que tu cuota del panel, los límites de frecuencia y las funciones de tu plan se aplican exactamente igual que en cualquier otra parte.

---

## Instalación

Los community nodes de n8n se instalan desde el editor. Abre **Settings → Community nodes → Install** y escribe el nombre del paquete:

```text
@enconvert/n8n-nodes-enconvert
```

En n8n autoalojado también puedes instalarlo desde la línea de comandos, dentro de tu directorio de datos de n8n:

```bash
npm install @enconvert/n8n-nodes-enconvert
```

<div class="alert alert-warning">
<strong>n8n Cloud solo instala nodes verificados.</strong> Si el botón de instalación no aparece o el paquete no se encuentra en Cloud, es que el node todavía no ha superado la revisión de verificación de n8n. Hasta entonces, las instancias autoalojadas sí pueden instalarlo, y cualquier instancia puede llamar a la API directamente con el node HTTP Request.
</div>

Reinicia n8n después de instalarlo. El node aparece en el panel de nodes como **EnConvert**, y cada operación se puede buscar por separado, así que escribir «docx», «screenshot» o «crawl» también lo saca a la luz.

---

## Añade tu credencial de EnConvert

1. Genera una clave de API **privada** en el [panel](/es/dashboard/api-keys). Las claves privadas empiezan por `sk_`.
2. En n8n, abre el node, haz clic en **Create new credential** y elige **EnConvert API**.
3. Pega la clave, haz clic en **Save** y luego en **Test**.

La prueba de la credencial llama a `GET /v1/whoami`, que solo acepta claves privadas. Eso significa que una clave pública `pk_` falla aquí, en el momento en que la pegas, en lugar de fallar más tarde durante la ejecución de un workflow con un mensaje confuso.

| Campo | Obligatorio | Predeterminado | Propósito |
|-------|----------|---------|---------|
| API Key | Sí | -- | Tu clave privada (`sk_...`) |
| Base URL | No | `https://api.enconvert.com` | Cámbialo solo si te dieron un endpoint distinto |

<div class="alert alert-warning">
<strong>Las claves públicas no funcionan.</strong> Las claves que empiezan por <code>pk_</code> están pensadas para widgets de navegador y todas las operaciones de este node las rechazan. Tienes más información en <a href="/es/docs/private-keys">Claves privadas</a>.
</div>

---

## Operaciones

### File

| Operación | Qué hace |
|-----------|--------------|
| **Convert to PDF** | Convierte un documento, una hoja de cálculo, una presentación, una página web, una imagen o un archivo de texto en un PDF. El tamaño de página, la orientación, los márgenes, la escala, la escala de grises, el encabezado y el pie se aplican a HTML, markdown, texto, EPUB, imágenes y SVG. Los archivos de Office llevan su propia configuración de página, así que solo les afecta Grayscale, y el node informa de qué ajustes omitió en lugar de hacer fallar la ejecución. |
| **Convert to Markdown** | Convierte archivos de Word, PowerPoint, Excel, PDF, EPUB, RTF, HTML y texto en markdown. Por defecto devuelve el texto en el item, de modo que alimenta directamente a un node de IA. Construido sobre [Anything to Markdown](/es/docs/anything-to-markdown). |
| **Convert Data** | Convierte entre JSON, CSV, XML, YAML, TOML y HTML. Al convertir a JSON obtienes un objeto ya parseado en `data`, listo para expresiones como `{{ $json.data.total }}`. |
| **Split Into Chunks** | Sube el archivo de cada item de entrada como un único trabajo y devuelve pasajes solapados listos para incrustar. Hasta 200 archivos por ejecución. |

### Image

| Operación | Qué hace |
|-----------|--------------|
| **Convert Format** | Convierte entre JPEG, PNG, WebP, HEIC y SVG, y rasteriza una página de PDF a JPEG. Width y Height fijan el lienzo cuando la entrada es un SVG. |
| **Compress** | Reduce el peso de un PNG, JPEG o WebP hasta acercarlo a un tamaño objetivo en KB. El formato nunca cambia. El objetivo se aplica con el mejor esfuerzo: un presupuesto inalcanzable devuelve el archivo más pequeño que se logró en lugar de un error, así que comprueba el tamaño que recibes. |

### Web Page

| Operación | Qué hace |
|-----------|--------------|
| **Scrape** | Renderiza una página y devuelve markdown, HTML limpio, HTML crudo, enlaces, imágenes y datos estructurados dentro del item, además de capturas de pantalla y PDF como binary. Los resultados se cachean durante alrededor de una hora y un acierto de caché no cuesta nada. Construido sobre [Perceive](/es/docs/v2-perceive). |
| **Scrape Many** | Renderiza hasta 1000 páginas en una sola ejecución. El campo URLs acepta una lista que escribas tú o una expresión que resuelva a un array, así que encadena directamente desde **Website > Map**. Si pones Output Mode en un único archivo ZIP con la salida en PDF, archivas un conjunto de páginas de una sola vez. |
| **Extract** | Obtiene campos con nombre de una o varias páginas. Describe lo que quieres en lenguaje natural, enumera los campos por nombre o aporta un JSON Schema. Los selectores CSS opcionales responden todo lo que pueden antes de que algo llegue a la extracción por IA, lo que abarata las páginas con una maquetación fija. Construido sobre [Distill](/es/docs/v2-distill). |

### Website

| Operación | Qué hace |
|-----------|--------------|
| **Map** | Lista las direcciones de un sitio sin renderizar ninguna. Es rápido y no consume nada de tu asignación de páginas. Construido sobre [Discover](/es/docs/v2-discover). |
| **Crawl** | Lee un sitio entero y devuelve pasajes listos para incrustar, cada uno con su URL de origen, su título y su ruta de encabezados. Se ejecuta sin cookies ni inicio de sesión por diseño. Construido sobre [Ingest](/es/docs/v2-ingest). |

### Search

| Operación | Qué hace |
|-----------|--------------|
| **Search** | Busca en la web, en noticias, imágenes, artículos académicos, patentes o mapas y devuelve un item por resultado. Scrape Top Results además renderiza los primeros resultados y adjunta su markdown, así que una sola ejecución te da la página de resultados y el contenido de las páginas a la vez. Construido sobre [Lookup](/es/docs/v2-lookup). |

### Job

| Operación | Qué hace |
|-----------|--------------|
| **Get** | Busca cualquier trabajo de EnConvert por su ID. El node elige el endpoint correcto a partir del prefijo, así que los IDs de scrape (`per_`), de scrape de varias páginas (`batch_`), de crawl (`ing_`) y de conversión de archivos funcionan todos en el mismo campo. |
| **Get Many** | Lista tus trabajos de crawl recientes, con Return All o un límite. |
| **Cancel** | Detiene un crawl o un scrape de varias páginas en curso. |
| **Retry Webhook** | Vuelve a enviar el webhook de finalización de un crawl terminado. |

---

## Cómo elegir la forma en que vuelven los resultados

Todas las operaciones de File e Image ofrecen tres formas bajo **Response Format**:

| Valor | Qué llega al item |
|-------|------------------------|
| **File** | El archivo convertido como binary de n8n, listo para Gmail, Drive, S3 o Write to Disk |
| **Text** | El contenido como texto en `text`. Al convertir a JSON obtienes en su lugar un objeto parseado en `data` |
| **URL Only** | Solo un enlace de descarga en `downloadUrl`, sin transferir nada |

Convert to PDF y las dos operaciones de Image usan **File** por defecto. Convert to Markdown y Convert Data usan **Text**, porque una cadena markdown o un objeto ya parseado es casi siempre lo que quiere el siguiente node del workflow.

<div class="alert alert-warning">
<strong>Usa URL Only por encima de 16 MB.</strong> El tamaño máximo por item de n8n es de 16 MB por defecto y no se puede ajustar en n8n Cloud, así que una conversión grande falla cuando el node intenta transportar los bytes. URL Only evita ese problema. Los enlaces de descarga siguen siendo válidos durante 15 minutos.
</div>

---

## Operaciones que se ejecutan como trabajos

**Scrape Many**, **Crawl** y **Split Into Chunks** envían trabajo que puede tardar minutos. Por defecto el node espera y te entrega el resultado terminado. Tres ajustes bajo **Options** controlan ese comportamiento:

| Opción | Predeterminado | Qué hace |
|--------|---------|--------------|
| Wait for Completion | Activado | Desactívalo para recibir el ID del trabajo de inmediato y continuar en otra parte |
| Max Wait Time (Seconds) | 120 | Cuánto tiempo seguir esperando antes de renunciar a la espera |
| Poll Interval (Seconds) | 3 | Cada cuánto comprobar |

Si se agota la espera, el trabajo no se pierde. El error indica el ID del trabajo, y **Job > Get** recupera el resultado terminado cuando vuelvas a por él.

<div class="alert alert-info">
<strong>En n8n Cloud, mantén Max Wait Time por debajo de 300 segundos.</strong> Cloud puede cancelar una ejecución en ese punto, independientemente del ajuste del propio node. Para un crawl de varios cientos de páginas, configura un Webhook URL, desactiva Wait for Completion, apunta el webhook a un node Webhook de n8n y continúa el workflow ahí cuando EnConvert te llame de vuelta.
</div>

---

## Formatos admitidos

**Convert to PDF** acepta `bmp` `csv` `doc` `docx` `epub` `gif` `heic` `heif` `htm` `html` `jpeg` `jpg` `markdown` `md` `mdown` `mkd` `numbers` `odp` `ods` `odt` `ots` `pages` `pdf` `png` `ppt` `pptx` `rtf` `svg` `text` `tif` `tiff` `txt` `webp` `xhtml` `xls` `xlsx`.

**Convert to Markdown** acepta `csv` `doc` `docx` `epub` `htm` `html` `markdown` `md` `mdown` `mkd` `odp` `ods` `odt` `pdf` `ppt` `pptx` `rtf` `text` `txt` `xhtml` `xls` `xlsx`.

**Convert Data** cubre JSON hacia y desde XML, YAML, TOML y CSV, CSV hacia y desde XML, y markdown a HTML.

**Convert Format** cubre JPEG, PNG, WebP, HEIC y SVG en cualquier combinación, además de PDF a JPEG. Width y Height solo se aplican cuando la entrada es un SVG, cada uno acepta de 1 a 10000, y el producto de ambos no puede superar los 25 millones.

**Compress** acepta `png` `jpg` `jpeg` `webp`.

El node comprueba el par antes de enviar nada. Si pides una combinación que no existe, te lo dice en el editor y te indica a qué formatos se puede convertir realmente ese archivo. Las páginas escaneadas como imágenes y sin capa de texto no se leen, porque el node no hace OCR.

---

## Workflows de ejemplo

### Documento de Word a un resumen con IA

```text
Google Drive (Download)  ->  EnConvert                       ->  Basic LLM Chain
                             File · Convert to Markdown
                             Response Format: Text
```

El markdown llega a `{{ $json.text }}`. Este es el camino que `Extract From File` no puede tomar, porque no lee `.docx`.

### Factura HTML a un PDF adjunto

```text
Set (build the HTML)  ->  Convert to File   ->  EnConvert                 ->  Gmail (Send)
                          (Text to File)       File · Convert to PDF
                                               PDF Options: A4, margins
```

### Sitio web a un vector store

```text
EnConvert                     ->  Embeddings  ->  Pinecone
Website · Crawl
Mode: Sitemap, Max Pages: 200
Output: Chunks
```

Cada item lleva `content`, `sourceUrl`, `title`, `headingsPath`, `wordCount` y `chunkIndex`, que es exactamente la forma que esperan un Default Data Loader y un node de vector store. Un solo node sustituye al pipeline habitual de crawl, chunk, bucle y código.

### Precios de la competencia a una hoja de cálculo

```text
EnConvert         ->  EnConvert                          ->  Google Sheets
Website · Map         Web Page · Extract
Mode: Sitemap         Source: Specific URLs
                      Define Fields By: Description
                      "the plan name and the monthly price"
```

Map es el primer paso barato aquí. Lista las direcciones del sitio sin renderizarlas, así que solo gastas asignación de páginas en las páginas que realmente quieres.

### Captura de pantalla diaria a Slack

```text
Schedule Trigger  ->  EnConvert            ->  Slack (Upload file)
                      Web Page · Scrape
                      Outputs: Screenshot
```

El PNG llega como binary en `screenshot`. No hace falta un segundo node para descargarlo.

---

## Usar el node como herramienta de AI Agent

Todas las operaciones están disponibles como herramienta para el node AI Agent de n8n. Las operaciones web son las que mejor le encajan a un agente, porque un agente puede aportar una URL o una consulta de búsqueda, pero no tiene forma de entregar un archivo.

Las cuatro que vale la pena exponer a un agente son **Web Page > Scrape**, **Search > Search**, **Web Page > Extract** y **Website > Map**. Juntas permiten que un agente encuentre páginas, las lea como markdown y saque de ellas datos estructurados, que es el bucle que necesitan la mayoría de los agentes de investigación y de generación de leads.

---

## Solución de problemas

**El node no aparece después de instalarlo.**
Reinicia n8n. Los community nodes se cargan al arrancar. En n8n Cloud, comprueba que el paquete llegara a instalarse, ya que Cloud solo acepta nodes verificados.

**`EnConvert rejected the API key`.**
La clave es incorrecta, o es una clave pública `pk_`. Abre la credencial y ejecuta **Test**. Genera una clave privada en el [panel](/es/dashboard/api-keys).

**`This operation is not included in your EnConvert plan`.**
Scrape, Extract, Search, Map y Crawl están limitadas por plan, y cada una tiene su asignación mensual. Reintentar no sirve de nada. Consulta tu uso y tu plan en la [página de precios](/es/pricing).

**`Could not tell what kind of file is in "data"`.**
El archivo entrante no lleva extensión en el nombre, algo que pasa con las descargas del node HTTP Request. Indica de qué se trata con **Input File Format**, bajo Options, por ejemplo `docx`.

**`This operation expects the node's input data to contain a binary file`.**
El node anterior no devolvió ningún archivo, o usó otro nombre de campo. Revisa **Input Binary Field**, que en la mayoría de los nodes de n8n es `data`.

**Una conversión grande falla dentro de n8n.**
Cambia Response Format a URL Only. Los items de n8n tienen un tope de 16 MB por defecto y ese límite es fijo en Cloud.

**Un crawl agota el tiempo de espera.**
Sube Max Wait Time, o desactiva Wait for Completion y recoge el resultado más tarde con **Job > Get**, usando el ID del trabajo que aparece en el mensaje de error.

---

## Fuente y enlaces

- **npm**: [@enconvert/n8n-nodes-enconvert](https://www.npmjs.com/package/@enconvert/n8n-nodes-enconvert)
- **GitHub**: [enconvert/n8n-nodes-enconvert](https://github.com/enconvert/n8n-nodes-enconvert)
- **Licencia**: MIT
- **Community nodes de n8n**: [docs.n8n.io](https://docs.n8n.io/integrations/community-nodes/)
- **API subyacente**: [Introducción](/es/docs/introduction)

---

## Preguntas frecuentes

### ¿Cómo convierto un archivo DOCX a PDF en n8n?

Añade el node de EnConvert, elige el recurso **File** y la operación **Convert to PDF**, y apunta **Input Binary Field** al campo que contiene el archivo, que en la mayoría de los nodes es `data`. El PDF vuelve como binary en el mismo item, listo para adjuntarlo a un correo o subirlo a un almacenamiento. Los archivos de Word llevan su propia configuración de página, así que el tamaño de página y los márgenes no se les aplican, y el node te dice qué ajustes omitió.

### ¿Cómo extraigo el texto de un documento de Word en n8n?

Usa **File > Convert to Markdown** con Response Format en Text. El texto aterriza en `{{ $json.text }}`. El node `Extract From File` integrado en n8n no puede hacerlo, porque lee CSV, HTML, JSON, ICS, ODS, texto de PDF, RTF, TXT, XLS y XLSX, pero no `.doc`, `.docx` ni `.pptx`.

### ¿Puedo usar este node en n8n Cloud?

n8n Cloud solo instala community nodes que hayan superado su revisión de verificación. Hasta que este node complete esa revisión, instálalo en una instancia autoalojada o llama a la API directamente desde el node HTTP Request, que funciona en cualquier plan. Cloud es justo donde el node más rinde, ya que sus usuarios no pueden instalar herramientas del sistema ni paquetes npm para convertir archivos localmente.

### ¿Cómo extraigo una página web a markdown en n8n?

Usa **Web Page > Scrape** con Markdown seleccionado bajo Outputs. El markdown llega a `{{ $json.markdown }}`. El markdown es unas seis veces más pequeño que el HTML crudo de la misma página, lo que recorta el coste en tokens de cada node de IA posterior y le deja al modelo mucho menos texto de relleno con el que confundirse.

### ¿Cómo hago una captura de pantalla de un sitio web en n8n?

Usa **Web Page > Scrape** y selecciona Screenshot o Full-Page Screenshot bajo Outputs. El PNG llega como binary de n8n en `screenshot`, así que puedes subirlo a Slack o adjuntarlo a un correo directamente. La mayoría de los nodes de scraping devuelven un enlace en su lugar, lo que te obliga a añadir un node HTTP Request para descargar la imagen antes de poder usarla.

### ¿Cómo cargo un sitio web entero en un vector store con n8n?

Usa **Website > Crawl** con Output en Chunks. El node devuelve un item por pasaje, cada uno con `content`, `sourceUrl`, `title`, `headingsPath` y `chunkIndex`, que encaja directamente en un Default Data Loader, un node de Embeddings y un vector store como Pinecone, Qdrant o Supabase. Sustituye al pipeline habitual de crawl por sitemap, scraper, node Code y bucle.

### ¿Por qué mi conversión devuelve un enlace en lugar del archivo?

Response Format está en URL Only. Cámbialo a File para recibir binary de n8n. Lo contrario también resulta útil: los resultados de más de 16 MB no pueden viajar dentro de un item de n8n en Cloud, así que URL Only es la forma de manejar archivos grandes. Los enlaces de descarga siguen siendo válidos durante 15 minutos.

### ¿Qué pasa si un crawl tarda más que el tiempo de espera?

El trabajo sigue ejecutándose en EnConvert. El node lanza un error que contiene el ID del trabajo, y **Job > Get** recupera el resultado terminado más tarde. Para crawls largos, configura un Webhook URL, desactiva Wait for Completion y deja que EnConvert llame a un node Webhook de n8n cuando termine.

### ¿Funciona el node con el node AI Agent de n8n?

Sí, todas las operaciones se exponen como herramienta de agente. Las operaciones web son las que mejor encajan con un agente, porque un agente puede pasar una URL o una consulta de búsqueda, pero no puede entregar un archivo. Scrape, Search, Extract y Map son las cuatro que hacen que un agente resulte realmente útil para investigación y generación de leads.
