---
seo_title: Nodo n8n per conversione file e web scraping | EnConvert
meta_desc: Installa il community node EnConvert per n8n: converti DOCX, PDF e immagini, trasforma pagine in markdown ed esegui il crawl di interi siti in chunk pronti per il vector store.
keywords: nodo n8n pdf, n8n da docx a pdf, nodo n8n per convertire file, estrarre testo da docx con n8n, nodo n8n web scraping, n8n scraping url in markdown, nodo screenshot n8n, n8n rag vector store da sito web, community node n8n conversione file, nodo n8n enconvert, strumento web scraping per ai agent n8n
---

# Nodo n8n per la conversione di file e i dati web

`@enconvert/n8n-nodes-enconvert` è il community node ufficiale di [n8n](https://n8n.io) per EnConvert. Un solo node copre sedici operazioni distribuite su sei risorse: converte file tra formati, comprime immagini, trasforma pagine web in markdown, estrae campi strutturati dalle pagine, cerca sul web ed esegue il crawl di un intero sito ottenendo chunk pronti da incorporare in un vector store. Restituisce dati binary n8n veri, quindi uno screenshot o un PDF convertito finisce direttamente in un allegato Gmail o in un upload su Google Drive, senza alcun node HTTP Request aggiuntivo.

<div class="alert alert-info">
<strong>npm:</strong> <code>@enconvert/n8n-nodes-enconvert</code> · <strong>Sorgente:</strong> <a href="https://github.com/enconvert/n8n-nodes-enconvert">enconvert/n8n-nodes-enconvert</a> · <strong>Licenza:</strong> MIT
</div>

---

## Cosa fa il node

n8n include già due node per i file. `Extract From File` legge CSV, HTML, JSON, ICS, ODS, il testo dei PDF, RTF, TXT, XLS e XLSX. `Convert to File` riscrive lo stesso insieme di formati. Nessuno dei due legge Word, PowerPoint o EPUB, nessuno dei due renderizza una pagina web e su n8n Cloud non puoi installare gli strumenti da riga di comando che di solito colmerebbero queste lacune.

Questo node copre esattamente quel territorio:

| Ti serve | Cosa ti dà il node |
|----------|--------------------|
| Word, PowerPoint, Excel, EPUB o RTF come testo | `File > Convert to Markdown`, che restituisce il testo nell'item |
| Quasi qualsiasi cosa come PDF | `File > Convert to PDF`, con formato pagina, margini, intestazione e piè di pagina |
| Una pagina web come markdown pulito | `Web Page > Scrape`, circa sei volte più leggero dell'HTML grezzo |
| Uno screenshot o il PDF di una pagina come file vero | `Web Page > Scrape`, allegato come binary n8n |
| Campi con nome estratti da una pagina | `Web Page > Extract`, descritti in linguaggio naturale |
| Un intero sito in un vector store | `Website > Crawl`, un item per chunk |

Tutto passa dalla stessa REST API documentata in questo sito, quindi la quota della tua dashboard, i rate limit e le funzionalità del piano valgono esattamente come altrove.

---

## Installazione

I community node di n8n si installano dall'editor. Apri **Settings → Community nodes → Install**, poi inserisci il nome del pacchetto:

```text
@enconvert/n8n-nodes-enconvert
```

Su n8n self-hosted puoi installarlo anche da riga di comando, dentro la directory dei dati di n8n:

```bash
npm install @enconvert/n8n-nodes-enconvert
```

<div class="alert alert-warning">
<strong>n8n Cloud installa solo i node verificati.</strong> Se il pulsante di installazione non compare o il pacchetto non viene trovato su Cloud, significa che il node non ha ancora completato la verifica di n8n. Fino ad allora le istanze self-hosted possono installarlo, e qualsiasi istanza può chiamare l'API direttamente con il node HTTP Request.
</div>

Riavvia n8n dopo l'installazione. Il node compare nel pannello dei nodi come **EnConvert**, e ogni operazione è ricercabile per conto suo: anche digitando "docx", "screenshot" o "crawl" lo trovi.

---

## Aggiungi la tua credenziale EnConvert

1. Genera una chiave API **privata** nella [dashboard](/it/dashboard/api-keys). Le chiavi private iniziano con `sk_`.
2. In n8n apri il node, clicca **Create new credential** e scegli **EnConvert API**.
3. Incolla la chiave, clicca **Save** e poi **Test**.

Il test della credenziale chiama `GET /v1/whoami`, che accetta solo chiavi private. Significa che una chiave pubblica `pk_` fallisce qui, nel momento esatto in cui la incolli, invece di far fallire più tardi l'esecuzione di un workflow con un messaggio poco chiaro.

| Campo | Obbligatorio | Predefinito | Scopo |
|-------|----------|---------|---------|
| API Key | Sì | -- | La tua chiave privata (`sk_...`) |
| Base URL | No | `https://api.enconvert.com` | Cambialo solo se ti è stato indicato un endpoint diverso |

<div class="alert alert-warning">
<strong>Le chiavi pubbliche non funzionano.</strong> Le chiavi che iniziano con <code>pk_</code> sono pensate per i widget nel browser e vengono rifiutate da ogni operazione di questo node. Trovi altri dettagli in <a href="/it/docs/private-keys">Chiavi private</a>.
</div>

---

## Operazioni

### File

| Operazione | Cosa fa |
|-----------|--------------|
| **Convert to PDF** | Trasforma in PDF un documento, un foglio di calcolo, una presentazione, una pagina web, un'immagine o un file di testo. Formato pagina, orientamento, margini, scala, scala di grigi, intestazione e piè di pagina valgono per HTML, markdown, testo, EPUB, immagini e SVG. I file Office portano con sé la propria impostazione di pagina, quindi su di loro agisce solo Grayscale, e il node segnala quali impostazioni ha ignorato invece di far fallire l'esecuzione. |
| **Convert to Markdown** | Trasforma in markdown i file Word, PowerPoint, Excel, PDF, EPUB, RTF, HTML e di testo. Per impostazione predefinita restituisce il testo nell'item, così alimenta direttamente un node AI. Costruita su [Anything to Markdown](/it/docs/anything-to-markdown). |
| **Convert Data** | Converte tra JSON, CSV, XML, YAML, TOML e HTML. La conversione verso JSON ti dà un oggetto già parsato sotto `data`, pronto per espressioni come `{{ $json.data.total }}`. |
| **Split Into Chunks** | Carica il file di ogni item in ingresso come un unico job e restituisce chunk sovrapposti pronti da incorporare. Fino a 200 file per esecuzione. |

### Image

| Operazione | Cosa fa |
|-----------|--------------|
| **Convert Format** | Converte tra JPEG, PNG, WebP, HEIC e SVG, e rasterizza una pagina PDF in JPEG. Width e Height impostano il canvas quando l'input è un SVG. |
| **Compress** | Riduce un PNG, un JPEG o un WebP verso una dimensione target in KB. Il formato non cambia mai. Il target è best effort: un budget irraggiungibile restituisce il file più piccolo ottenuto invece di un errore, quindi controlla la dimensione che ricevi. |

### Web Page

| Operazione | Cosa fa |
|-----------|--------------|
| **Scrape** | Renderizza una pagina e restituisce markdown, HTML pulito, HTML grezzo, link, immagini e dati strutturati dentro l'item, più screenshot e PDF come binary. I risultati restano in cache per circa un'ora e un cache hit non costa nulla. Costruita su [Perceive](/it/docs/v2-perceive). |
| **Scrape Many** | Renderizza fino a 1000 pagine in una sola esecuzione. Il campo URLs accetta un elenco che scrivi tu oppure un'espressione che risolve in un array, quindi si concatena direttamente a **Website > Map**. Impostando Output Mode su un unico file ZIP con l'output PDF archivi un intero gruppo di pagine in un colpo solo. |
| **Extract** | Estrae campi con nome da una o più pagine. Descrivi ciò che vuoi in linguaggio naturale, elenca i campi per nome oppure fornisci un JSON Schema. I selettori CSS opzionali rispondono a tutto quello che possono prima che il resto passi all'estrazione AI, e questo abbassa il costo sulle pagine con un layout fisso. Costruita su [Distill](/it/docs/v2-distill). |

### Website

| Operazione | Cosa fa |
|-----------|--------------|
| **Map** | Elenca gli indirizzi di un sito senza renderizzarne nessuno. È veloce e non consuma nulla della tua quota di pagine. Costruita su [Discover](/it/docs/v2-discover). |
| **Crawl** | Legge un intero sito e restituisce chunk pronti da incorporare, ciascuno con il proprio URL di origine, il titolo e il percorso dei titoli. Per scelta progettuale gira senza cookie e senza login. Costruita su [Ingest](/it/docs/v2-ingest). |

### Search

| Operazione | Cosa fa |
|-----------|--------------|
| **Search** | Cerca sul web, nelle news, nelle immagini, su scholar, nei brevetti o nelle mappe e restituisce un item per risultato. Scrape Top Results renderizza anche i primi risultati e ne allega il markdown, così una sola esecuzione ti dà insieme la pagina dei risultati e il contenuto delle pagine. Costruita su [Lookup](/it/docs/v2-lookup). |

### Job

| Operazione | Cosa fa |
|-----------|--------------|
| **Get** | Recupera qualsiasi job EnConvert tramite ID. Il node sceglie l'endpoint giusto in base al prefisso, quindi nello stesso campo funzionano gli ID di scrape (`per_`), scrape multipagina (`batch_`), crawl (`ing_`) e conversione file. |
| **Get Many** | Elenca i tuoi crawl recenti, con Return All o un limite. |
| **Cancel** | Ferma un crawl o uno scrape multipagina in corso. |
| **Retry Webhook** | Invia di nuovo il webhook di completamento di un crawl terminato. |

---

## Scegliere come tornano i risultati

Ogni operazione File e Image offre tre forme sotto **Response Format**:

| Valore | Cosa arriva sull'item |
|-------|------------------------|
| **File** | Il file convertito come binary n8n, pronto per Gmail, Drive, S3 o Write to Disk |
| **Text** | Il contenuto come testo sotto `text`. La conversione verso JSON dà invece un oggetto parsato sotto `data` |
| **URL Only** | Solo un link di download sotto `downloadUrl`, senza trasferire nulla |

Convert to PDF e le due operazioni Image usano **File** come impostazione predefinita. Convert to Markdown e Convert Data usano **Text**, perché una stringa markdown o un oggetto parsato è quasi sempre ciò che serve al node successivo del workflow.

<div class="alert alert-warning">
<strong>Sopra i 16 MB usa URL Only.</strong> La dimensione massima predefinita di un item n8n è 16 MB e su n8n Cloud non è modificabile, quindi una conversione grande fallisce quando il node prova a trasportare i byte. URL Only aggira il problema. I link di download restano validi per 15 minuti.
</div>

---

## Operazioni che girano come job

**Scrape Many**, **Crawl** e **Split Into Chunks** inviano lavori che possono durare minuti. Per impostazione predefinita il node attende e ti consegna il risultato finito. Tre impostazioni sotto **Options** governano questo comportamento:

| Opzione | Predefinito | Cosa fa |
|--------|---------|--------------|
| Wait for Completion | On | Disattivala per ricevere subito l'ID del job e proseguire altrove |
| Max Wait Time (Seconds) | 120 | Per quanto tempo continuare ad attendere prima di rinunciare all'attesa |
| Poll Interval (Seconds) | 3 | Ogni quanto controllare |

Se l'attesa scade, il lavoro non va perso. L'errore riporta l'ID del job, e **Job > Get** recupera il risultato finito quando ci torni sopra.

<div class="alert alert-info">
<strong>Su n8n Cloud tieni Max Wait Time sotto i 300 secondi.</strong> A quel punto Cloud può annullare l'esecuzione a prescindere dall'impostazione del node. Per il crawl di qualche centinaio di pagine imposta un Webhook URL, disattiva Wait for Completion, punta il webhook a un node Webhook di n8n e prosegui il workflow da lì quando EnConvert richiama.
</div>

---

## Formati supportati

**Convert to PDF** accetta `bmp` `csv` `doc` `docx` `epub` `gif` `heic` `heif` `htm` `html` `jpeg` `jpg` `markdown` `md` `mdown` `mkd` `numbers` `odp` `ods` `odt` `ots` `pages` `pdf` `png` `ppt` `pptx` `rtf` `svg` `text` `tif` `tiff` `txt` `webp` `xhtml` `xls` `xlsx`.

**Convert to Markdown** accetta `csv` `doc` `docx` `epub` `htm` `html` `markdown` `md` `mdown` `mkd` `odp` `ods` `odt` `pdf` `ppt` `pptx` `rtf` `text` `txt` `xhtml` `xls` `xlsx`.

**Convert Data** copre JSON da e verso XML, YAML, TOML e CSV, CSV da e verso XML, e markdown verso HTML.

**Convert Format** copre JPEG, PNG, WebP, HEIC e SVG in qualsiasi combinazione, più PDF verso JPEG. Width e Height si applicano solo quando l'input è un SVG, ciascuna accetta un valore da 1 a 10000, e le due moltiplicate tra loro non possono superare 25 milioni.

**Compress** accetta `png` `jpg` `jpeg` `webp`.

Il node controlla la coppia di formati prima di inviare qualunque cosa. Se chiedi una combinazione che non esiste te lo dice nell'editor, insieme ai formati in cui quel file può davvero essere convertito. Le pagine scansionate come immagini, prive di livello di testo, non vengono lette, perché il node non esegue OCR.

---

## Esempi di workflow

### Documento Word verso un riassunto AI

```text
Google Drive (Download)  ->  EnConvert                       ->  Basic LLM Chain
                             File · Convert to Markdown
                             Response Format: Text
```

Il markdown arriva in `{{ $json.text }}`. Questa è la strada che `Extract From File` non può percorrere, perché non legge i file `.docx`.

### Fattura HTML verso un allegato PDF

```text
Set (build the HTML)  ->  Convert to File   ->  EnConvert                 ->  Gmail (Send)
                          (Text to File)       File · Convert to PDF
                                               PDF Options: A4, margins
```

### Sito web verso un vector store

```text
EnConvert                     ->  Embeddings  ->  Pinecone
Website · Crawl
Mode: Sitemap, Max Pages: 200
Output: Chunks
```

Ogni item porta `content`, `sourceUrl`, `title`, `headingsPath`, `wordCount` e `chunkIndex`, che è esattamente la forma attesa da un Default Data Loader e da un node vector store. Un solo node sostituisce la solita pipeline fatta di crawl, chunk, loop e codice.

### Prezzi dei concorrenti in un foglio di calcolo

```text
EnConvert         ->  EnConvert                          ->  Google Sheets
Website · Map         Web Page · Extract
Mode: Sitemap         Source: Specific URLs
                      Define Fields By: Description
                      "the plan name and the monthly price"
```

Qui Map è il primo passo, quello economico. Elenca gli indirizzi del sito senza renderizzarli, così spendi quota di pagine solo per le pagine che ti interessano davvero.

### Screenshot giornaliero su Slack

```text
Schedule Trigger  ->  EnConvert            ->  Slack (Upload file)
                      Web Page · Scrape
                      Outputs: Screenshot
```

Il PNG arriva come binary sotto `screenshot`. Non serve un secondo node per recuperarlo.

---

## Usare il node come strumento per un AI Agent

Ogni operazione è disponibile come strumento per il node AI Agent di n8n. Le operazioni web sono quelle che si adattano meglio a un agente, perché un agente può fornire un URL o una query di ricerca ma non ha modo di consegnare un file.

Le quattro che vale la pena esporre a un agente sono **Web Page > Scrape**, **Search > Search**, **Web Page > Extract** e **Website > Map**. Insieme permettono a un agente di trovare le pagine, leggerle come markdown ed estrarne fatti strutturati, cioè il ciclo di cui ha bisogno la maggior parte degli agenti di ricerca e di lead generation.

---

## Risoluzione dei problemi

**Il node non compare dopo l'installazione.**
Riavvia n8n. I community node si caricano all'avvio. Su n8n Cloud verifica che il pacchetto si sia installato davvero, dato che Cloud accetta solo i node verificati.

**`EnConvert rejected the API key`.**
La chiave è sbagliata, oppure è una chiave pubblica `pk_`. Apri la credenziale ed esegui **Test**. Genera una chiave privata nella [dashboard](/it/dashboard/api-keys).

**`This operation is not included in your EnConvert plan`.**
Scrape, Extract, Search, Map e Crawl dipendono dal piano, e ciascuna ha una quota mensile. Riprovare non serve a nulla. Controlla il tuo consumo e il tuo piano sulla [pagina dei prezzi](/it/pricing).

**`Could not tell what kind of file is in "data"`.**
Il file in ingresso non ha estensione nel nome, cosa che capita con i download fatti dal node HTTP Request. Imposta **Input File Format** sotto Options per dichiarare di che file si tratta, per esempio `docx`.

**`This operation expects the node's input data to contain a binary file`.**
Il node precedente non ha prodotto un file, oppure ha usato un nome di campo diverso. Controlla **Input Binary Field**, che sulla maggior parte dei node n8n è `data`.

**Una conversione grande fallisce dentro n8n.**
Cambia Response Format in URL Only. Gli item di n8n si fermano a 16 MB per impostazione predefinita, e su Cloud quel limite è fisso.

**Un crawl va in timeout.**
Alza Max Wait Time, oppure disattiva Wait for Completion e raccogli il risultato più tardi con **Job > Get**, usando l'ID del job che trovi nel messaggio di errore.

---

## Sorgente e link

- **npm**: [@enconvert/n8n-nodes-enconvert](https://www.npmjs.com/package/@enconvert/n8n-nodes-enconvert)
- **GitHub**: [enconvert/n8n-nodes-enconvert](https://github.com/enconvert/n8n-nodes-enconvert)
- **Licenza**: MIT
- **Community node di n8n**: [docs.n8n.io](https://docs.n8n.io/integrations/community-nodes/)
- **API sottostante**: [Introduzione](/it/docs/introduction)

---

## Domande frequenti

### Come converto un file DOCX in PDF in n8n?

Aggiungi il node EnConvert, scegli la risorsa **File** e l'operazione **Convert to PDF**, poi punta **Input Binary Field** al campo che contiene il file, che sulla maggior parte dei node è `data`. Il PDF torna come binary sullo stesso item, pronto da allegare a un'email o da caricare su uno storage. I file Word portano con sé la propria impostazione di pagina, quindi formato pagina e margini non valgono per loro e il node ti dice quali impostazioni ha ignorato.

### Come estraggo il testo da un documento Word in n8n?

Usa **File > Convert to Markdown** con Response Format impostato su Text. Il testo arriva in `{{ $json.text }}`. Il node `Extract From File` integrato in n8n non può farlo, perché legge CSV, HTML, JSON, ICS, ODS, il testo dei PDF, RTF, TXT, XLS e XLSX, ma non i file `.doc`, `.docx` o `.pptx`.

### Posso usare questo node su n8n Cloud?

n8n Cloud installa solo i community node che hanno superato la verifica di n8n. Finché questo node non completa quella verifica, installalo su un'istanza self-hosted oppure chiama l'API direttamente dal node HTTP Request, che funziona su qualsiasi piano. Cloud è proprio il contesto in cui il node vale di più, dato che chi usa Cloud non può installare strumenti di sistema o pacchetti npm per convertire i file localmente.

### Come trasformo una pagina web in markdown in n8n?

Usa **Web Page > Scrape** con Markdown selezionato sotto Outputs. Il markdown arriva in `{{ $json.markdown }}`. Il markdown è circa sei volte più leggero dell'HTML grezzo della stessa pagina: taglia il costo in token di ogni node AI a valle e lascia al modello molto meno boilerplate su cui confondersi.

### Come faccio lo screenshot di un sito web in n8n?

Usa **Web Page > Scrape** e seleziona Screenshot o Full-Page Screenshot sotto Outputs. Il PNG arriva come binary n8n sotto `screenshot`, così puoi caricarlo su Slack o allegarlo a un'email immediatamente. La maggior parte dei node di scraping restituisce invece un link, il che ti obbliga ad aggiungere un node HTTP Request per recuperare l'immagine prima di poterla usare.

### Come carico un intero sito web in un vector store con n8n?

Usa **Website > Crawl** con Output impostato su Chunks. Il node restituisce un item per chunk, ciascuno con `content`, `sourceUrl`, `title`, `headingsPath` e `chunkIndex`, che si innesta direttamente in un Default Data Loader, in un node Embeddings e in un vector store come Pinecone, Qdrant o Supabase. Sostituisce la solita pipeline fatta di crawl della sitemap, scraper, node Code e loop.

### Perché la mia conversione restituisce un link invece del file?

Response Format è impostato su URL Only. Passa a File per ricevere il binary n8n. Vale anche il contrario: i risultati sopra i 16 MB non possono viaggiare dentro un item n8n su Cloud, quindi URL Only è il modo giusto di gestire i file grandi. I link di download restano validi per 15 minuti.

### Cosa succede se un crawl dura più del tempo di attesa?

Il job continua a girare su EnConvert. Il node solleva un errore che contiene l'ID del job, e **Job > Get** recupera il risultato finito più tardi. Per i crawl lunghi imposta un Webhook URL, disattiva Wait for Completion e lascia che sia EnConvert a chiamare un node Webhook di n8n quando ha finito.

### Il node funziona con il node AI Agent di n8n?

Sì, ogni operazione è esposta come strumento per l'agente. Le operazioni web sono quelle più adatte a un agente, perché un agente può passare un URL o una query di ricerca ma non può consegnare un file. Scrape, Search, Extract e Map sono le quattro che rendono un agente davvero utile per la ricerca e la lead generation.
