Nodo n8n per la conversione di file e i dati web#
@enconvert/n8n-nodes-enconvert è il community node ufficiale di n8n per EnConvert. Un solo node copre sedici operazioni distribuite su sei risorse: converte file tra formati, comprime immagini, trasforma pagine web in markdown, estrae campi strutturati dalle pagine, cerca sul web ed esegue il crawl di un intero sito ottenendo chunk pronti da incorporare in un vector store. Restituisce dati binary n8n veri, quindi uno screenshot o un PDF convertito finisce direttamente in un allegato Gmail o in un upload su Google Drive, senza alcun node HTTP Request aggiuntivo.
@enconvert/n8n-nodes-enconvert · Sorgente: enconvert/n8n-nodes-enconvert · Licenza: MIT
Cosa fa il node#
n8n include già due node per i file. Extract From File legge CSV, HTML, JSON, ICS, ODS, il testo dei PDF, RTF, TXT, XLS e XLSX. Convert to File riscrive lo stesso insieme di formati. Nessuno dei due legge Word, PowerPoint o EPUB, nessuno dei due renderizza una pagina web e su n8n Cloud non puoi installare gli strumenti da riga di comando che di solito colmerebbero queste lacune.
Questo node copre esattamente quel territorio:
| Ti serve | Cosa ti dà il node |
|---|---|
| Word, PowerPoint, Excel, EPUB o RTF come testo | File > Convert to Markdown, che restituisce il testo nell'item |
| Quasi qualsiasi cosa come PDF | File > Convert to PDF, con formato pagina, margini, intestazione e piè di pagina |
| Una pagina web come markdown pulito | Web Page > Scrape, circa sei volte più leggero dell'HTML grezzo |
| Uno screenshot o il PDF di una pagina come file vero | Web Page > Scrape, allegato come binary n8n |
| Campi con nome estratti da una pagina | Web Page > Extract, descritti in linguaggio naturale |
| Un intero sito in un vector store | Website > Crawl, un item per chunk |
Tutto passa dalla stessa REST API documentata in questo sito, quindi la quota della tua dashboard, i rate limit e le funzionalità del piano valgono esattamente come altrove.
Installazione#
I community node di n8n si installano dall'editor. Apri Settings → Community nodes → Install, poi inserisci il nome del pacchetto:
@enconvert/n8n-nodes-enconvert
Su n8n self-hosted puoi installarlo anche da riga di comando, dentro la directory dei dati di n8n:
npm install @enconvert/n8n-nodes-enconvert
Riavvia n8n dopo l'installazione. Il node compare nel pannello dei nodi come EnConvert, e ogni operazione è ricercabile per conto suo: anche digitando "docx", "screenshot" o "crawl" lo trovi.
Aggiungi la tua credenziale EnConvert#
- Genera una chiave API privata nella dashboard. Le chiavi private iniziano con
sk_. - In n8n apri il node, clicca Create new credential e scegli EnConvert API.
- Incolla la chiave, clicca Save e poi Test.
Il test della credenziale chiama GET /v1/whoami, che accetta solo chiavi private. Significa che una chiave pubblica pk_ fallisce qui, nel momento esatto in cui la incolli, invece di far fallire più tardi l'esecuzione di un workflow con un messaggio poco chiaro.
| Campo | Obbligatorio | Predefinito | Scopo |
|---|---|---|---|
| API Key | Sì | -- | La tua chiave privata (sk_...) |
| Base URL | No | https://api.enconvert.com |
Cambialo solo se ti è stato indicato un endpoint diverso |
pk_ sono pensate per i widget nel browser e vengono rifiutate da ogni operazione di questo node. Trovi altri dettagli in Chiavi private.
Operazioni#
File#
| Operazione | Cosa fa |
|---|---|
| Convert to PDF | Trasforma in PDF un documento, un foglio di calcolo, una presentazione, una pagina web, un'immagine o un file di testo. Formato pagina, orientamento, margini, scala, scala di grigi, intestazione e piè di pagina valgono per HTML, markdown, testo, EPUB, immagini e SVG. I file Office portano con sé la propria impostazione di pagina, quindi su di loro agisce solo Grayscale, e il node segnala quali impostazioni ha ignorato invece di far fallire l'esecuzione. |
| Convert to Markdown | Trasforma in markdown i file Word, PowerPoint, Excel, PDF, EPUB, RTF, HTML e di testo. Per impostazione predefinita restituisce il testo nell'item, così alimenta direttamente un node AI. Costruita su Anything to Markdown. |
| Convert Data | Converte tra JSON, CSV, XML, YAML, TOML e HTML. La conversione verso JSON ti dà un oggetto già parsato sotto data, pronto per espressioni come {{ $json.data.total }}. |
| Split Into Chunks | Carica il file di ogni item in ingresso come un unico job e restituisce chunk sovrapposti pronti da incorporare. Fino a 200 file per esecuzione. |
Image#
| Operazione | Cosa fa |
|---|---|
| Convert Format | Converte tra JPEG, PNG, WebP, HEIC e SVG, e rasterizza una pagina PDF in JPEG. Width e Height impostano il canvas quando l'input è un SVG. |
| Compress | Riduce un PNG, un JPEG o un WebP verso una dimensione target in KB. Il formato non cambia mai. Il target è best effort: un budget irraggiungibile restituisce il file più piccolo ottenuto invece di un errore, quindi controlla la dimensione che ricevi. |
Web Page#
| Operazione | Cosa fa |
|---|---|
| Scrape | Renderizza una pagina e restituisce markdown, HTML pulito, HTML grezzo, link, immagini e dati strutturati dentro l'item, più screenshot e PDF come binary. I risultati restano in cache per circa un'ora e un cache hit non costa nulla. Costruita su Perceive. |
| Scrape Many | Renderizza fino a 1000 pagine in una sola esecuzione. Il campo URLs accetta un elenco che scrivi tu oppure un'espressione che risolve in un array, quindi si concatena direttamente a Website > Map. Impostando Output Mode su un unico file ZIP con l'output PDF archivi un intero gruppo di pagine in un colpo solo. |
| Extract | Estrae campi con nome da una o più pagine. Descrivi ciò che vuoi in linguaggio naturale, elenca i campi per nome oppure fornisci un JSON Schema. I selettori CSS opzionali rispondono a tutto quello che possono prima che il resto passi all'estrazione AI, e questo abbassa il costo sulle pagine con un layout fisso. Costruita su Distill. |
Website#
| Operazione | Cosa fa |
|---|---|
| Map | Elenca gli indirizzi di un sito senza renderizzarne nessuno. È veloce e non consuma nulla della tua quota di pagine. Costruita su Discover. |
| Crawl | Legge un intero sito e restituisce chunk pronti da incorporare, ciascuno con il proprio URL di origine, il titolo e il percorso dei titoli. Per scelta progettuale gira senza cookie e senza login. Costruita su Ingest. |
Search#
| Operazione | Cosa fa |
|---|---|
| Search | Cerca sul web, nelle news, nelle immagini, su scholar, nei brevetti o nelle mappe e restituisce un item per risultato. Scrape Top Results renderizza anche i primi risultati e ne allega il markdown, così una sola esecuzione ti dà insieme la pagina dei risultati e il contenuto delle pagine. Costruita su Lookup. |
Job#
| Operazione | Cosa fa |
|---|---|
| Get | Recupera qualsiasi job EnConvert tramite ID. Il node sceglie l'endpoint giusto in base al prefisso, quindi nello stesso campo funzionano gli ID di scrape (per_), scrape multipagina (batch_), crawl (ing_) e conversione file. |
| Get Many | Elenca i tuoi crawl recenti, con Return All o un limite. |
| Cancel | Ferma un crawl o uno scrape multipagina in corso. |
| Retry Webhook | Invia di nuovo il webhook di completamento di un crawl terminato. |
Scegliere come tornano i risultati#
Ogni operazione File e Image offre tre forme sotto Response Format:
| Valore | Cosa arriva sull'item |
|---|---|
| File | Il file convertito come binary n8n, pronto per Gmail, Drive, S3 o Write to Disk |
| Text | Il contenuto come testo sotto text. La conversione verso JSON dà invece un oggetto parsato sotto data |
| URL Only | Solo un link di download sotto downloadUrl, senza trasferire nulla |
Convert to PDF e le due operazioni Image usano File come impostazione predefinita. Convert to Markdown e Convert Data usano Text, perché una stringa markdown o un oggetto parsato è quasi sempre ciò che serve al node successivo del workflow.
Operazioni che girano come job#
Scrape Many, Crawl e Split Into Chunks inviano lavori che possono durare minuti. Per impostazione predefinita il node attende e ti consegna il risultato finito. Tre impostazioni sotto Options governano questo comportamento:
| Opzione | Predefinito | Cosa fa |
|---|---|---|
| Wait for Completion | On | Disattivala per ricevere subito l'ID del job e proseguire altrove |
| Max Wait Time (Seconds) | 120 | Per quanto tempo continuare ad attendere prima di rinunciare all'attesa |
| Poll Interval (Seconds) | 3 | Ogni quanto controllare |
Se l'attesa scade, il lavoro non va perso. L'errore riporta l'ID del job, e Job > Get recupera il risultato finito quando ci torni sopra.
Formati supportati#
Convert to PDF accetta bmp csv doc docx epub gif heic heif htm html jpeg jpg markdown md mdown mkd numbers odp ods odt ots pages pdf png ppt pptx rtf svg text tif tiff txt webp xhtml xls xlsx.
Convert to Markdown accetta csv doc docx epub htm html markdown md mdown mkd odp ods odt pdf ppt pptx rtf text txt xhtml xls xlsx.
Convert Data copre JSON da e verso XML, YAML, TOML e CSV, CSV da e verso XML, e markdown verso HTML.
Convert Format copre JPEG, PNG, WebP, HEIC e SVG in qualsiasi combinazione, più PDF verso JPEG. Width e Height si applicano solo quando l'input è un SVG, ciascuna accetta un valore da 1 a 10000, e le due moltiplicate tra loro non possono superare 25 milioni.
Compress accetta png jpg jpeg webp.
Il node controlla la coppia di formati prima di inviare qualunque cosa. Se chiedi una combinazione che non esiste te lo dice nell'editor, insieme ai formati in cui quel file può davvero essere convertito. Le pagine scansionate come immagini, prive di livello di testo, non vengono lette, perché il node non esegue OCR.
Esempi di workflow#
Documento Word verso un riassunto AI#
Google Drive (Download) -> EnConvert -> Basic LLM Chain
File · Convert to Markdown
Response Format: Text
Il markdown arriva in {{ $json.text }}. Questa è la strada che Extract From File non può percorrere, perché non legge i file .docx.
Fattura HTML verso un allegato PDF#
Set (build the HTML) -> Convert to File -> EnConvert -> Gmail (Send)
(Text to File) File · Convert to PDF
PDF Options: A4, margins
Sito web verso un vector store#
EnConvert -> Embeddings -> Pinecone
Website · Crawl
Mode: Sitemap, Max Pages: 200
Output: Chunks
Ogni item porta content, sourceUrl, title, headingsPath, wordCount e chunkIndex, che è esattamente la forma attesa da un Default Data Loader e da un node vector store. Un solo node sostituisce la solita pipeline fatta di crawl, chunk, loop e codice.
Prezzi dei concorrenti in un foglio di calcolo#
EnConvert -> EnConvert -> Google Sheets
Website · Map Web Page · Extract
Mode: Sitemap Source: Specific URLs
Define Fields By: Description
"the plan name and the monthly price"
Qui Map è il primo passo, quello economico. Elenca gli indirizzi del sito senza renderizzarli, così spendi quota di pagine solo per le pagine che ti interessano davvero.
Screenshot giornaliero su Slack#
Schedule Trigger -> EnConvert -> Slack (Upload file)
Web Page · Scrape
Outputs: Screenshot
Il PNG arriva come binary sotto screenshot. Non serve un secondo node per recuperarlo.
Usare il node come strumento per un AI Agent#
Ogni operazione è disponibile come strumento per il node AI Agent di n8n. Le operazioni web sono quelle che si adattano meglio a un agente, perché un agente può fornire un URL o una query di ricerca ma non ha modo di consegnare un file.
Le quattro che vale la pena esporre a un agente sono Web Page > Scrape, Search > Search, Web Page > Extract e Website > Map. Insieme permettono a un agente di trovare le pagine, leggerle come markdown ed estrarne fatti strutturati, cioè il ciclo di cui ha bisogno la maggior parte degli agenti di ricerca e di lead generation.
Risoluzione dei problemi#
Il node non compare dopo l'installazione. Riavvia n8n. I community node si caricano all'avvio. Su n8n Cloud verifica che il pacchetto si sia installato davvero, dato che Cloud accetta solo i node verificati.
EnConvert rejected the API key.
La chiave è sbagliata, oppure è una chiave pubblica pk_. Apri la credenziale ed esegui Test. Genera una chiave privata nella dashboard.
This operation is not included in your EnConvert plan.
Scrape, Extract, Search, Map e Crawl dipendono dal piano, e ciascuna ha una quota mensile. Riprovare non serve a nulla. Controlla il tuo consumo e il tuo piano sulla pagina dei prezzi.
Could not tell what kind of file is in "data".
Il file in ingresso non ha estensione nel nome, cosa che capita con i download fatti dal node HTTP Request. Imposta Input File Format sotto Options per dichiarare di che file si tratta, per esempio docx.
This operation expects the node's input data to contain a binary file.
Il node precedente non ha prodotto un file, oppure ha usato un nome di campo diverso. Controlla Input Binary Field, che sulla maggior parte dei node n8n è data.
Una conversione grande fallisce dentro n8n. Cambia Response Format in URL Only. Gli item di n8n si fermano a 16 MB per impostazione predefinita, e su Cloud quel limite è fisso.
Un crawl va in timeout. Alza Max Wait Time, oppure disattiva Wait for Completion e raccogli il risultato più tardi con Job > Get, usando l'ID del job che trovi nel messaggio di errore.
Sorgente e link#
- npm: @enconvert/n8n-nodes-enconvert
- GitHub: enconvert/n8n-nodes-enconvert
- Licenza: MIT
- Community node di n8n: docs.n8n.io
- API sottostante: Introduzione
Domande frequenti#
Come converto un file DOCX in PDF in n8n?#
Aggiungi il node EnConvert, scegli la risorsa File e l'operazione Convert to PDF, poi punta Input Binary Field al campo che contiene il file, che sulla maggior parte dei node è data. Il PDF torna come binary sullo stesso item, pronto da allegare a un'email o da caricare su uno storage. I file Word portano con sé la propria impostazione di pagina, quindi formato pagina e margini non valgono per loro e il node ti dice quali impostazioni ha ignorato.
Come estraggo il testo da un documento Word in n8n?#
Usa File > Convert to Markdown con Response Format impostato su Text. Il testo arriva in {{ $json.text }}. Il node Extract From File integrato in n8n non può farlo, perché legge CSV, HTML, JSON, ICS, ODS, il testo dei PDF, RTF, TXT, XLS e XLSX, ma non i file .doc, .docx o .pptx.
Posso usare questo node su n8n Cloud?#
n8n Cloud installa solo i community node che hanno superato la verifica di n8n. Finché questo node non completa quella verifica, installalo su un'istanza self-hosted oppure chiama l'API direttamente dal node HTTP Request, che funziona su qualsiasi piano. Cloud è proprio il contesto in cui il node vale di più, dato che chi usa Cloud non può installare strumenti di sistema o pacchetti npm per convertire i file localmente.
Come trasformo una pagina web in markdown in n8n?#
Usa Web Page > Scrape con Markdown selezionato sotto Outputs. Il markdown arriva in {{ $json.markdown }}. Il markdown è circa sei volte più leggero dell'HTML grezzo della stessa pagina: taglia il costo in token di ogni node AI a valle e lascia al modello molto meno boilerplate su cui confondersi.
Come faccio lo screenshot di un sito web in n8n?#
Usa Web Page > Scrape e seleziona Screenshot o Full-Page Screenshot sotto Outputs. Il PNG arriva come binary n8n sotto screenshot, così puoi caricarlo su Slack o allegarlo a un'email immediatamente. La maggior parte dei node di scraping restituisce invece un link, il che ti obbliga ad aggiungere un node HTTP Request per recuperare l'immagine prima di poterla usare.
Come carico un intero sito web in un vector store con n8n?#
Usa Website > Crawl con Output impostato su Chunks. Il node restituisce un item per chunk, ciascuno con content, sourceUrl, title, headingsPath e chunkIndex, che si innesta direttamente in un Default Data Loader, in un node Embeddings e in un vector store come Pinecone, Qdrant o Supabase. Sostituisce la solita pipeline fatta di crawl della sitemap, scraper, node Code e loop.
Perché la mia conversione restituisce un link invece del file?#
Response Format è impostato su URL Only. Passa a File per ricevere il binary n8n. Vale anche il contrario: i risultati sopra i 16 MB non possono viaggiare dentro un item n8n su Cloud, quindi URL Only è il modo giusto di gestire i file grandi. I link di download restano validi per 15 minuti.
Cosa succede se un crawl dura più del tempo di attesa?#
Il job continua a girare su EnConvert. Il node solleva un errore che contiene l'ID del job, e Job > Get recupera il risultato finito più tardi. Per i crawl lunghi imposta un Webhook URL, disattiva Wait for Completion e lascia che sia EnConvert a chiamare un node Webhook di n8n quando ha finito.
Il node funziona con il node AI Agent di n8n?#
Sì, ogni operazione è esposta come strumento per l'agente. Le operazioni web sono quelle più adatte a un agente, perché un agente può passare un URL o una query di ricerca ma non può consegnare un file. Scrape, Search, Extract e Map sono le quattro che rendono un agente davvero utile per la ricerca e la lead generation.