n8n Node für Dateikonvertierung und Web-Daten#
@enconvert/n8n-nodes-enconvert ist der offizielle n8n Community Node für EnConvert. Ein einziger Node deckt sechzehn Operationen über sechs Ressourcen ab: Dateien zwischen Formaten konvertieren, Bilder komprimieren, Webseiten als Markdown scrapen, strukturierte Felder aus Seiten extrahieren, das Web durchsuchen und eine komplette Site in Passagen crawlen, die sich sofort in einen Vector Store einbetten lassen. Er liefert echte n8n Binary Data zurück, sodass ein Screenshot oder ein konvertiertes PDF ohne zusätzlichen HTTP Request Node direkt in einen Gmail-Anhang oder einen Google-Drive-Upload wandert.
@enconvert/n8n-nodes-enconvert · Quelle: enconvert/n8n-nodes-enconvert · Lizenz: MIT
Was der Node macht#
n8n bringt zwei eigene Datei-Nodes mit. Extract From File liest CSV, HTML, JSON, ICS, ODS, PDF-Text, RTF, TXT, XLS und XLSX. Convert to File schreibt denselben Satz wieder heraus. Keiner von beiden liest Word, PowerPoint oder EPUB, keiner rendert eine Webseite, und auf n8n Cloud kannst du die Kommandozeilen-Tools nicht installieren, die diese Lücken sonst füllen würden.
Genau dieses Terrain deckt dieser Node ab:
| Was du brauchst | Was der Node liefert |
|---|---|
| Word, PowerPoint, Excel, EPUB oder RTF als Text | File > Convert to Markdown, gibt den Text im item zurück |
| Fast alles als PDF | File > Convert to PDF, mit Seitengröße, Rändern, Kopf- und Fußzeile |
| Eine Webseite als sauberes Markdown | Web Page > Scrape, rund sechsmal kleiner als rohes HTML |
| Ein Screenshot oder Seiten-PDF als echte Datei | Web Page > Scrape, angehängt als n8n binary |
| Benannte Felder von einer Seite | Web Page > Extract, in normaler Sprache beschrieben |
| Eine ganze Site in einem Vector Store | Website > Crawl, ein item pro Passage |
Alles läuft gegen dieselbe REST-API, die auf dieser Site dokumentiert ist. Dein Dashboard-Kontingent, deine Rate-Limits und deine Tarif-Features gelten also genau wie überall sonst.
Installation#
Community Nodes installierst du direkt aus dem Editor heraus. Öffne Settings → Community nodes → Install und gib den Paketnamen ein:
@enconvert/n8n-nodes-enconvert
Auf einer selbst gehosteten n8n-Instanz kannst du ihn auch von der Kommandozeile aus in deinem n8n-Datenverzeichnis installieren:
npm install @enconvert/n8n-nodes-enconvert
Starte n8n nach der Installation neu. Der Node erscheint im Nodes-Panel als EnConvert, und jede Operation ist einzeln suchbar: Auch die Eingabe von „docx", „screenshot" oder „crawl" bringt ihn zum Vorschein.
EnConvert-Credential anlegen#
- Erzeuge im Dashboard einen privaten API-Key. Private Keys beginnen mit
sk_. - Öffne den Node in n8n, klicke auf Create new credential und wähle EnConvert API.
- Füge den Key ein, klicke auf Save und danach auf Test.
Der Credential-Test ruft GET /v1/whoami auf, und dieser Endpunkt akzeptiert nur private Keys. Ein öffentlicher pk_-Key scheitert damit genau hier, in dem Moment, in dem du ihn einfügst, statt später mitten in einem Workflow-Lauf mit einer verwirrenden Meldung.
| Feld | Erforderlich | Standard | Zweck |
|---|---|---|---|
| API Key | Ja | -- | Dein privater Key (sk_...) |
| Base URL | Nein | https://api.enconvert.com |
Ändere das nur, wenn du einen abweichenden Endpunkt genannt bekommen hast |
pk_ beginnen, sind für Browser-Widgets gedacht und werden von jeder Operation in diesem Node abgelehnt. Mehr dazu unter Private Keys.
Operationen#
File#
| Operation | Was sie macht |
|---|---|
| Convert to PDF | Macht aus einem Dokument, einer Tabelle, einer Präsentation, einer Webseite, einem Bild oder einer Textdatei ein PDF. Seitengröße, Ausrichtung, Ränder, Skalierung, Graustufen, Kopf- und Fußzeile gelten für HTML, Markdown, Text, EPUB, Bilder und SVG. Office-Dateien bringen ihr eigenes Seitenlayout mit, deshalb wirkt bei ihnen nur Grayscale, und der Node meldet, welche Einstellungen er übersprungen hat, statt den Lauf abzubrechen. |
| Convert to Markdown | Macht aus Word-, PowerPoint-, Excel-, PDF-, EPUB-, RTF-, HTML- und Textdateien Markdown. Gibt den Text standardmäßig im item zurück, sodass er direkt in einen AI-Node fließt. Basiert auf Anything to Markdown. |
| Convert Data | Konvertiert zwischen JSON, CSV, XML, YAML, TOML und HTML. Bei der Konvertierung nach JSON bekommst du unter data ein geparstes Objekt, bereit für Ausdrücke wie {{ $json.data.total }}. |
| Split Into Chunks | Lädt die Datei jedes Input-items als einen einzigen Job hoch und gibt überlappende Passagen zurück, die sich direkt einbetten lassen. Bis zu 200 Dateien pro Lauf. |
Image#
| Operation | Was sie macht |
|---|---|
| Convert Format | Konvertiert zwischen JPEG, PNG, WebP, HEIC und SVG und rastert eine PDF-Seite nach JPEG. Width und Height legen die Zeichenfläche fest, wenn die Eingabe ein SVG ist. |
| Compress | Verkleinert ein PNG, JPEG oder WebP in Richtung einer Zielgröße in KB. Das Format ändert sich nie. Das Ziel ist Best Effort: Ein Budget, das sich nicht erreichen lässt, liefert die kleinste erzielte Datei statt eines Fehlers, prüfe also die zurückgegebene Größe. |
Web Page#
| Operation | Was sie macht |
|---|---|
| Scrape | Rendert eine Seite und gibt Markdown, bereinigtes HTML, rohes HTML, Links, Bilder und strukturierte Daten im item zurück, dazu Screenshots und PDFs als binary. Ergebnisse werden rund eine Stunde lang gecacht, und ein Cache-Treffer kostet nichts. Basiert auf Perceive. |
| Scrape Many | Rendert bis zu 1000 Seiten in einem Lauf. Das URLs-Feld akzeptiert eine Liste, die du eintippst, oder einen Ausdruck, der ein Array liefert, und schließt damit direkt an Website > Map an. Setzt du Output Mode auf eine einzelne ZIP-Datei mit der PDF-Ausgabe, archivierst du einen ganzen Satz Seiten in einem Rutsch. |
| Extract | Holt benannte Felder aus einer oder aus vielen Seiten. Beschreibe in normaler Sprache, was du brauchst, liste die Felder namentlich auf, oder übergib ein JSON Schema. Optionale CSS-Selektoren beantworten vorab alles, was sie können, bevor der Rest an die AI-Extraktion durchfällt. Das senkt die Kosten auf Seiten mit festem Layout. Basiert auf Distill. |
Website#
| Operation | Was sie macht |
|---|---|
| Map | Listet die Adressen einer Site auf, ohne eine davon zu rendern. Das ist schnell und verbraucht nichts von deinem Seitenkontingent. Basiert auf Discover. |
| Crawl | Liest eine ganze Site und gibt Passagen zurück, die sich direkt einbetten lassen, jede mit ihrer Quell-URL, ihrem Titel und ihrem Überschriftenpfad. Läuft per Design ohne Cookies und ohne Anmeldung. Basiert auf Ingest. |
Search#
| Operation | Was sie macht |
|---|---|
| Search | Durchsucht Web, News, Bilder, Scholar, Patente oder Maps und gibt ein item pro Treffer zurück. Scrape Top Results rendert zusätzlich die ersten Treffer und hängt deren Markdown an, sodass ein einziger Lauf dir die Trefferliste und die Seiteninhalte zusammen liefert. Basiert auf Lookup. |
Job#
| Operation | Was sie macht |
|---|---|
| Get | Schlägt jeden EnConvert-Job anhand seiner ID nach. Der Node wählt den passenden Endpunkt anhand des Präfixes, sodass Scrape- (per_), Multi-Page-Scrape- (batch_), Crawl- (ing_) und Dateikonvertierungs-IDs alle im selben Feld funktionieren. |
| Get Many | Listet deine letzten Crawl-Jobs auf, mit Return All oder einem Limit. |
| Cancel | Stoppt einen laufenden Crawl oder Multi-Page-Scrape. |
| Retry Webhook | Sendet den Abschluss-Webhook eines fertigen Crawls erneut. |
Die Form der Ergebnisse wählen#
Jede File- und Image-Operation bietet unter Response Format drei Formen an:
| Wert | Was auf dem item landet |
|---|---|
| File | Die konvertierte Datei als n8n binary, bereit für Gmail, Drive, S3 oder Write to Disk |
| Text | Der Inhalt als Text unter text. Bei der Konvertierung nach JSON kommt stattdessen ein geparstes Objekt unter data |
| URL Only | Nur ein Download-Link unter downloadUrl, ohne dass Daten übertragen werden |
Convert to PDF und die beiden Image-Operationen stehen standardmäßig auf File. Convert to Markdown und Convert Data stehen standardmäßig auf Text, denn ein Markdown-String oder ein geparstes Objekt ist fast immer genau das, was der nächste Node im Workflow braucht.
Operationen, die als Job laufen#
Scrape Many, Crawl und Split Into Chunks stoßen Arbeit an, die Minuten dauern kann. Standardmäßig wartet der Node und übergibt dir das fertige Ergebnis. Drei Einstellungen unter Options steuern das:
| Option | Standard | Was sie macht |
|---|---|---|
| Wait for Completion | An | Ausschalten, um sofort die Job-ID zu erhalten und woanders weiterzuarbeiten |
| Max Wait Time (Seconds) | 120 | Wie lange gewartet wird, bevor das Warten aufgegeben wird |
| Poll Interval (Seconds) | 3 | Wie oft geprüft wird |
Läuft die Wartezeit ab, ist die Arbeit nicht verloren. Der Fehler nennt die Job-ID, und Job > Get holt das fertige Ergebnis, wann immer du darauf zurückkommst.
Unterstützte Formate#
Convert to PDF akzeptiert bmp csv doc docx epub gif heic heif htm html jpeg jpg markdown md mdown mkd numbers odp ods odt ots pages pdf png ppt pptx rtf svg text tif tiff txt webp xhtml xls xlsx.
Convert to Markdown akzeptiert csv doc docx epub htm html markdown md mdown mkd odp ods odt pdf ppt pptx rtf text txt xhtml xls xlsx.
Convert Data deckt JSON von und nach XML, YAML, TOML und CSV ab, dazu CSV von und nach XML sowie Markdown nach HTML.
Convert Format deckt JPEG, PNG, WebP, HEIC und SVG in jeder Kombination ab, dazu PDF nach JPEG. Width und Height gelten nur, wenn die Eingabe ein SVG ist, akzeptieren jeweils 1 bis 10000, und ihr Produkt darf 25 Millionen nicht überschreiten.
Compress akzeptiert png jpg jpeg webp.
Der Node prüft die Formatkombination, bevor er irgendetwas sendet. Fragst du nach einer Kombination, die es nicht gibt, sagt er dir das direkt im Editor und nennt dazu die Formate, in die sich diese Datei tatsächlich konvertieren lässt. Als Bild eingescannte Seiten ohne Textebene werden nicht gelesen, denn der Node führt kein OCR durch.
Beispiel-Workflows#
Word-Dokument zu einer AI-Zusammenfassung#
Google Drive (Download) -> EnConvert -> Basic LLM Chain
File · Convert to Markdown
Response Format: Text
Das Markdown kommt unter {{ $json.text }} an. Das ist der Weg, den Extract From File nicht gehen kann, weil dieser Node .docx nicht liest.
HTML-Rechnung als PDF-Anhang#
Set (build the HTML) -> Convert to File -> EnConvert -> Gmail (Send)
(Text to File) File · Convert to PDF
PDF Options: A4, margins
Website in einen Vector Store#
EnConvert -> Embeddings -> Pinecone
Website · Crawl
Mode: Sitemap, Max Pages: 200
Output: Chunks
Jedes item trägt content, sourceUrl, title, headingsPath, wordCount und chunkIndex, also exakt die Form, die ein Default Data Loader und ein Vector-Store-Node erwarten. Ein einziger Node ersetzt die sonst übliche Pipeline aus Crawl, Chunking, Loop und Code.
Wettbewerber-Preise in eine Tabelle#
EnConvert -> EnConvert -> Google Sheets
Website · Map Web Page · Extract
Mode: Sitemap Source: Specific URLs
Define Fields By: Description
"the plan name and the monthly price"
Map ist hier der günstige erste Schritt. Es listet die Adressen der Site auf, ohne sie zu rendern, sodass du Seitenkontingent nur für die Seiten ausgibst, die dich wirklich interessieren.
Täglicher Screenshot in Slack#
Schedule Trigger -> EnConvert -> Slack (Upload file)
Web Page · Scrape
Outputs: Screenshot
Das PNG kommt als binary unter screenshot an. Ein zweiter Node zum Abholen ist nicht nötig.
Den Node als AI-Agent-Tool nutzen#
Jede Operation steht dem AI Agent Node von n8n als Tool zur Verfügung. Die Web-Operationen passen am besten zu einem Agenten, denn ein Agent kann eine URL oder eine Suchanfrage liefern, hat aber keine Möglichkeit, eine Datei zu übergeben.
Die vier, die sich für einen Agenten lohnen, sind Web Page > Scrape, Search > Search, Web Page > Extract und Website > Map. Zusammen erlauben sie einem Agenten, Seiten zu finden, sie als Markdown zu lesen und strukturierte Fakten daraus zu ziehen. Genau diese Schleife brauchen die meisten Recherche- und Lead-Generation-Agenten.
Fehlerbehebung#
Der Node erscheint nach der Installation nicht. Starte n8n neu. Community Nodes werden beim Start geladen. Prüfe auf n8n Cloud, ob das Paket überhaupt installiert wurde, denn Cloud akzeptiert nur verifizierte Nodes.
EnConvert rejected the API key.
Der Key ist falsch, oder es ist ein öffentlicher pk_-Key. Öffne die Credential und führe Test aus. Erzeuge im Dashboard einen privaten Key.
This operation is not included in your EnConvert plan.
Scrape, Extract, Search, Map und Crawl sind tarifgebunden, und jede Operation hat ein monatliches Kontingent. Ein erneuter Versuch hilft nicht. Prüfe deine Nutzung und deinen Tarif auf der Preisseite.
Could not tell what kind of file is in "data".
Die eingehende Datei hat keine Endung im Namen, was bei Downloads über den HTTP Request Node regelmäßig passiert. Setze unter Options das Feld Input File Format, um festzulegen, worum es sich handelt, zum Beispiel docx.
This operation expects the node's input data to contain a binary file.
Der vorherige Node hat keine Datei ausgegeben, oder er hat einen anderen Feldnamen verwendet. Prüfe Input Binary Field, das bei den meisten n8n-Nodes data heißt.
Eine große Konvertierung schlägt innerhalb von n8n fehl. Stelle Response Format auf URL Only um. n8n-items sind standardmäßig auf 16 MB begrenzt, und auf Cloud ist dieses Limit fest.
Ein Crawl läuft in ein Timeout. Erhöhe Max Wait Time, oder schalte Wait for Completion aus und hole das Ergebnis später mit Job > Get über die Job-ID aus der Fehlermeldung.
Quellen und Links#
- npm: @enconvert/n8n-nodes-enconvert
- GitHub: enconvert/n8n-nodes-enconvert
- Lizenz: MIT
- n8n Community Nodes: docs.n8n.io
- Zugrunde liegende API: Einführung
Häufig gestellte Fragen#
Wie konvertiere ich in n8n eine DOCX-Datei zu PDF?#
Füge den EnConvert-Node hinzu, wähle die Ressource File und die Operation Convert to PDF, und richte Input Binary Field auf das Feld mit der Datei, das bei den meisten Nodes data heißt. Das PDF kommt als binary auf demselben item zurück, bereit zum Anhängen an eine E-Mail oder zum Hochladen in einen Speicher. Word-Dateien bringen ihr eigenes Seitenlayout mit, deshalb gelten Seitengröße und Ränder für sie nicht, und der Node sagt dir, welche Einstellungen er übersprungen hat.
Wie extrahiere ich in n8n Text aus einem Word-Dokument?#
Nutze File > Convert to Markdown mit Response Format auf Text. Der Text landet unter {{ $json.text }}. Der eingebaute Extract From File Node von n8n kann das nicht, denn er liest CSV, HTML, JSON, ICS, ODS, PDF-Text, RTF, TXT, XLS und XLSX, aber weder .doc noch .docx oder .pptx.
Kann ich diesen Node auf n8n Cloud nutzen?#
n8n Cloud installiert nur Community Nodes, die n8ns Verifizierungsprüfung bestanden haben. Bis dieser Node die Prüfung abgeschlossen hat, installierst du ihn auf einer selbst gehosteten Instanz, oder du rufst die API direkt über den HTTP Request Node auf, was in jedem Tarif funktioniert. Dabei ist gerade Cloud der Ort, an dem sich der Node bezahlt macht, denn Cloud-Nutzer können weder Systemtools noch npm-Pakete installieren, um Dateien lokal zu konvertieren.
Wie scrape ich in n8n eine Webseite zu Markdown?#
Nutze Web Page > Scrape und wähle unter Outputs Markdown. Das Markdown kommt unter {{ $json.markdown }} an. Markdown ist rund sechsmal kleiner als das rohe HTML derselben Seite. Das senkt die Token-Kosten jedes nachgelagerten AI-Nodes und gibt dem Modell deutlich weniger Boilerplate, an dem es sich verheddern kann.
Wie erstelle ich in n8n einen Screenshot einer Website?#
Nutze Web Page > Scrape und wähle unter Outputs Screenshot oder Full-Page Screenshot. Das PNG kommt als n8n binary unter screenshot an, du kannst es also sofort zu Slack hochladen oder an eine E-Mail anhängen. Die meisten Scraping-Nodes liefern stattdessen einen Link und zwingen dich damit, einen HTTP Request Node einzubauen, der das Bild erst noch holt.
Wie lade ich mit n8n eine komplette Website in einen Vector Store?#
Nutze Website > Crawl mit Output auf Chunks. Der Node gibt ein item pro Passage zurück, jedes mit content, sourceUrl, title, headingsPath und chunkIndex, und genau das passt direkt in einen Default Data Loader, einen Embeddings-Node und einen Vector Store wie Pinecone, Qdrant oder Supabase. Es ersetzt die sonst übliche Pipeline aus Sitemap-Crawl, Scraper, Code-Node und Loop.
Warum liefert meine Konvertierung einen Link statt der Datei?#
Response Format steht auf URL Only. Stelle es auf File um, um n8n binary zu erhalten. Der umgekehrte Fall ist genauso nützlich: Ergebnisse über 16 MB können auf Cloud nicht in einem n8n-item reisen, für große Dateien ist URL Only also der richtige Weg. Download-Links bleiben 15 Minuten gültig.
Was passiert, wenn ein Crawl länger dauert als die Wartezeit?#
Der Job läuft bei EnConvert weiter. Der Node wirft einen Fehler, der die Job-ID enthält, und Job > Get holt das fertige Ergebnis später ab. Setze bei langen Crawls eine Webhook URL, schalte Wait for Completion aus, und lass EnConvert einen n8n Webhook Node aufrufen, sobald der Crawl fertig ist.
Funktioniert der Node mit dem AI Agent Node von n8n?#
Ja, jede Operation wird als Agent-Tool bereitgestellt. Die Web-Operationen passen am besten zu einem Agenten, denn ein Agent kann eine URL oder eine Suchanfrage übergeben, aber keine Datei. Scrape, Search, Extract und Map sind die vier, die einen Agenten für Recherche und Lead-Generierung wirklich nützlich machen.