---
seo_title: n8n Node für Dateikonvertierung und Web-Scraping | EnConvert
meta_desc: Installiere den EnConvert n8n Community Node: DOCX, PDF und Bilder konvertieren, Seiten als Markdown scrapen und ganze Sites in vektorfertige Chunks crawlen.
keywords: n8n pdf node, n8n docx zu pdf, n8n datei konvertieren node, n8n text aus docx extrahieren, n8n web scraping node, n8n url zu markdown scrapen, n8n screenshot node, n8n rag vector store website, n8n community node dateikonvertierung, enconvert n8n node, n8n ai agent web scraping tool
---

# n8n Node für Dateikonvertierung und Web-Daten

`@enconvert/n8n-nodes-enconvert` ist der offizielle [n8n](https://n8n.io) Community Node für EnConvert. Ein einziger Node deckt sechzehn Operationen über sechs Ressourcen ab: Dateien zwischen Formaten konvertieren, Bilder komprimieren, Webseiten als Markdown scrapen, strukturierte Felder aus Seiten extrahieren, das Web durchsuchen und eine komplette Site in Passagen crawlen, die sich sofort in einen Vector Store einbetten lassen. Er liefert echte n8n Binary Data zurück, sodass ein Screenshot oder ein konvertiertes PDF ohne zusätzlichen HTTP Request Node direkt in einen Gmail-Anhang oder einen Google-Drive-Upload wandert.

<div class="alert alert-info">
<strong>npm:</strong> <code>@enconvert/n8n-nodes-enconvert</code> · <strong>Quelle:</strong> <a href="https://github.com/enconvert/n8n-nodes-enconvert">enconvert/n8n-nodes-enconvert</a> · <strong>Lizenz:</strong> MIT
</div>

---

## Was der Node macht

n8n bringt zwei eigene Datei-Nodes mit. `Extract From File` liest CSV, HTML, JSON, ICS, ODS, PDF-Text, RTF, TXT, XLS und XLSX. `Convert to File` schreibt denselben Satz wieder heraus. Keiner von beiden liest Word, PowerPoint oder EPUB, keiner rendert eine Webseite, und auf n8n Cloud kannst du die Kommandozeilen-Tools nicht installieren, die diese Lücken sonst füllen würden.

Genau dieses Terrain deckt dieser Node ab:

| Was du brauchst | Was der Node liefert |
|----------|--------------------|
| Word, PowerPoint, Excel, EPUB oder RTF als Text | `File > Convert to Markdown`, gibt den Text im item zurück |
| Fast alles als PDF | `File > Convert to PDF`, mit Seitengröße, Rändern, Kopf- und Fußzeile |
| Eine Webseite als sauberes Markdown | `Web Page > Scrape`, rund sechsmal kleiner als rohes HTML |
| Ein Screenshot oder Seiten-PDF als echte Datei | `Web Page > Scrape`, angehängt als n8n binary |
| Benannte Felder von einer Seite | `Web Page > Extract`, in normaler Sprache beschrieben |
| Eine ganze Site in einem Vector Store | `Website > Crawl`, ein item pro Passage |

Alles läuft gegen dieselbe REST-API, die auf dieser Site dokumentiert ist. Dein Dashboard-Kontingent, deine Rate-Limits und deine Tarif-Features gelten also genau wie überall sonst.

---

## Installation

Community Nodes installierst du direkt aus dem Editor heraus. Öffne **Settings → Community nodes → Install** und gib den Paketnamen ein:

```text
@enconvert/n8n-nodes-enconvert
```

Auf einer selbst gehosteten n8n-Instanz kannst du ihn auch von der Kommandozeile aus in deinem n8n-Datenverzeichnis installieren:

```bash
npm install @enconvert/n8n-nodes-enconvert
```

<div class="alert alert-warning">
<strong>n8n Cloud installiert ausschließlich verifizierte Nodes.</strong> Fehlt der Install-Button oder lässt sich das Paket auf Cloud nicht finden, hat der Node n8ns Verifizierungsprüfung noch nicht abgeschlossen. Bis dahin können selbst gehostete Instanzen ihn installieren, und jede Instanz kann die API direkt mit dem HTTP Request Node aufrufen.
</div>

Starte n8n nach der Installation neu. Der Node erscheint im Nodes-Panel als **EnConvert**, und jede Operation ist einzeln suchbar: Auch die Eingabe von „docx", „screenshot" oder „crawl" bringt ihn zum Vorschein.

---

## EnConvert-Credential anlegen

1. Erzeuge im [Dashboard](/de/dashboard/api-keys) einen **privaten** API-Key. Private Keys beginnen mit `sk_`.
2. Öffne den Node in n8n, klicke auf **Create new credential** und wähle **EnConvert API**.
3. Füge den Key ein, klicke auf **Save** und danach auf **Test**.

Der Credential-Test ruft `GET /v1/whoami` auf, und dieser Endpunkt akzeptiert nur private Keys. Ein öffentlicher `pk_`-Key scheitert damit genau hier, in dem Moment, in dem du ihn einfügst, statt später mitten in einem Workflow-Lauf mit einer verwirrenden Meldung.

| Feld | Erforderlich | Standard | Zweck |
|-------|----------|---------|---------|
| API Key | Ja | -- | Dein privater Key (`sk_...`) |
| Base URL | Nein | `https://api.enconvert.com` | Ändere das nur, wenn du einen abweichenden Endpunkt genannt bekommen hast |

<div class="alert alert-warning">
<strong>Öffentliche Keys funktionieren nicht.</strong> Keys, die mit <code>pk_</code> beginnen, sind für Browser-Widgets gedacht und werden von jeder Operation in diesem Node abgelehnt. Mehr dazu unter <a href="/de/docs/private-keys">Private Keys</a>.
</div>

---

## Operationen

### File

| Operation | Was sie macht |
|-----------|--------------|
| **Convert to PDF** | Macht aus einem Dokument, einer Tabelle, einer Präsentation, einer Webseite, einem Bild oder einer Textdatei ein PDF. Seitengröße, Ausrichtung, Ränder, Skalierung, Graustufen, Kopf- und Fußzeile gelten für HTML, Markdown, Text, EPUB, Bilder und SVG. Office-Dateien bringen ihr eigenes Seitenlayout mit, deshalb wirkt bei ihnen nur Grayscale, und der Node meldet, welche Einstellungen er übersprungen hat, statt den Lauf abzubrechen. |
| **Convert to Markdown** | Macht aus Word-, PowerPoint-, Excel-, PDF-, EPUB-, RTF-, HTML- und Textdateien Markdown. Gibt den Text standardmäßig im item zurück, sodass er direkt in einen AI-Node fließt. Basiert auf [Anything to Markdown](/de/docs/anything-to-markdown). |
| **Convert Data** | Konvertiert zwischen JSON, CSV, XML, YAML, TOML und HTML. Bei der Konvertierung nach JSON bekommst du unter `data` ein geparstes Objekt, bereit für Ausdrücke wie `{{ $json.data.total }}`. |
| **Split Into Chunks** | Lädt die Datei jedes Input-items als einen einzigen Job hoch und gibt überlappende Passagen zurück, die sich direkt einbetten lassen. Bis zu 200 Dateien pro Lauf. |

### Image

| Operation | Was sie macht |
|-----------|--------------|
| **Convert Format** | Konvertiert zwischen JPEG, PNG, WebP, HEIC und SVG und rastert eine PDF-Seite nach JPEG. Width und Height legen die Zeichenfläche fest, wenn die Eingabe ein SVG ist. |
| **Compress** | Verkleinert ein PNG, JPEG oder WebP in Richtung einer Zielgröße in KB. Das Format ändert sich nie. Das Ziel ist Best Effort: Ein Budget, das sich nicht erreichen lässt, liefert die kleinste erzielte Datei statt eines Fehlers, prüfe also die zurückgegebene Größe. |

### Web Page

| Operation | Was sie macht |
|-----------|--------------|
| **Scrape** | Rendert eine Seite und gibt Markdown, bereinigtes HTML, rohes HTML, Links, Bilder und strukturierte Daten im item zurück, dazu Screenshots und PDFs als binary. Ergebnisse werden rund eine Stunde lang gecacht, und ein Cache-Treffer kostet nichts. Basiert auf [Perceive](/de/docs/v2-perceive). |
| **Scrape Many** | Rendert bis zu 1000 Seiten in einem Lauf. Das URLs-Feld akzeptiert eine Liste, die du eintippst, oder einen Ausdruck, der ein Array liefert, und schließt damit direkt an **Website > Map** an. Setzt du Output Mode auf eine einzelne ZIP-Datei mit der PDF-Ausgabe, archivierst du einen ganzen Satz Seiten in einem Rutsch. |
| **Extract** | Holt benannte Felder aus einer oder aus vielen Seiten. Beschreibe in normaler Sprache, was du brauchst, liste die Felder namentlich auf, oder übergib ein JSON Schema. Optionale CSS-Selektoren beantworten vorab alles, was sie können, bevor der Rest an die AI-Extraktion durchfällt. Das senkt die Kosten auf Seiten mit festem Layout. Basiert auf [Distill](/de/docs/v2-distill). |

### Website

| Operation | Was sie macht |
|-----------|--------------|
| **Map** | Listet die Adressen einer Site auf, ohne eine davon zu rendern. Das ist schnell und verbraucht nichts von deinem Seitenkontingent. Basiert auf [Discover](/de/docs/v2-discover). |
| **Crawl** | Liest eine ganze Site und gibt Passagen zurück, die sich direkt einbetten lassen, jede mit ihrer Quell-URL, ihrem Titel und ihrem Überschriftenpfad. Läuft per Design ohne Cookies und ohne Anmeldung. Basiert auf [Ingest](/de/docs/v2-ingest). |

### Search

| Operation | Was sie macht |
|-----------|--------------|
| **Search** | Durchsucht Web, News, Bilder, Scholar, Patente oder Maps und gibt ein item pro Treffer zurück. Scrape Top Results rendert zusätzlich die ersten Treffer und hängt deren Markdown an, sodass ein einziger Lauf dir die Trefferliste und die Seiteninhalte zusammen liefert. Basiert auf [Lookup](/de/docs/v2-lookup). |

### Job

| Operation | Was sie macht |
|-----------|--------------|
| **Get** | Schlägt jeden EnConvert-Job anhand seiner ID nach. Der Node wählt den passenden Endpunkt anhand des Präfixes, sodass Scrape- (`per_`), Multi-Page-Scrape- (`batch_`), Crawl- (`ing_`) und Dateikonvertierungs-IDs alle im selben Feld funktionieren. |
| **Get Many** | Listet deine letzten Crawl-Jobs auf, mit Return All oder einem Limit. |
| **Cancel** | Stoppt einen laufenden Crawl oder Multi-Page-Scrape. |
| **Retry Webhook** | Sendet den Abschluss-Webhook eines fertigen Crawls erneut. |

---

## Die Form der Ergebnisse wählen

Jede File- und Image-Operation bietet unter **Response Format** drei Formen an:

| Wert | Was auf dem item landet |
|-------|------------------------|
| **File** | Die konvertierte Datei als n8n binary, bereit für Gmail, Drive, S3 oder Write to Disk |
| **Text** | Der Inhalt als Text unter `text`. Bei der Konvertierung nach JSON kommt stattdessen ein geparstes Objekt unter `data` |
| **URL Only** | Nur ein Download-Link unter `downloadUrl`, ohne dass Daten übertragen werden |

Convert to PDF und die beiden Image-Operationen stehen standardmäßig auf **File**. Convert to Markdown und Convert Data stehen standardmäßig auf **Text**, denn ein Markdown-String oder ein geparstes Objekt ist fast immer genau das, was der nächste Node im Workflow braucht.

<div class="alert alert-warning">
<strong>Nutze ab 16 MB URL Only.</strong> Die maximale item-Größe von n8n liegt standardmäßig bei 16 MB und lässt sich auf n8n Cloud nicht anpassen. Eine große Konvertierung scheitert also, sobald der Node die Bytes selbst transportieren will. URL Only umgeht das. Download-Links bleiben 15 Minuten gültig.
</div>

---

## Operationen, die als Job laufen

**Scrape Many**, **Crawl** und **Split Into Chunks** stoßen Arbeit an, die Minuten dauern kann. Standardmäßig wartet der Node und übergibt dir das fertige Ergebnis. Drei Einstellungen unter **Options** steuern das:

| Option | Standard | Was sie macht |
|--------|---------|--------------|
| Wait for Completion | An | Ausschalten, um sofort die Job-ID zu erhalten und woanders weiterzuarbeiten |
| Max Wait Time (Seconds) | 120 | Wie lange gewartet wird, bevor das Warten aufgegeben wird |
| Poll Interval (Seconds) | 3 | Wie oft geprüft wird |

Läuft die Wartezeit ab, ist die Arbeit nicht verloren. Der Fehler nennt die Job-ID, und **Job > Get** holt das fertige Ergebnis, wann immer du darauf zurückkommst.

<div class="alert alert-info">
<strong>Halte Max Wait Time auf n8n Cloud unter 300 Sekunden.</strong> Cloud kann eine Execution an diesem Punkt abbrechen, unabhängig von der Einstellung im Node. Setze für einen Crawl über mehrere hundert Seiten eine Webhook URL, schalte Wait for Completion aus, richte den Webhook auf einen n8n Webhook Node, und führe den Workflow dort weiter, sobald EnConvert zurückruft.
</div>

---

## Unterstützte Formate

**Convert to PDF** akzeptiert `bmp` `csv` `doc` `docx` `epub` `gif` `heic` `heif` `htm` `html` `jpeg` `jpg` `markdown` `md` `mdown` `mkd` `numbers` `odp` `ods` `odt` `ots` `pages` `pdf` `png` `ppt` `pptx` `rtf` `svg` `text` `tif` `tiff` `txt` `webp` `xhtml` `xls` `xlsx`.

**Convert to Markdown** akzeptiert `csv` `doc` `docx` `epub` `htm` `html` `markdown` `md` `mdown` `mkd` `odp` `ods` `odt` `pdf` `ppt` `pptx` `rtf` `text` `txt` `xhtml` `xls` `xlsx`.

**Convert Data** deckt JSON von und nach XML, YAML, TOML und CSV ab, dazu CSV von und nach XML sowie Markdown nach HTML.

**Convert Format** deckt JPEG, PNG, WebP, HEIC und SVG in jeder Kombination ab, dazu PDF nach JPEG. Width und Height gelten nur, wenn die Eingabe ein SVG ist, akzeptieren jeweils 1 bis 10000, und ihr Produkt darf 25 Millionen nicht überschreiten.

**Compress** akzeptiert `png` `jpg` `jpeg` `webp`.

Der Node prüft die Formatkombination, bevor er irgendetwas sendet. Fragst du nach einer Kombination, die es nicht gibt, sagt er dir das direkt im Editor und nennt dazu die Formate, in die sich diese Datei tatsächlich konvertieren lässt. Als Bild eingescannte Seiten ohne Textebene werden nicht gelesen, denn der Node führt kein OCR durch.

---

## Beispiel-Workflows

### Word-Dokument zu einer AI-Zusammenfassung

```text
Google Drive (Download)  ->  EnConvert                       ->  Basic LLM Chain
                             File · Convert to Markdown
                             Response Format: Text
```

Das Markdown kommt unter `{{ $json.text }}` an. Das ist der Weg, den `Extract From File` nicht gehen kann, weil dieser Node `.docx` nicht liest.

### HTML-Rechnung als PDF-Anhang

```text
Set (build the HTML)  ->  Convert to File   ->  EnConvert                 ->  Gmail (Send)
                          (Text to File)       File · Convert to PDF
                                               PDF Options: A4, margins
```

### Website in einen Vector Store

```text
EnConvert                     ->  Embeddings  ->  Pinecone
Website · Crawl
Mode: Sitemap, Max Pages: 200
Output: Chunks
```

Jedes item trägt `content`, `sourceUrl`, `title`, `headingsPath`, `wordCount` und `chunkIndex`, also exakt die Form, die ein Default Data Loader und ein Vector-Store-Node erwarten. Ein einziger Node ersetzt die sonst übliche Pipeline aus Crawl, Chunking, Loop und Code.

### Wettbewerber-Preise in eine Tabelle

```text
EnConvert         ->  EnConvert                          ->  Google Sheets
Website · Map         Web Page · Extract
Mode: Sitemap         Source: Specific URLs
                      Define Fields By: Description
                      "the plan name and the monthly price"
```

Map ist hier der günstige erste Schritt. Es listet die Adressen der Site auf, ohne sie zu rendern, sodass du Seitenkontingent nur für die Seiten ausgibst, die dich wirklich interessieren.

### Täglicher Screenshot in Slack

```text
Schedule Trigger  ->  EnConvert            ->  Slack (Upload file)
                      Web Page · Scrape
                      Outputs: Screenshot
```

Das PNG kommt als binary unter `screenshot` an. Ein zweiter Node zum Abholen ist nicht nötig.

---

## Den Node als AI-Agent-Tool nutzen

Jede Operation steht dem AI Agent Node von n8n als Tool zur Verfügung. Die Web-Operationen passen am besten zu einem Agenten, denn ein Agent kann eine URL oder eine Suchanfrage liefern, hat aber keine Möglichkeit, eine Datei zu übergeben.

Die vier, die sich für einen Agenten lohnen, sind **Web Page > Scrape**, **Search > Search**, **Web Page > Extract** und **Website > Map**. Zusammen erlauben sie einem Agenten, Seiten zu finden, sie als Markdown zu lesen und strukturierte Fakten daraus zu ziehen. Genau diese Schleife brauchen die meisten Recherche- und Lead-Generation-Agenten.

---

## Fehlerbehebung

**Der Node erscheint nach der Installation nicht.**
Starte n8n neu. Community Nodes werden beim Start geladen. Prüfe auf n8n Cloud, ob das Paket überhaupt installiert wurde, denn Cloud akzeptiert nur verifizierte Nodes.

**`EnConvert rejected the API key`.**
Der Key ist falsch, oder es ist ein öffentlicher `pk_`-Key. Öffne die Credential und führe **Test** aus. Erzeuge im [Dashboard](/de/dashboard/api-keys) einen privaten Key.

**`This operation is not included in your EnConvert plan`.**
Scrape, Extract, Search, Map und Crawl sind tarifgebunden, und jede Operation hat ein monatliches Kontingent. Ein erneuter Versuch hilft nicht. Prüfe deine Nutzung und deinen Tarif auf der [Preisseite](/de/pricing).

**`Could not tell what kind of file is in "data"`.**
Die eingehende Datei hat keine Endung im Namen, was bei Downloads über den HTTP Request Node regelmäßig passiert. Setze unter Options das Feld **Input File Format**, um festzulegen, worum es sich handelt, zum Beispiel `docx`.

**`This operation expects the node's input data to contain a binary file`.**
Der vorherige Node hat keine Datei ausgegeben, oder er hat einen anderen Feldnamen verwendet. Prüfe **Input Binary Field**, das bei den meisten n8n-Nodes `data` heißt.

**Eine große Konvertierung schlägt innerhalb von n8n fehl.**
Stelle Response Format auf URL Only um. n8n-items sind standardmäßig auf 16 MB begrenzt, und auf Cloud ist dieses Limit fest.

**Ein Crawl läuft in ein Timeout.**
Erhöhe Max Wait Time, oder schalte Wait for Completion aus und hole das Ergebnis später mit **Job > Get** über die Job-ID aus der Fehlermeldung.

---

## Quellen und Links

- **npm**: [@enconvert/n8n-nodes-enconvert](https://www.npmjs.com/package/@enconvert/n8n-nodes-enconvert)
- **GitHub**: [enconvert/n8n-nodes-enconvert](https://github.com/enconvert/n8n-nodes-enconvert)
- **Lizenz**: MIT
- **n8n Community Nodes**: [docs.n8n.io](https://docs.n8n.io/integrations/community-nodes/)
- **Zugrunde liegende API**: [Einführung](/de/docs/introduction)

---

## Häufig gestellte Fragen

### Wie konvertiere ich in n8n eine DOCX-Datei zu PDF?

Füge den EnConvert-Node hinzu, wähle die Ressource **File** und die Operation **Convert to PDF**, und richte **Input Binary Field** auf das Feld mit der Datei, das bei den meisten Nodes `data` heißt. Das PDF kommt als binary auf demselben item zurück, bereit zum Anhängen an eine E-Mail oder zum Hochladen in einen Speicher. Word-Dateien bringen ihr eigenes Seitenlayout mit, deshalb gelten Seitengröße und Ränder für sie nicht, und der Node sagt dir, welche Einstellungen er übersprungen hat.

### Wie extrahiere ich in n8n Text aus einem Word-Dokument?

Nutze **File > Convert to Markdown** mit Response Format auf Text. Der Text landet unter `{{ $json.text }}`. Der eingebaute `Extract From File` Node von n8n kann das nicht, denn er liest CSV, HTML, JSON, ICS, ODS, PDF-Text, RTF, TXT, XLS und XLSX, aber weder `.doc` noch `.docx` oder `.pptx`.

### Kann ich diesen Node auf n8n Cloud nutzen?

n8n Cloud installiert nur Community Nodes, die n8ns Verifizierungsprüfung bestanden haben. Bis dieser Node die Prüfung abgeschlossen hat, installierst du ihn auf einer selbst gehosteten Instanz, oder du rufst die API direkt über den HTTP Request Node auf, was in jedem Tarif funktioniert. Dabei ist gerade Cloud der Ort, an dem sich der Node bezahlt macht, denn Cloud-Nutzer können weder Systemtools noch npm-Pakete installieren, um Dateien lokal zu konvertieren.

### Wie scrape ich in n8n eine Webseite zu Markdown?

Nutze **Web Page > Scrape** und wähle unter Outputs Markdown. Das Markdown kommt unter `{{ $json.markdown }}` an. Markdown ist rund sechsmal kleiner als das rohe HTML derselben Seite. Das senkt die Token-Kosten jedes nachgelagerten AI-Nodes und gibt dem Modell deutlich weniger Boilerplate, an dem es sich verheddern kann.

### Wie erstelle ich in n8n einen Screenshot einer Website?

Nutze **Web Page > Scrape** und wähle unter Outputs Screenshot oder Full-Page Screenshot. Das PNG kommt als n8n binary unter `screenshot` an, du kannst es also sofort zu Slack hochladen oder an eine E-Mail anhängen. Die meisten Scraping-Nodes liefern stattdessen einen Link und zwingen dich damit, einen HTTP Request Node einzubauen, der das Bild erst noch holt.

### Wie lade ich mit n8n eine komplette Website in einen Vector Store?

Nutze **Website > Crawl** mit Output auf Chunks. Der Node gibt ein item pro Passage zurück, jedes mit `content`, `sourceUrl`, `title`, `headingsPath` und `chunkIndex`, und genau das passt direkt in einen Default Data Loader, einen Embeddings-Node und einen Vector Store wie Pinecone, Qdrant oder Supabase. Es ersetzt die sonst übliche Pipeline aus Sitemap-Crawl, Scraper, Code-Node und Loop.

### Warum liefert meine Konvertierung einen Link statt der Datei?

Response Format steht auf URL Only. Stelle es auf File um, um n8n binary zu erhalten. Der umgekehrte Fall ist genauso nützlich: Ergebnisse über 16 MB können auf Cloud nicht in einem n8n-item reisen, für große Dateien ist URL Only also der richtige Weg. Download-Links bleiben 15 Minuten gültig.

### Was passiert, wenn ein Crawl länger dauert als die Wartezeit?

Der Job läuft bei EnConvert weiter. Der Node wirft einen Fehler, der die Job-ID enthält, und **Job > Get** holt das fertige Ergebnis später ab. Setze bei langen Crawls eine Webhook URL, schalte Wait for Completion aus, und lass EnConvert einen n8n Webhook Node aufrufen, sobald der Crawl fertig ist.

### Funktioniert der Node mit dem AI Agent Node von n8n?

Ja, jede Operation wird als Agent-Tool bereitgestellt. Die Web-Operationen passen am besten zu einem Agenten, denn ein Agent kann eine URL oder eine Suchanfrage übergeben, aber keine Datei. Scrape, Search, Extract und Map sind die vier, die einen Agenten für Recherche und Lead-Generierung wirklich nützlich machen.
