Konvertierungsmatrix#

Alle 51 Konvertierungs-Endpunkte an einem Ort: was jeder entgegennimmt, was er zurückgibt und wo seine Referenzseite liegt. Suchen Sie Ihre Eingabe in der linken Spalte, kopieren Sie den Pfad aus der Mitte und klicken Sie sich für Parameter und Codebeispiele durch. Ein Paar, das nicht in diesen Tabellen steht, wird nicht unterstützt.

Zwei Endpunkte akzeptieren viele Eingaben auf einmal. anything-to-pdf nimmt 36 Dateiendungen entgegen und liefert immer ein PDF; anything-to-markdown nimmt 22 entgegen und liefert immer eine einzelne UTF-8-.md-Datei. Beide sind unten einmal in der Tabelle „Dokumente“ aufgeführt, statt für jeden Eingabetyp wiederholt zu werden, den sie abdecken.

Webseiten#

Fünf Endpunkte, die eine Live-URL in einem echten Browser rendern. Sie nehmen einen JSON-Body entgegen, keinen Datei-Upload.

Eingabe Ausgabe Endpunkt Doku
URL PDF POST /v1/convert/url-to-pdf url-to-pdf
URL PNG-Screenshot POST /v1/convert/url-to-screenshot url-to-screenshot
URL Markdown POST /v1/convert/url-to-markdown url-to-markdown
Website (gecrawlt oder aus sitemap.xml) ZIP mit PDFs POST /v1/convert/website-to-pdf website-to-pdf
Website (gecrawlt oder aus sitemap.xml) ZIP mit PNGs POST /v1/convert/website-to-screenshot website-to-screenshot

Die drei url-to-*-Endpunkte akzeptieren einen einzelnen URL-String oder eine Liste und laufen bei einer URL synchron. Die beiden website-to-*-Endpunkte ermitteln die Seiten selbst und arbeiten ausschließlich asynchron: Sie antworten immer mit 202, einer batch_id und einem output_format von zip. Screenshots sind PNG; eine JPEG-Screenshot-Option gibt es nicht.

Dokumente#

Dreizehn Endpunkte, jeder ein multipart/form-data-Upload mit dem Dokument im Feld file.

Eingabe Ausgabe Endpunkt Doku
36 Dateitypen (Office, iWork, OpenDocument, RTF, CSV, HTML, Markdown, Text, EPUB, Bilder, SVG, PDF) PDF POST /v1/convert/anything-to-pdf anything-to-pdf
22 Dateitypen (PDF, Office, OpenDocument, RTF, CSV, HTML, Markdown, Text, EPUB) Markdown POST /v1/convert/anything-to-markdown anything-to-markdown
HTML (.html, .htm) PDF POST /v1/convert/html-to-pdf html-to-pdf
Markdown (.md, .markdown) PDF POST /v1/convert/markdown-to-pdf markdown-to-pdf
Word (.doc, .docx) PDF POST /v1/convert/doc-to-pdf doc-to-pdf
Excel (.xls, .xlsx) PDF POST /v1/convert/excel-to-pdf excel-to-pdf
PowerPoint (.ppt, .pptx) PDF POST /v1/convert/ppt-to-pdf ppt-to-pdf
Apple Pages (.pages) PDF POST /v1/convert/pages-to-pdf pages-to-pdf
Apple Numbers (.numbers) PDF POST /v1/convert/numbers-to-pdf numbers-to-pdf
OpenDocument Text (.odt) PDF POST /v1/convert/odt-to-pdf odt-to-pdf
OpenDocument Spreadsheet (.ods) PDF POST /v1/convert/ods-to-pdf ods-to-pdf
OpenDocument Presentation (.odp) PDF POST /v1/convert/odp-to-pdf odp-to-pdf
OpenDocument Spreadsheet Template (.ots) PDF POST /v1/convert/ots-to-pdf ots-to-pdf

Die Engine unterscheidet sich je nach Eingabe, und das ändert, was pdf_options akzeptiert. HTML und Markdown laufen über WeasyPrint und unterstützen Seitengröße, Ausrichtung, Ränder sowie Kopf- und Fußzeilen. Die neun auf LibreOffice basierenden Endpunkte (doc, excel, ppt, odt, ods, odp, ots, pages, numbers) übernehmen die Seitengeometrie aus dem Quelldokument und berücksichtigen daher nur grayscale; setzt du eine Geometrie-Option explizit, liefern sie 400.

Datenformate#

Elf Endpunkte, allesamt synchrone multipart/form-data-Uploads. Die Dateiendung der gesendeten Datei muss zu dem Endpunkt passen, an den Sie sie senden.

Eingabe Ausgabe Endpunkt Doku
JSON (.json) XML POST /v1/convert/json-to-xml json-to-xml
XML (.xml) JSON POST /v1/convert/xml-to-json xml-to-json
JSON (.json) YAML POST /v1/convert/json-to-yaml json-to-yaml
YAML (.yaml, .yml) JSON POST /v1/convert/yaml-to-json yaml-to-json
JSON (.json) CSV POST /v1/convert/json-to-csv json-to-csv
CSV (.csv) JSON POST /v1/convert/csv-to-json csv-to-json
JSON (.json) TOML POST /v1/convert/json-to-toml json-to-toml
TOML (.toml) JSON POST /v1/convert/toml-to-json toml-to-json
CSV (.csv) XML POST /v1/convert/csv-to-xml csv-to-xml
XML (.xml) CSV POST /v1/convert/xml-to-csv xml-to-csv
Markdown (.md, .markdown) HTML POST /v1/convert/markdown-to-html markdown-to-html

Eingaben müssen UTF-8 sein. Über ein Endpunktpaar hinweg gibt es keine Round-Trip-Garantie: XML und CSV transportieren die Typinformationen von JSON nicht, JSON zu CSV und zurück liefert also Strings.

Bilder#

Zweiundzwanzig Endpunkte, allesamt multipart/form-data-Uploads. JPEG als Eingabe umfasst .jpg und .jpeg, HEIC als Eingabe umfasst .heic und .heif.

Eingabe Ausgabe Endpunkt Doku
JPEG PNG POST /v1/convert/jpeg-to-png jpeg-to-png
PNG JPEG POST /v1/convert/png-to-jpeg png-to-jpeg
JPEG SVG POST /v1/convert/jpeg-to-svg jpeg-to-svg
SVG JPEG POST /v1/convert/svg-to-jpeg svg-to-jpeg
JPEG HEIC POST /v1/convert/jpeg-to-heic jpeg-to-heic
HEIC JPEG POST /v1/convert/heic-to-jpeg heic-to-jpeg
JPEG WebP POST /v1/convert/jpeg-to-webp jpeg-to-webp
WebP JPEG POST /v1/convert/webp-to-jpeg webp-to-jpeg
PNG SVG POST /v1/convert/png-to-svg png-to-svg
SVG PNG POST /v1/convert/svg-to-png svg-to-png
PNG HEIC POST /v1/convert/png-to-heic png-to-heic
HEIC PNG POST /v1/convert/heic-to-png heic-to-png
PNG WebP POST /v1/convert/png-to-webp png-to-webp
WebP PNG POST /v1/convert/webp-to-png webp-to-png
SVG HEIC POST /v1/convert/svg-to-heic svg-to-heic
HEIC SVG POST /v1/convert/heic-to-svg heic-to-svg
SVG WebP POST /v1/convert/svg-to-webp svg-to-webp
WebP SVG POST /v1/convert/webp-to-svg webp-to-svg
HEIC WebP POST /v1/convert/heic-to-webp heic-to-webp
WebP HEIC POST /v1/convert/webp-to-heic webp-to-heic
PDF JPEG oder ein ZIP mit JPEGs POST /v1/convert/pdf-to-jpeg pdf-to-jpeg
PNG, JPEG oder WebP Dasselbe Format wie die Eingabe POST /v1/convert/compress-image compress-image

Drei Details, über die man leicht stolpert:

  • Die vier *-to-svg-Endpunkte vektorisieren nicht. Sie kodieren das Rasterbild base64 in ein SVG-<image>-Element in der Größe der ursprünglichen Pixel, was die Dateigröße um rund 33 % erhöht.
  • pdf-to-jpeg liefert bei einem einseitigen PDF ein rohes JPEG und bei einem mehrseitigen ein ZIP mit page_1.jpeg und folgenden; schreiben Sie Ihren Client also so, dass er beides verarbeitet.
  • compress-image behält das Eingabeformat bei. PNG rein, PNG raus.
Uploads sind pro Plan gedeckelt. Eine Datei über der Obergrenze deines Plans liefert 413, bevor überhaupt Konvertierungsarbeit beginnt. Die Größen pro Plan stehen unter Rate-Limits und Kontingente.

Hier nicht aufgeführt?#

Zwei Stellen, an denen Sie als Nächstes nachsehen können.

Unterstützte Formate listet die reinen Dateiendungen statt der Paare, einschließlich aller 36 Eingaben, die anything-to-pdf akzeptiert, und aller 22, die anything-to-markdown akzeptiert.

Perceive ist der Endpunkt, um eine Seite zu lesen, statt sie zu konvertieren. Ein einziger Render-Durchlauf einer URL liefert Markdown, bereinigtes HTML, einen Screenshot, ein PDF, das Link- und Bild-Inventar sowie strukturierte Daten auf einmal, und das ist für einen Agenten oder eine RAG-Pipeline meist genau das, was Sie brauchen.

Manche fehlenden Paare sind in zwei Schritten oder über einen Catch-all-Endpunkt trotzdem erreichbar. Einen png-to-pdf-Endpunkt gibt es zum Beispiel nicht, aber anything-to-pdf akzeptiert .png und liefert ein einseitiges PDF. Was es überhaupt nicht gibt, sind OCR sowie Audio- und Videokonvertierung. Deshalb liefert auch ein Bild an anything-to-markdown ein 400: Es gibt keine Textebene zum Auslesen und keinen OCR-Durchlauf dahinter.