Matrice di Conversione#

Tutti i 51 endpoint di conversione in un unico posto: cosa accetta ciascuno, cosa restituisce e dove si trova la sua pagina di riferimento. Trova il tuo input nella colonna di sinistra, copia il percorso da quella centrale, clicca per parametri ed esempi di codice. Una coppia che non compare in queste tabelle non è supportata.

Due endpoint accettano molti input diversi. anything-to-pdf accetta 36 estensioni di file e restituisce sempre un PDF; anything-to-markdown ne accetta 22 e restituisce sempre un unico file .md in UTF-8. Entrambi compaiono una sola volta nella tabella Documenti qui sotto, invece di essere ripetuti per ogni tipo di input che coprono.

Pagine Web#

Cinque endpoint che renderizzano un URL live in un browser reale. Accettano un corpo JSON, non un caricamento di file.

Input Output Endpoint Documentazione
URL PDF POST /v1/convert/url-to-pdf url-to-pdf
URL Screenshot PNG POST /v1/convert/url-to-screenshot url-to-screenshot
URL Markdown POST /v1/convert/url-to-markdown url-to-markdown
Sito web (scansionato o da sitemap.xml) ZIP di PDF POST /v1/convert/website-to-pdf website-to-pdf
Sito web (scansionato o da sitemap.xml) ZIP di PNG POST /v1/convert/website-to-screenshot website-to-screenshot

I tre endpoint url-to-* accettano una singola stringa URL o un elenco, e con un solo URL vengono eseguiti in modo sincrono. I due endpoint website-to-* individuano le pagine da soli e sono esclusivamente asincroni: rispondono sempre 202 con un batch_id e un output_format pari a zip. Gli screenshot sono PNG; non esiste un'opzione di screenshot JPEG.

Documenti#

Tredici endpoint, ciascuno un caricamento multipart/form-data con il documento nel campo file.

Input Output Endpoint Documentazione
36 tipi di file (Office, iWork, OpenDocument, RTF, CSV, HTML, Markdown, testo, EPUB, immagini, SVG, PDF) PDF POST /v1/convert/anything-to-pdf anything-to-pdf
22 tipi di file (PDF, Office, OpenDocument, RTF, CSV, HTML, Markdown, testo, EPUB) Markdown POST /v1/convert/anything-to-markdown anything-to-markdown
HTML (.html, .htm) PDF POST /v1/convert/html-to-pdf html-to-pdf
Markdown (.md, .markdown) PDF POST /v1/convert/markdown-to-pdf markdown-to-pdf
Word (.doc, .docx) PDF POST /v1/convert/doc-to-pdf doc-to-pdf
Excel (.xls, .xlsx) PDF POST /v1/convert/excel-to-pdf excel-to-pdf
PowerPoint (.ppt, .pptx) PDF POST /v1/convert/ppt-to-pdf ppt-to-pdf
Apple Pages (.pages) PDF POST /v1/convert/pages-to-pdf pages-to-pdf
Apple Numbers (.numbers) PDF POST /v1/convert/numbers-to-pdf numbers-to-pdf
OpenDocument Text (.odt) PDF POST /v1/convert/odt-to-pdf odt-to-pdf
OpenDocument Spreadsheet (.ods) PDF POST /v1/convert/ods-to-pdf ods-to-pdf
OpenDocument Presentation (.odp) PDF POST /v1/convert/odp-to-pdf odp-to-pdf
OpenDocument Spreadsheet Template (.ots) PDF POST /v1/convert/ots-to-pdf ots-to-pdf

Il motore cambia a seconda dell'input, e questo cambia ciò che pdf_options accetta. HTML e Markdown passano da WeasyPrint e supportano dimensioni pagina, orientamento, margini, intestazioni e piè di pagina. I nove endpoint basati su LibreOffice (doc, excel, ppt, odt, ods, odp, ots, pages, numbers) prendono la geometria di pagina dal documento sorgente, quindi rispettano solo grayscale e restituiscono 400 se imposti esplicitamente un'opzione di geometria.

Formati Dati#

Undici endpoint, tutti caricamenti multipart/form-data sincroni. L'estensione del file che invii deve corrispondere all'endpoint a cui lo invii.

Input Output Endpoint Documentazione
JSON (.json) XML POST /v1/convert/json-to-xml json-to-xml
XML (.xml) JSON POST /v1/convert/xml-to-json xml-to-json
JSON (.json) YAML POST /v1/convert/json-to-yaml json-to-yaml
YAML (.yaml, .yml) JSON POST /v1/convert/yaml-to-json yaml-to-json
JSON (.json) CSV POST /v1/convert/json-to-csv json-to-csv
CSV (.csv) JSON POST /v1/convert/csv-to-json csv-to-json
JSON (.json) TOML POST /v1/convert/json-to-toml json-to-toml
TOML (.toml) JSON POST /v1/convert/toml-to-json toml-to-json
CSV (.csv) XML POST /v1/convert/csv-to-xml csv-to-xml
XML (.xml) CSV POST /v1/convert/xml-to-csv xml-to-csv
Markdown (.md, .markdown) HTML POST /v1/convert/markdown-to-html markdown-to-html

Gli input devono essere in UTF-8. Non c'è alcuna garanzia di round-trip tra una coppia di endpoint: XML e CSV non trasportano le informazioni di tipo di JSON, quindi da JSON a CSV e ritorno si ottengono stringhe.

Immagini#

Ventidue endpoint, tutti caricamenti multipart/form-data. L'input JPEG copre .jpg e .jpeg, mentre l'input HEIC copre .heic e .heif.

Input Output Endpoint Documentazione
JPEG PNG POST /v1/convert/jpeg-to-png jpeg-to-png
PNG JPEG POST /v1/convert/png-to-jpeg png-to-jpeg
JPEG SVG POST /v1/convert/jpeg-to-svg jpeg-to-svg
SVG JPEG POST /v1/convert/svg-to-jpeg svg-to-jpeg
JPEG HEIC POST /v1/convert/jpeg-to-heic jpeg-to-heic
HEIC JPEG POST /v1/convert/heic-to-jpeg heic-to-jpeg
JPEG WebP POST /v1/convert/jpeg-to-webp jpeg-to-webp
WebP JPEG POST /v1/convert/webp-to-jpeg webp-to-jpeg
PNG SVG POST /v1/convert/png-to-svg png-to-svg
SVG PNG POST /v1/convert/svg-to-png svg-to-png
PNG HEIC POST /v1/convert/png-to-heic png-to-heic
HEIC PNG POST /v1/convert/heic-to-png heic-to-png
PNG WebP POST /v1/convert/png-to-webp png-to-webp
WebP PNG POST /v1/convert/webp-to-png webp-to-png
SVG HEIC POST /v1/convert/svg-to-heic svg-to-heic
HEIC SVG POST /v1/convert/heic-to-svg heic-to-svg
SVG WebP POST /v1/convert/svg-to-webp svg-to-webp
WebP SVG POST /v1/convert/webp-to-svg webp-to-svg
HEIC WebP POST /v1/convert/heic-to-webp heic-to-webp
WebP HEIC POST /v1/convert/webp-to-heic webp-to-heic
PDF JPEG, oppure uno ZIP di JPEG POST /v1/convert/pdf-to-jpeg pdf-to-jpeg
PNG, JPEG o WebP Lo stesso formato dell'input POST /v1/convert/compress-image compress-image

Tre dettagli su cui si inciampa spesso:

  • I quattro endpoint *-to-svg non vettorizzano. Codificano in base64 l'immagine raster dentro un elemento SVG <image> dimensionato sui pixel originali, il che aggiunge circa il 33% alla dimensione del file.
  • pdf-to-jpeg restituisce un JPEG grezzo per un PDF a pagina singola e uno ZIP con page_1.jpeg e successivi per un PDF multipagina, quindi scrivi il client in modo che gestisca entrambi i casi.
  • compress-image mantiene il formato di input. PNG in ingresso, PNG in uscita.
I caricamenti hanno un limite per piano. Un file oltre il tetto massimo del tuo piano restituisce 413 prima che inizi qualsiasi lavoro di conversione. Le dimensioni per ciascun piano sono su Rate limit e quote.

Non lo trovi qui?#

Due posti dove cercare.

Formati supportati riporta gli elenchi grezzi delle estensioni invece delle coppie, inclusi tutti i 36 input accettati da anything-to-pdf e tutti i 22 accettati da anything-to-markdown.

Perceive è l'endpoint per leggere una pagina invece di convertirla. Un singolo render di un URL restituisce insieme Markdown, HTML ripulito, uno screenshot, un PDF, l'inventario di link e immagini e i dati strutturati: di solito è quello che serve per un agente o una pipeline RAG.

Alcune coppie mancanti restano comunque raggiungibili in due passaggi o tramite un endpoint generico. Non esiste un endpoint png-to-pdf, per esempio, ma anything-to-pdf accetta .png e restituisce un PDF a pagina singola. Quello che non esiste affatto è l'OCR e la conversione di audio e video. È anche il motivo per cui inviare un'immagine a anything-to-markdown restituisce 400: non c'è nessun livello di testo da leggere e nessun passaggio OCR dietro.