Convertitore da PDF a Markdown
Per convertire un PDF in Markdown, carica il PDF e scegli Markdown (MD). Il nostro server estrae il testo, trasforma i caratteri di dimensione maggiore in titoli #, ## e ###, riconosce gli elenchi puntati e numerati e restituisce un file .md in stile GitHub. Le tabelle del PDF non vengono ricostruite come tabelle Markdown; il loro testo arriva come paragrafi. I PDF scansionati non sono supportati perché non c'è alcun OCR.
- Gratuito, senza registrazione
- File eliminati entro 30 minuti
- Fino a 100 MB
I file vengono eliminati definitivamente dai nostri server entro 30 minuti.
Come convertire PDF in Markdown
Carica il file PDF
Trascina il file PDF nell'area di caricamento oppure selezionalo dal dispositivo (fino a 100 MB).
Mantieni Markdown come formato di destinazione
Markdown è già selezionato nel menu; se ti serve, puoi scegliere un altro formato.
Converti e scarica
Premi «Converti» e il download del file convertito parte automaticamente.
Cosa viene mantenuto?
Mantenuto
- Testo del corpo e paragrafi
- Titoli riconosciuti dalla dimensione del carattere (#, ##, ###)
- Elenchi puntati e numerati
Modificato
- Le righe che iniziano con #, -, > o 1. vengono precedute da un carattere di escape per restare letterali
Non riportato
- Struttura delle tabelle: le celle diventano paragrafi
- Caratteri, colori e layout della pagina
- Immagini di sfondo a pagina intera
Quando usarlo
Preparare documenti per LLM e pipeline RAG
Prima di dare i PDF a ChatGPT, Claude o a un sistema RAG (retrieval-augmented generation), convertirli in Markdown elimina il rumore dell'impaginazione mantenendo la gerarchia dei titoli, e questo rende molto più semplice suddividere in blocchi e citare le sezioni.
Portare i manuali in docs-as-code e nelle app per appunti
Quando migri manuali PDF su GitHub, su una wiki GitLab, su Obsidian o Notion, puoi partire da un file .md in cui titoli ed elenchi sono già marcati, invece di formattare tutto a mano.
Limiti da conoscere
- Nessun OCR per i PDF scansionati.
- Il riconoscimento dei titoli si basa sulla dimensione del carattere; i titoli in grassetto con dimensione del testo normale possono restare paragrafi.
- I PDF cifrati vengono rifiutati.
Informazioni sui formati
Che cos'è PDF?
PDF (Portable Document Format) è un formato di documento a layout fisso creato da Adobe e standardizzato come ISO 32000. Ogni testo, immagine e linea è memorizzato con la propria posizione nella pagina, quindi un PDF appare uguale su ogni dispositivo e si stampa in modo affidabile. Il rovescio della medaglia è la modifica: un PDF memorizza posizioni nella pagina, non paragrafi e tabelle. I PDF scansionati contengono solo immagini delle pagine e richiedono l'OCR (riconoscimento ottico dei caratteri) prima di poterne estrarre il testo.
Che cos'è Markdown (MD)?
Markdown è un linguaggio di markup leggero ideato da John Gruber nel 2004. La formattazione si scrive con semplici simboli all'interno del testo: # per i titoli, ** per il grassetto, - per le voci di elenco e | per le tabelle. I file Markdown (.md) sono ovunque: nei README di GitHub, nella documentazione tecnica, nelle app per appunti e negli output degli assistenti IA. La variante più diffusa è GitHub Flavored Markdown (GFM), che aggiunge tabelle, elenchi di attività e testo barrato.
Domande frequenti
Come vengono riconosciuti i titoli nel PDF?
Il convertitore confronta la dimensione del carattere di ogni blocco di testo con quella del testo del corpo. I blocchi nettamente più grandi diventano titoli #, ## o ### a seconda di quanto sono più grandi. I titoli in grassetto con la dimensione del testo normale possono restare paragrafi, cosa che puoi correggere nel file .md.
Le tabelle del PDF diventano tabelle Markdown?
No. Un PDF memorizza solo testo posizionato, non righe e celle, quindi il convertitore scrive il contenuto delle tabelle come paragrafi. Se ti servono vere tabelle Markdown e hai il documento anche in Word o DOC, converti invece quel file in Markdown, perché le tabelle dei file Word vengono mantenute.
L'output è adatto a ChatGPT e agli altri LLM?
Sì, è un utilizzo molto comune. Il Markdown è compatto e facile da interpretare per i modelli linguistici: i titoli segnano le sezioni e i simboli di elenco segnano le voci. Carica il file .md o incolla il suo contenuto. Ricorda solo che i PDF scansionati non producono testo, perché non viene eseguito alcun OCR.
La conversione da PDF a Markdown è gratuita?
Sì, è completamente gratuita. Non servono account, abbonamenti e non viene applicata alcuna filigrana: basta caricare il file e convertirlo.
Il mio file è al sicuro e quando viene eliminato?
Il file viene trasferito tramite HTTPS e archiviato sul nostro server con un codice casuale. Il file caricato e il risultato vengono eliminati definitivamente entro 30 minuti, e il link di download funziona solo per chi possiede il tuo codice univoco.