Converti PDF in Markdown
Trasforma qualsiasi PDF in Markdown pulito e strutturato: titoli, tabelle, elenchi e link vengono conservati.
Rilascia qui i file PDF
Rilascia per aggiungere i file
Un analizzatore di PDF, non uno scarico di testo
La maggior parte degli strumenti «PDF in testo» restituisce un muro di righe nell'ordine in cui il file le ha memorizzate per caso. Questo ricostruisce il documento: quali righe erano un titolo, quale blocco era una tabella, quale colonna viene prima e dove un'interruzione di pagina ha spezzato un paragrafo a metà.
Estrazione di testo semplice
Risultati trimestrali I ricavi sono cresciuti del 18 % su base annua. La tabella Regione T3 T4 EMEA 4,1 4,8 APAC 2,7 3,9 qui sotto dettaglia i risultati per regione.
Questo convertitore
## Risultati trimestrali I ricavi sono cresciuti del 18 % su base annua. La tabella qui sotto dettaglia i risultati per regione. | Regione | T3 | T4 | |---------|-----|-----| | EMEA | 4,1 | 4,8 | | APAC | 2,7 | 3,9 |
Lo stesso PDF. La differenza è la struttura: un livello di titolo, una tabella vera e un paragrafo ricomposto attorno al blocco che lo interrompeva.
Che cosa sopravvive alla conversione
La struttura viene ricavata dalla geometria del layout, non indovinata dalla punteggiatura.
Titoli ed elenchi
I livelli dei titoli derivano dalla dimensione e dal peso relativi del carattere, così un H2 resta un H2 anziché diventare un altro paragrafo. Gli elenchi numerati e puntati mantengono l'annidamento, e i tratti in grassetto, corsivo e a spaziatura fissa passano come enfasi e codice in linea di Markdown.
Tabelle, con o senza righe
Le tabelle con bordi vengono riconosciute dalle loro righe. Quelle senza bordi — in realtà semplici colonne di testo allineate — si individuano raggruppando le posizioni delle celle: è proprio qui che la maggior parte dei convertitori si arrende e produce un guazzabuglio di frammenti separati da tabulazioni.
Ordine di lettura su più colonne
Una pagina a due colonne memorizza il testo in un unico flusso che zigzaga tra le colonne. Letto in modo ingenuo, una riga su due proviene dal punto sbagliato. I confini delle colonne vengono rilevati per primi, così ogni colonna è letta dall'alto in basso prima che inizi la successiva.
Link e ricucitura delle interruzioni di pagina
Le annotazioni dei collegamenti ipertestuali diventano veri link Markdown invece di essere appiattite in testo nudo. I paragrafi divisi da un confine di pagina — con intestazione, piè di pagina e numero di pagina incastrati nel mezzo — vengono ricuciti in un unico paragrafo.
Conversione in blocco
Invia un'intera cartella di PDF come un solo processo e ricevi uno ZIP con ogni file .md più un manifest CONVERSION_REPORT.md che registra che cosa è successo a ciascuno. Disponibile nei piani con la conversione in blocco attiva.
Riservato per impostazione predefinita
I file vengono caricati via TLS, elaborati ed eliminati automaticamente allo scadere del periodo di conservazione del tuo piano. Le anteprime delle pagine sono generate localmente nel browser, quindi un PDF che decidi di non convertire non lascia mai il tuo computer.
Le quattro cose che mandano in crisi i convertitori di PDF
Un PDF memorizza glifi a certe coordinate. Non memorizza paragrafi, tabelle o ordine di lettura: tutto questo va dedotto. Ecco ciò a cui quella deduzione deve resistere.
Layout a due colonne
Il problema
Articoli accademici, newsletter e bilanci dispongono il testo in colonne, ma il flusso di contenuto sottostante spesso attraversa la pagina da parte a parte. Estratto nell'ordine memorizzato, produce la riga uno della colonna A, poi la riga uno della colonna B, poi la riga due della colonna A: un intreccio che si legge come un guazzabuglio. L'analizzatore rileva prima il corridoio verticale e legge ogni colonna come un blocco a sé.
Tabelle senza bordi
Il problema
Moltissime tabelle non hanno alcuna linea tracciata; una persona le legge come tabella soltanto perché i valori sono allineati. Senza righe da rilevare, l'unico segnale è l'analisi geometrica di dove il testo inizia e finisce su ciascuna riga. Righe e colonne vengono dedotte da quegli allineamenti e ricostruite come tabelle Markdown.
Paragrafi tagliati dalle interruzioni di pagina
Il problema
Una frase che inizia in fondo a pagina 4 e finisce all'inizio di pagina 5 ha un'intestazione corrente, un piè di pagina e un numero di pagina fra le sue due metà. Questi elementi ricorrenti vengono individuati fra le pagine e rimossi, e i due frammenti si riuniscono in un unico paragrafo.
Pagine senza alcun testo
Il problema
Una pagina scansionata contiene un'immagine, non caratteri: letteralmente non c'è nulla da estrarre. Anziché produrre in silenzio una sezione vuota, quelle pagine vengono contate e segnalate per numero, così un risultato breve viene spiegato invece di sembrare un errore. Attiva l'OCR e verranno lette.
Pagine scansionate: segnalate per impostazione predefinita, leggibili su richiesta
Se una pagina non ha un livello di testo, il convertitore ti dice quali pagine sono coinvolte invece di produrre in silenzio un file più corto. L'OCR facoltativo legge quelle pagine come testo: è disattivato per impostazione predefinita, perché è un vero compromesso e non un miglioramento gratuito.
Che cosa recupera
Titoli, elenchi, tabelle e ordine di lettura tornano tutti, perché derivano da dove le parole si collocano nella pagina e non dai metadati del carattere.
Quanto costa
Circa 1,5 secondi per pagina contro circa 50 millisecondi senza — all'incirca trenta volte più lento — ed è limitato a 50 pagine per documento.
Che cosa non può recuperare
Grassetto e corsivo. L'output dell'OCR non porta con sé informazioni sul carattere, quindi l'enfasi sulle pagine riconosciute è persa definitivamente. Anche gli errori di riconoscimento su scansioni scadenti sono normali.
L'OCR usa la stessa abilitazione di piano dello strumento OCR autonomo. Le pagine lette in questo modo sono elencate a parte nel risultato, così sai esattamente quali parti del documento controllare.
Convertire molti file in una volta
La modalità in blocco parte dal presupposto che in ogni cartella reale di PDF almeno un file darà problemi.
Un processo, uno ZIP
Ogni PDF diventa un file .md a sé dentro un unico archivio, così migrare una documentazione è un caricamento e uno scaricamento anziché un ciclo ripetitivo.
Un file guasto non affonda mai il blocco
Un PDF danneggiato o bloccato fallisce per conto suo. Gli altri vengono convertiti normalmente e restano scaricabili: non si torna mai al punto di partenza per un solo file.
Un resoconto di quanto accaduto
Il file CONVERSION_REPORT.md dentro lo ZIP registra l'esito di ogni file di origine: pagine convertite, pagine che erano scansioni, pagine che non è stato possibile elaborare.
Una password per file
I PDF protetti raramente condividono la stessa password. Ogni file bloccato ha un campo dedicato, verificato nel browser prima del caricamento, così un errore di battitura emerge subito e non dopo un lungo trasferimento.
Markdown, testo semplice o Word?
Tutti e tre estraggono parole da un PDF. Differiscono per quanta forma del documento le accompagna e per ciò che potrai farne dopo.
| Markdown | Testo semplice (.txt) | Word (.docx) | |
|---|---|---|---|
| Titoli | Conservati come livelli # | Persi | Conservati come stili |
| Tabelle | Tabelle Markdown | Perse | Conservate |
| Si legge bene in un diff | Sì | Sì | No — formato binario |
| Si visualizza su GitHub, wiki, siti di documentazione | In modo nativo | Come blocco di codice | Non senza conversione |
| Buon input per un LLM o un indice di ricerca | Il migliore — la struttura resta | Utilizzabile, struttura persa | Richiede prima l'estrazione |
| Modificabile in qualsiasi editor di testo | Sì | Sì | No |
Regola pratica: Markdown quando il testo verrà letto, versionato o rielaborato; Word quando verrà reimpaginato e stampato.
Come convertire un PDF in Markdown
Non serve un account per provarlo, né alcun software da installare.
Aggiungi i tuoi PDF
Trascina i file in qualsiasi punto della pagina o usa il selettore. Ognuno riceve una miniatura della prima pagina e il numero di pagine, generati localmente nel browser.
Imposta le opzioni
Se vuoi, estrai le immagini incorporate, attiva l'OCR per le pagine scansionate e inserisci la password per ogni file che risulta bloccato.
Converti
Un file viene convertito subito. Più file vengono messi in coda come blocco ed elaborati insieme, con l'avanzamento mostrato via via che ciascuno termina.
Scarica e leggi le note
Ottieni un file .md, oppure uno ZIP se sono state estratte immagini o se hai convertito più file. Leggi l'avviso, se compare: indica quali pagine hanno richiesto attenzione.
Dove viene usato davvero
Ovunque un PDF debba diventare testo su cui possano lavorare una macchina o un sistema di controllo di versione.
Migrazione della documentazione
Manuali storici, procedure e schede tecniche bloccati in PDF passano a un sito di documentazione, a un wiki o a un repository con titoli e tabelle intatti: nessuna ribattitura, nessuna riformattazione.
Pipeline RAG e contesto per LLM
La qualità del recupero dipende molto dal chunking, e il chunking dipende dalla struttura. I titoli Markdown danno allo splitter confini reali su cui tagliare, cosa che il testo semplice semplicemente non offre.
Ricerca e presa di appunti
Porta gli articoli in Obsidian, Notion o Logseq con sezioni e tabelle conservate, così citazioni e figure restano legate al titolo da cui provengono.
Documenti sotto controllo di versione
Il Markdown si confronta riga per riga in git. Un contratto o una policy convertiti una volta possono poi essere tracciati, revisionati e approvati con lo stesso flusso di lavoro del codice.
Contenuti per siti statici e CMS
Il Markdown è l'input nativo di Hugo, Jekyll, Astro, Docusaurus e della maggior parte dei CMS headless, quindi i file convertiti finiscono direttamente in una cartella di contenuti.
Estrazione di dati dai report
Bilanci e report di ricerca seppelliscono i numeri nelle tabelle. Le tabelle Markdown si analizzano in modo banale, il che rende quelle cifre raggiungibili da uno script.
Che cosa non farà
Meglio saperlo in anticipo, perché è più difficile fidarsi di un convertitore che nasconde i propri limiti rispetto a uno che li dichiara.
Le pagine difficili vengono segnalate, non nascoste
Le pagine che erano scansioni, quelle che non è stato possibile elaborare e quelle risultate troppo complesse per il riconoscimento delle tabelle sono indicate per numero nel risultato. Le pagine complesse producono comunque il loro testo come paragrafi: ciò che si perde è la forma tabellare.
I limiti di dimensione e pagine derivano dal tuo piano
Dimensione massima del file, pagine per documento e file per blocco sono tutti stabiliti dal tuo piano e mostrati nel pannello accanto all'area di caricamento. Il valore visualizzato è sempre quello attuale.
I file cifrati richiedono la loro password
Un PDF bloccato non può essere letto senza. Le password vengono usate per quella singola conversione, verificate prima nel browser e mai memorizzate.
Domande frequenti
Funziona con i PDF scansionati?
Non senza OCR, perché una pagina scansionata contiene un'immagine anziché caratteri: non c'è nulla da estrarre. Il convertitore ti dice esattamente quali pagine erano scansioni, e attivando l'OCR vengono lette. Aspettati tempi molto più lunghi e la perdita di grassetto e corsivo su quelle pagine.
Le tabelle vengono davvero conservate o solo approssimate?
Sia le tabelle con bordi sia i layout a colonne allineate senza bordi vengono riconosciuti e ricostruiti come tabelle Markdown. Le pagine molto complesse — celle unite, tabelle annidate, forte impaginazione visiva — ripiegano su paragrafi semplici, e quelle pagine sono elencate nel risultato così sai quali controllare.
Che fine fanno le immagini dentro il PDF?
Per impostazione predefinita vengono ignorate e ottieni un unico file .md. Spunta «estrai le immagini incorporate» e il risultato è uno ZIP con il tuo Markdown più una cartella images/, con il Markdown che rimanda a ciascun file estratto.
Posso convertire più PDF in una volta?
Sì, con un piano che ha la conversione in blocco attiva. I file vengono messi in coda come un unico processo e restituiti in uno ZIP con un report di conversione. Senza quella funzione del piano puoi comunque convertire quanti file vuoi, uno alla volta.
Come gestisce gli articoli accademici a due colonne?
I confini delle colonne vengono rilevati prima di leggere qualsiasi testo, così ogni colonna è elaborata dall'alto in basso a turno. Senza quel passaggio l'estrazione alterna le colonne riga per riga e il risultato è inutilizzabile: è proprio per questo che tanti strumenti faticano con gli articoli.
Posso convertire un PDF protetto da password?
Sì. I file bloccati mostrano un campo password sulla propria scheda, e la password viene verificata nel browser prima che qualsiasi cosa venga caricata, così una errata emerge all'istante. In un blocco ogni file può avere una password diversa.
Quanto può essere grande il file?
Dipende dal tuo piano. Il limite mostrato sotto l'area di caricamento è quello attuale e viene letto in tempo reale dal tuo account anziché essere un numero fisso, quindi un passaggio di piano lo alza subito.
Il Markdown è pubblicabile così com'è?
Di solito ci va vicino. Titoli, elenchi, tabelle e link escono puliti, e il risultato è CommonMark standard che si visualizza su GitHub, nei wiki e nei generatori di siti statici. I documenti con impaginazione insolita meritano una rilettura veloce, e l'avviso nel risultato ti dice dove guardare.
Per quanto tempo vengono conservati i miei file?
I caricamenti e i risultati vengono eliminati automaticamente allo scadere del periodo di conservazione del tuo piano, indicato sotto l'area di caricamento. Puoi anche eliminare subito un file convertito dalla schermata di download.
Serve un account?
No. La conversione funziona senza accedere, entro i limiti del piano anonimo per dimensione dei file, pagine e conversioni giornaliere. Accedere alza quei limiti e conserva i file più a lungo.
Strumenti correlati
Altri modi per estrarre contenuti da un PDF o inserirli in uno.
Related Guides

Common document management mistakes small business make
Discover the most common document management mistakes small businesses make and learn simple ways to organize, store, share, and manage important files efficiently." focus_keyword: Document Management Mistakes

The Difference Between Storing Documents and Actually Managing Them
Learn the difference between storing documents and actually managing them. Discover how better organization, version control, PDF tools, and workflows save time." focus_keyword: Document Storage vs Document Management

PDF Techno vs iLovePDF OCR: Which Is More Accurate?
Compare PDF Techno vs iLovePDF OCR for text accuracy, scanned PDFs, multilingual documents, tables, ease of use, and overall OCR performance.

PDF Techno vs Smallpdf PDF to JPG: Which Is Better?
Compare PDF Techno vs Smallpdf PDF to JPG conversion for image quality, text clarity, scanned documents, file size, ease of use, and overall results.

Edit PDF vs Repair PDF: What's the Difference and Which One Do You Need?
Confused between editing a PDF and repairing one? Learn the difference, when to use each option, and how PDF Techno helps you edit and repair PDF files quickly.

PDF Security Checklist: 10 Things You Should Do Before Sharing a File
Protect your sensitive documents with this PDF security checklist. Learn 10 essential steps to secure your PDF before sharing it online using PDF Techno.