Estrarre il testo da un PDF
Tira fuori il testo da un PDF per citarlo, tradurlo, analizzarlo o riutilizzarlo altrove. Il testo viene mostrato pagina per pagina e si può copiare o scaricare come file .txt.
Funziona nel tuo browser
Come si usa
- Trascina un PDF.
- Scegli se aggiungere i separatori di pagina.
- Fai clic su «Estrai il testo».
- Copia il testo o scarica il file .txt.
Come funziona
Il testo viene letto dal livello di testo del PDF con pdf.js e ricomposto in righe in base alla posizione di ogni frammento sulla pagina. Nelle impaginazioni su più colonne e nelle tabelle l'ordine di lettura può non coincidere con quello visivo.
I PDF scansionati contengono solo immagini di testo e non hanno un livello di testo; lo strumento se ne accorge e ti avvisa che servirebbe un OCR (riconoscimento ottico dei caratteri).
I file vengono elaborati nel tuo browser con le librerie open source pdf-lib e pdf.js: non vengono mai caricati.
Esempi
- Articolo scientifico
- Estrai il testo di un articolo per contarne le parole o incollarlo in un traduttore.
Usi comuni
- Copiare il testo da PDF con l'impaginazione bloccata
- Contare le parole di un documento PDF
- Passare il testo ad altri strumenti
Privacy e sicurezza
Questo strumento funziona interamente nel tuo browser. I tuoi file e i tuoi testi non vengono mai caricati sui nostri server: l'elaborazione avviene sul tuo dispositivo e anche il risultato viene creato lì. Come ogni strumento tratta i file
Domande frequenti
Perché il testo risulta vuoto?
Molto probabilmente il PDF è una scansione (un'immagine). L'OCR è previsto più avanti.
La formattazione viene mantenuta?
No: il risultato è testo semplice. Usa PDF in Word (in arrivo) se ti serve testo formattato.
Ultimo aggiornamento: