Aller au contenu
HandfulTools

PDF en texte (extraire le texte d'un PDF)

Récupérez le texte d'un PDF pour le citer, le traduire, l'analyser ou le réutiliser. Le texte s'affiche page par page et peut être copié ou téléchargé en .txt.

Fonctionne dans le navigateur

Loading…

Mode d'emploi

  1. Déposez un PDF.
  2. Choisissez d'ajouter ou non des séparateurs de pages.
  3. Cliquez sur Extraire le texte.
  4. Copiez le texte ou téléchargez le .txt.

Comment ça marche

Le texte est lu dans le calque texte du PDF avec pdf.js et réassemblé en lignes selon la position de chaque fragment. Les mises en page en colonnes et les tableaux peuvent sortir dans un ordre différent de l'affichage.

Les PDF scannés ne contiennent que des images : l'outil le détecte et indique qu'une reconnaissance de caractères (OCR) serait nécessaire.

Les fichiers sont traités dans votre navigateur avec les bibliothèques open source pdf-lib et pdf.js : ils ne sont jamais envoyés.

Exemples

Article scientifique
Extrayez le texte pour compter les mots ou le traduire.

Utilisations courantes

  • Copier le texte d'un PDF
  • Compter les mots d'un PDF
  • Réutiliser le texte dans d'autres outils

Confidentialité et sécurité

Cet outil fonctionne entièrement dans votre navigateur. Vos fichiers et textes ne sont jamais envoyés sur nos serveurs : le traitement a lieu sur votre appareil. Comment chaque outil traite les fichiers

Questions fréquentes

Pourquoi le texte est-il vide ?

Le PDF est sans doute un scan (image). L'OCR est prévu.

La mise en forme est-elle conservée ?

Non, le résultat est du texte brut.

Dernière mise à jour: