Extraire le texte d’un PDF gratuitement
Le texte du PDF s’affiche : copiez-le ou téléchargez-le en fichier .txt. L’extraction se fait dans votre navigateur.
Ou sélectionnez-le sur votre appareil. Aucun fichier n’est envoyé.
PDF uniquement · 100 Mo maximum (40 Mo sur mobile) · 500 pagesTraitement 100 % local, rien n’est envoyé
Comment ça marche ?
Un PDF « numérique » (créé par un traitement de texte, un export de site…) contient son texte sous forme de caractères. L’outil le lit avec la bibliothèque pdf.js de Mozilla, page par page, puis le remet en lignes et en paragraphes.
- Déposez le PDF et cochez, si vous le voulez, l’indication du numéro de page.
- Cliquez sur « Extraire le texte » : il s’affiche dans une zone que vous pouvez copier.
- Téléchargez-le aussi en fichier .txt (encodage UTF-8).
La mise en forme (polices, colonnes, tableaux) n’est pas reproduite : seul le texte est récupéré, dans l’ordre de lecture du document. Un PDF issu d’un scan ne contient qu’une image : il n’a pas de texte à extraire, il faudrait une reconnaissance de caractères (OCR).
Exemples
Récupérer le texte d’un rapport
Un rapport de 10 pages d’environ 4 500 mots s’extrait en moins de 2 secondes ; copiez-le dans un traitement de texte pour le retravailler.
Reconnaître un scan
Un PDF de 3 pages numérisées ne contient que des images : l’outil le signale (« aucun texte trouvé ») au lieu de renvoyer une page blanche.