Extraire le texte d'un PDF

Extrayez le texte de pages choisies, vérifiez-le et téléchargez un TXT UTF-8. Aucun OCR n'est appliqué aux scans.

Gratuit · Sans inscription · Aucun envoi de fichier

Déposez vos fichiers ici

Fichiers pris en charge: PDF · Un fichier de 100 Mo maximum

Options de modification→ TXT

Exemple : 1,3-5. Laissez vide pour toutes les pages.

Lire la couche de texte d'un document PDF

  1. Choisissez un PDF avec du texte sélectionnable.

  2. Vérifiez le texte extrait dans l’aperçu.

  3. Téléchargez le fichier TXT.

L'extraction dépend du texte stocké dans le PDF

Transformer un PDF en texte brut retire les polices, les images et la mise en page pour ne garder que les mots, faciles à reprendre dans un autre éditeur.

Colonnes, tableaux, polices spéciales et tables de caractères manquantes peuvent modifier l'ordre. Les pages vides ou scannées sont signalées lorsque d'autres contiennent du texte.

Fichiers pris en charge

PDF → TXT

  • Un fichier de 100 Mo maximum
  • Entrée totale: 300 MB
  • Sortie totale: 150 MB
  • Pages: ≤ 200

PDF chiffrés non pris en charge. Pas de modification du texte existant ni d’OCR.

Exemple de résultat

Original

Exemple de résultat: Extraire le texte d'un PDF (Original)
journal-cover.pdf344.0 KB · 1 Pages

Résultat

COASTAL NOTES THE SLOW ISSUE
BLURME / SAMPLE JOURNAL
A little closer
to the coast.
Light, texture and the pleasure of taking your time.
A table for two. A view for miles.
An imaginary travel journal, made for trying out your next edit.

Questions fréquentes

Pourquoi un PDF numérisé ne renvoie-t-il aucun texte ?
Il peut ne contenir que des images de lettres. L'outil lit la couche de texte existante, sans reconnaissance dans les images.
L'extraction PDF reconstruit-elle un tableau pour un tableur ?
Non. Elle produit du texte brut sans reconstituer cellules, colonnes ou mise en page.
Les caractères coréens, japonais et arabes du PDF sont-ils conservés ?
UTF-8 les prend en charge, mais l'extraction dépend des correspondances de caractères du PDF. Vérifiez les omissions et l'ordre.
Peut-on extraire le texte PDF dans un autre ordre de pages ?
Oui. 3,1-2 traite la troisième page avant la première et la deuxième, sans changer l'ordre à l'intérieur d'une page.
Mes fichiers sont-ils envoyés sur un serveur ?
Non. Les fichiers sont traités dans votre navigateur sur cet appareil et ne sont pas envoyés aux serveurs de BlurMe.

Outils associés

Tous les outils

Avec BlurMe, vérifiez et masquez les informations personnelles de vos documents.

Un compte gratuit est nécessaire pour télécharger. Les exports gratuits incluent un filigrane.