Extraire le texte d’un PDF

Récupérez le texte brut d’un PDF dans un fichier .txt, prêt à copier, rechercher ou réutiliser. L’extraction se fait sur votre appareil : votre PDF n’est jamais envoyé.

Déposez vos fichiers ici

ou glissez-déposez · PDF · jusqu’à 200 Mo

    Traitement…

    Terminé !

      Traité sur votre appareil. Aucun envoi. · Gratuit · Sans inscription · Sans filigrane

      Comment extraire le texte d’un PDF

      1. 1

        Cliquez sur Choisir des fichiers ou glissez un ou plusieurs PDF dans le cadre (jusqu’à 200 Mo chacun).

      2. 2

        Cliquez sur Convertir : le texte de toutes les pages est extrait.

      3. 3

        Le fichier .txt se télécharge automatiquement ; pour plusieurs PDF, utilisez Tout télécharger (ZIP).

      À quoi sert l’extraction de texte ?

      Copier-coller depuis un lecteur PDF fonctionne pour une phrase, mais devient pénible sur un long document : retours à la ligne au milieu des phrases, pages à sélectionner une à une. L’extraction récupère d’un coup tout le texte dans un fichier simple, lisible partout.

      • Réutiliser un contenu : citer un rapport, reprendre un article, préparer une traduction.
      • Rechercher dans un document : un fichier texte s’ouvre instantanément et se parcourt avec n’importe quel outil de recherche.
      • Analyser ou résumer : un texte brut est le format le plus simple à coller dans un tableur, un logiciel d’analyse ou un assistant IA.

      Texte, Word, Excel ou OCR : quel outil choisir ?

      Votre besoinOutil
      Le texte brut, rien d’autrePDF en texte
      Un document modifiable avec sa mise en formePDF en Word
      Les tableaux, avec des chiffres calculablesPDF en Excel
      Le texte d’un scan ou d’une photoOCR PDF

      Problèmes fréquents

      • Des mots coupés ou des lignes mélangées : la mise en page d’origine est en colonnes ou contient des encadrés. Le texte est bien là, mais il faudra peut-être réorganiser quelques paragraphes.
      • Des caractères étranges à la place des lettres : certains PDF utilisent des polices encodées de façon non standard. Dans ce cas, l’OCR peut donner un meilleur résultat, car il lit l’image de la page.
      • Le fichier est refusé : un PDF protégé par mot de passe doit d’abord passer par Déverrouiller PDF.

      Vous pouvez extraire le texte de plusieurs PDF d’un coup : vous obtenez un fichier .txt par document, regroupés dans une archive ZIP.

      Vérifier si votre PDF contient du texte

      Ouvrez le PDF et essayez de sélectionner un mot. S’il se surligne, l’extraction fonctionnera. Si rien ne se sélectionne, ou si la page entière se comporte comme une image, c’est un scan : il faut passer par l’OCR.

      L’extraction se fait entièrement dans votre navigateur, sans envoi : vous pouvez l’utiliser sur des documents internes ou personnels.

      Sur téléphone

      L’extraction fonctionne aussi depuis le navigateur d’un smartphone. Le fichier .txt téléchargé s’ouvre dans l’app Fichiers (iPhone) ou dans n’importe quel éditeur de texte sur Android ; vous pouvez ensuite copier tout le contenu en un geste pour le coller ailleurs.

      Questions & réponses

      Comment extraire le texte d’un PDF ?
      Déposez le PDF ci-dessus et cliquez sur Convertir : vous obtenez un fichier .txt contenant le texte de toutes les pages, que vous pouvez ouvrir avec n’importe quel éditeur.
      Pourquoi le fichier texte est-il vide ?
      Votre PDF est très probablement un scan : chaque page est une image, sans texte. Passez-le dans OCR PDF, qui reconnaît les caractères (français compris).
      Quelle différence avec PDF en Word ?
      PDF en texte donne du texte brut, sans mise en forme : idéal pour copier, analyser ou indexer. PDF en Word reconstruit un document mis en forme, avec titres, gras et images.
      Les accents sont-ils conservés ?
      Oui, le fichier est enregistré en UTF-8 : accents, cédilles et caractères spéciaux sont conservés lorsqu’ils sont correctement encodés dans le PDF.