Convertir un PDF en texte

Extrayez le texte de chaque page dans un seul fichier .txt UTF-8 — directement dans votre navigateur.
Plages de pages prises en charge, aucun envoi, sortie prête à copier-coller.

Déposez ici votre PDF pour en extraire le texte
Gratuit · Jusqu'à 50 Mo · Pro jusqu'à 250 Mo · Traitement dans votre navigateur

À propos de l'extraction de texte depuis un PDF

PDF en Texte lit la couche de texte de votre PDF et produit un fichier .txt en UTF-8. La formule gratuite traite jusqu'à 50 pages ; Pro débloque les documents plus volumineux et la conversion par lot. Contrairement à certains convertisseurs en ligne qui envoient votre PDF sur un serveur pour l'analyser, pdfmundo extrait le texte localement avec pdf.js de Mozilla — votre fichier ne quitte jamais l'onglet du navigateur. Les PDF sur plusieurs colonnes (journaux, articles universitaires en deux colonnes) peuvent produire un texte où les colonnes s'entremêlent ; pour une extraction respectant la mise en page, utilisez PDF → Word. Les PDF numérisés sans couche de texte ne renverront aucun texte — passez d'abord par OCR PDF pour ajouter une couche de texte.

Questions fréquentes

Où mon PDF est-il traité ?
Entièrement dans l'onglet de votre navigateur. Nous utilisons pdf.js de Mozilla pour lire la couche de texte du PDF. Rien n'est envoyé sur notre serveur.
Pourquoi mon PDF multi-colonnes produit-il un texte entremêlé ?
pdf.js renvoie les éléments de texte dans l'ordre où ils apparaissent dans le flux interne du PDF, ce qui, pour les mises en page en colonnes, peut les entremêler selon la position verticale. Pour une extraction respectant l'ordre de lecture des colonnes, utilisez PDF → Word — cet outil dispose d'une détection de colonnes dédiée.
Et si mon PDF est une image numérisée sans couche de texte ?
Alors il n'y a aucun texte à extraire. Nous le détectons et vous proposons un lien vers notre outil OCR PDF, qui ajoute une couche de texte aux PDF composés uniquement d'images. Lancez d'abord l'OCR, puis revenez extraire le texte.
Et si mon PDF est protégé par mot de passe ?
L'outil vous le signalera. Retirez d'abord le mot de passe dans votre logiciel PDF, puis extrayez le texte.
La mise en forme sera-t-elle conservée ?
Non. La sortie en texte brut est sans mise en forme : ni gras, ni italique, ni tailles de police, ni titres. Pour une extraction respectant la mise en page et le formatage, utilisez PDF → Word.
Quel encodage la sortie utilise-t-elle ?
Toujours UTF-8. Sans perte pour tout PDF contenant de l'Unicode : emoji, CJC, cyrillique, grec, arabe, etc.
Quelle est la taille maximale ?
50 Mo et 50 pages en formule gratuite ; 250 Mo et 5 000 pages en Pro.
Faut-il un compte ?
Non. L'outil est entièrement gratuit et ne demande aucune inscription.

D'autres outils PDF

Une fois le texte brut obtenu, vous pouvez d'abord appliquer l'OCR à un PDF numérisé pour y ajouter une couche de texte, convertir en respectant la mise en page avec PDF → Word, ou extraire les images de pages avec PDF → JPG.

Voir tous les outils