PDF en Excel

Rapports financiers. Jeux de données de recherche. Archives publiques.
Certains tableaux ne devraient pas quitter votre appareil. Extrayez-les dans votre navigateur — rien n'est envoyé.

Déposez ici votre PDF pour en extraire les tableaux
Max 25 Mo par fichier

À propos de l'extraction de tableaux depuis un PDF

Ce que cet outil extrait

Tableaux bien alignés, tableaux sans bordures (l'algorithme s'appuie sur la géométrie du texte, pas sur les traits visibles) et tableaux se poursuivant sur plusieurs pages (quand les repères de colonnes et les en-têtes concordent d'une page à l'autre). Les tableaux détectés s'affichent avec un niveau de fiabilité — élevé, moyen ou faible — pour vous laisser juger de chacun avant utilisation.

Quand l'utiliser

Rapports financiers, jeux de données de recherche, registres publics collectés, archives administratives, exports de données internes — tout cas où le PDF source est assez sensible pour que l'envoi à un convertisseur tiers soit le mauvais réflexe, mais assez structuré pour que ressaisir les tableaux à la main le soit aussi.

Le cadrage confidentialité

D'après nos recherches, tous les concurrents PDF→Excel accessibles (Smallpdf, iLovePDF, PDFCandy, PDF24, Convertio) traitent le contenu sur leurs serveurs ou emploient une formulation ambiguë de « traitement dans le navigateur ». Adobe Acrobat place la fonction derrière un abonnement. Le quadrant « tout dans le navigateur » reste inoccupé. PDF en Excel s'exécute entièrement sur votre appareil via pdf.js et SheetJS — vos rapports financiers, jeux de données et archives restent dans votre navigateur.

Les indicateurs de fiabilité

L'extraction de tableaux depuis un PDF est statistique, pas déterministe. Cet outil affiche un niveau de fiabilité par tableau (élevé / moyen / faible), calculé à partir de l'alignement des colonnes, de la proportion de cellules vides et du nombre de lignes. Aucun concurrent accessible n'affiche de fiabilité — tous promettent une « structure préservée » sans reconnaître les pertes inhérentes à une extraction fondée sur la position du texte. Cette transparence est, avec la confidentialité, notre second facteur de différenciation.

Ce que nous ne gérons pas, et pourquoi

Les PDF numérisés doivent d'abord passer par l'OCR — utilisez OCR PDF pour ajouter une couche de texte, puis revenez. Les PDF chiffrés exigent de retirer d'abord le mot de passe, dans votre logiciel PDF. Les PDF corrompus doivent d'abord être réparés — voyez Réparer un PDF. Les tableaux à faible fiabilité sont signalés explicitement ; pour des données critiques, une reprise manuelle ou d'autres outils restent des options.

Après l'extraction

Ajoutez un mot de passe au tableur extrait avant de le partager avec Protéger un PDF — vos exports financiers et de recherche restent chiffrés au repos.

Convertissez un PDF en Excel sans rien envoyer — vos fichiers ne quittent jamais votre appareil

Contrairement à la plupart des outils en ligne, la conversion de votre PDF en Excel se déroule entièrement dans votre navigateur. Le fichier n'est jamais envoyé à un serveur, jamais stocké et ne quitte jamais votre appareil — contrats, documents financiers et autres pièces sensibles restent privés.

Questions fréquentes

Mes fichiers sont-ils envoyés quelque part ?
Non. Rien n'est envoyé — la conversion s'exécute entièrement dans votre navigateur, votre fichier n'atteint donc jamais un serveur et ne quitte jamais votre appareil. Nous ne pouvons pas le voir puisque nous ne le recevons jamais.
Quels PDF donnent les meilleurs résultats ?
Les PDF textuels bien alignés (exports Excel, rapports générés, données publiques). Les tableaux sans bordures fonctionnent — l'algorithme s'appuie sur la géométrie du texte, pas sur les traits visibles. Une page contenant plusieurs tableaux produit une feuille par tableau. Les PDF numérisés doivent d'abord passer par l'outil OCR PDF.
Pourquoi mon tableau semble-t-il incorrect ?
L'extraction de tableaux depuis un PDF est statistique. L'algorithme regroupe les éléments de texte par position pour déduire lignes et colonnes. Les tableaux bien alignés donnent des extractions à fiabilité élevée ; ceux avec cellules fusionnées, contenus multi-lignes ou mises en page inhabituelles peuvent donner une fiabilité moyenne ou faible, avec un avertissement visible. Pour des données critiques, relisez manuellement les tableaux à faible fiabilité ou nettoyez-les dans Excel / LibreOffice.
Puis-je extraire des tableaux de PDF numérisés ?
Non. Cet outil exige des PDF au texte sélectionnable. Pour les PDF numérisés (image seule), lancez d'abord OCR PDF pour ajouter une couche de texte, puis revenez à PDF en Excel. Nous n'intégrons pas l'OCR en v1 — l'outil OCR PDF existant couvre le cas sans coût supplémentaire.
Puis-je extraire des tableaux de PDF protégés par mot de passe ?
Non. La v1 refuse le déchiffrement. Retirez d'abord le mot de passe dans votre logiciel PDF, puis revenez à PDF en Excel. Nous ne faisons pas transiter votre mot de passe par pdfmundo.
Mes PDF sont-ils envoyés sur vos serveurs ?
Non. Toute l'extraction s'exécute dans votre navigateur via pdf.js et SheetJS. Rapports financiers, jeux de données de recherche et archives publiques ne quittent jamais votre appareil. Nous n'avons aucun serveur qui reçoive le contenu.
Faut-il choisir XLSX ou CSV ?
XLSX conserve la structure multi-tableaux (une feuille par tableau détecté), les indications de mise en forme des en-têtes et les métadonnées de fiabilité. Choisissez XLSX pour poursuivre dans Excel / LibreOffice. Choisissez CSV pour alimenter une chaîne de traitement (Pandas, R, Python) qui préfère du texte brut ; les sorties multi-tableaux sont alors regroupées dans une archive ZIP.

Extraire d'un autre PDF

Ou explorez le reste du catalogue.

Retour à l'accueil →