OCR d'un PDF numérisé
Rendez vos numérisations consultables ou extrayez-en le texte brut — le tout dans votre navigateur.
Vos fichiers ne quittent jamais votre appareil.
Chargement du pack linguistique Anglais
Téléchargement de 3 Mo. Une seule fois — les exécutions suivantes sont instantanées.
Conserve l'apparence visible et ajoute du texte sélectionnable en dessous. Ctrl-F trouve les mots.
Vous obtenez un fichier .txt brut contenant les mots reconnus.
Aperçu gratuit
La formule gratuite traite la première page. Pro traite le document complet.
Passer à Pro — $5,99/moisVous avez une clé Pro ?
OCR d'un PDF dans votre navigateur
La reconnaissance optique de caractères (OCR) rend les documents numérisés consultables. Déposez un PDF numérisé, choisissez la langue et décidez si vous voulez un PDF consultable (original visible + texte sélectionnable en dessous) ou un extrait en texte brut. Tout s'exécute dans votre navigateur — votre fichier ne quitte jamais votre appareil.
Appliquez l'OCR à votre PDF sans rien envoyer — vos fichiers ne quittent jamais votre appareil
Contrairement à la plupart des outils en ligne, l'OCR de votre PDF se déroule entièrement dans votre navigateur. Le fichier n'est jamais envoyé à un serveur, jamais stocké et ne quitte jamais votre appareil — contrats, documents financiers et autres pièces sensibles restent privés.
Questions fréquentes
- Mes fichiers sont-ils envoyés quelque part ?
- Non. Rien n'est envoyé — l'OCR s'exécute entièrement dans votre navigateur, votre fichier n'atteint donc jamais un serveur et ne quitte jamais votre appareil. Nous ne pouvons pas le voir puisque nous ne le recevons jamais.
- Que signifie « PDF consultable » ?
- Le résultat est visuellement identique à votre numérisation, mais Ctrl-F (Cmd-F) y trouve les mots. Tesseract.js détecte le texte dans l'image et l'intègre en couche invisible sous l'image visible. Sélectionner-copier renvoie le texte reconnu.
- Quelle différence entre PDF consultable et Extraction de texte ?
- Le PDF consultable conserve l'apparence visible et ajoute une couche de texte sélectionnable. L'extraction de texte vous donne un fichier .txt brut contenant uniquement les mots reconnus.
- Quelles langues sont prises en charge ?
- Anglais, espagnol, portugais et polonais en v1. Choisissez la langue de votre document pour une meilleure précision. L'allemand, le français et d'autres sont prévus en v1.1 selon la demande.
- Quelle est la précision de l'OCR ?
- Tesseract fonctionne au mieux avec un texte dactylographié net et bien résolu. Les numérisations de travers, à faible contraste ou manuscrites peuvent donner des résultats peu fiables. Essayez une numérisation en plus haute résolution ou une autre langue si le résultat est médiocre.
- Pourquoi la première exécution est-elle lente ?
- À la première exécution, votre navigateur télécharge le moteur OCR (~3 Mo) et le pack linguistique (~1-2 Mo par langue). Les deux sont mis en cache — les exécutions suivantes sont instantanées. Gardez cet onglet au premier plan pendant l'OCR.
- Quelle est la limite de taille ?
- 10 Mo en formule gratuite, 25 Mo en Pro. La vraie limite est la mémoire de votre appareil.
- Qu'apporte la formule Pro ?
- En formule gratuite, l'OCR traite les fichiers jusqu'à 10 Mo. Pro offre 25 Mo de capacité et — dès leur disponibilité — le traitement par lot et l'accès à l'API. Pass journée à $1,99, crédits à $4,99, Pro à $5,99/mois ou Pro annuel à $49.
- Envoyez-vous mes fichiers ?
- Non. L'OCR s'exécute entièrement dans votre navigateur via WebAssembly. Vos fichiers et le texte reconnu restent sur votre appareil.
D'autres outils PDF
29 outils — compresser, fusionner, diviser, pivoter, convertir, signer et plus encore. Tous gratuits à essayer.
Retour à l'accueil →