OCR PDF — Extraire le texte d’un PDF scanné, gratuit
OCR PDF gratuit : extrayez le texte de PDF scannés ou en images, jusqu’à 20 pages par passe, dans le navigateur. Moteur OCR chargé d’un CDN au 1er usage.
Conversion dans le navigateur · Sans inscription
PDF jusqu’à 30 Mo. L’OCR traite jusqu’à 20 pages par passe.
Les images (PNG, JPG, WebP, AVIF) fonctionnent aussi : déposez-en une ici.
Vous pouvez aussi coller une capture d’écran avec Ctrl+V (⌘V sur Mac).
À la première utilisation, votre navigateur télécharge le moteur OCR et les données de la langue choisie (plusieurs mégaoctets) depuis un CDN public et les met en cache. Votre image, elle, n’est jamais envoyée.
Mode d’emploi
- Choisissez un PDF scanné (jusqu’à 30 Mo).
- Sélectionnez la langue du texte et les pages à lire, par exemple 1-3, 5 (jusqu’à 20 pages par passe).
- Cliquez sur Extraire le texte, puis modifiez, copiez ou téléchargez le résultat au format .txt.
Exemple
Un contrat scanné de 3 pages, pages 1-3 → « --- Page 1 ---\nCONTRAT\nLe présent contrat est conclu…\n\n--- Page 2 ---\n… » en texte modifiable, enregistré sous contrat.txt.
Détails et limites
Les pages sont rendues à environ 200 DPI et reconnues l’une après l’autre avec tesseract.js dans votre navigateur ; le PDF n’est pas envoyé. Le moteur OCR et les données de langue sont téléchargés depuis un CDN public (jsDelivr) la première fois, puis mis en cache.
Si le PDF contient déjà du texte sélectionnable, copiez-le directement ; l’OCR sert aux pages scannées ou composées d’images. Les PDF protégés par mot de passe ne sont pas pris en charge, et le résultat est du texte brut sans mise en page.
FAQ
Comment extraire gratuitement le texte d’un PDF scanné ?
Choisissez le PDF, la langue et les pages (jusqu’à 20 par passe), puis cliquez sur Extraire le texte. C’est gratuit, sans compte, et tout se passe dans votre navigateur. Pour un document plus long, relancez avec la plage de pages suivante.
Peut-il lire des PDF japonais ou chinois en texte vertical ?
Oui. Choisissez japonais (vertical), chinois simplifié (vertical) ou chinois traditionnel (vertical). Pour du texte horizontal, utilisez l’option japonais ou chinois normale.
Pourquoi le résultat est-il vide ou plein d’erreurs ?
L’OCR a besoin d’un texte imprimé et net. Un scan en basse résolution, l’écriture manuscrite, des polices inhabituelles ou une mauvaise langue réduisent la précision. Vérifiez que la langue correspond au document et essayez un scan plus propre.
Outils associés
Références des formats
Page de l’outil mise à jour le :