OCR d’un PDF scanné

Lisez les mots d’un PDF qui est en réalité une image de page. Vous obtenez le texte, et une copie interrogeable de l’original avec une couche de texte invisible par-dessus le scan — il a exactement la même allure et Ctrl-F trouve les choses. Vos fichiers ne sont jamais téléversés — tout se passe sur votre appareil.

  1. Your PDF

    Drop a scanned PDF here

    PDF

    Your files are never uploaded — everything runs on your device.

  2. Before you start

  3. Text

Comment faire l’OCR d’un PDF

  1. Ouvrez votre PDF scanné

    Glissez-le, ou cliquez pour le choisir. Le document est lu ici, dans le navigateur — rien n’est téléversé, ce qui compte plus que d’ordinaire pour le genre de paperasse que l’on scanne.

  2. Voyez ce que cela coûtera

    Avant que quoi que ce soit ne tourne, vous voyez le nombre de pages, le téléchargement unique du modèle et une fourchette de temps. Les pages qui contiennent déjà du texte sont sautées, et si toutes en ont, l’outil le dit au lieu de tourner.

  3. Lisez et téléchargez

    Prenez le texte brut, ou le PDF interrogeable. Il signale aussi les pages revenues vides plutôt que de laisser des trous en silence.

Ce que vous pouvez faire

Fusionner et diviser

Combinez plusieurs PDF en un seul, ou extrayez uniquement les pages dont vous avez besoin pour les télécharger dans un fichier séparé.

Images → PDF

Déposez des images JPG ou PNG et elles deviennent des pages PDF à organiser aux côtés de vos documents, puis téléchargez le tout en un seul PDF.

PDF → images

Exportez aussi dans l'autre sens : convertissez chaque page (ou une sélection) en PNG ou JPG et téléchargez le tout sous forme de fichier ZIP.

Réorganiser par glisser-déposer

Faites glisser une page par sa poignée pour la déplacer. Compatible avec la souris et le tactile, vous pouvez aussi réorganiser vos pages sur votre téléphone.

Pivoter et orienter automatiquement

Faites pivoter n'importe quelle page de 90° à la fois, ou laissez Auto-rotate détecter les numérisations inclinées ou inversées pour les redresser automatiquement.

Aperçu de chaque page

Cliquez sur une page pour afficher un aperçu net en plein écran et parcourir le document avant de le télécharger.

Supprimer et extraire

Supprimez les pages inutiles ou extrayez une plage en sélectionnant les pages souhaitées et en ne téléchargeant que cette sélection.

Compresser

Réduisez la taille d'un PDF : un enregistrement sans perte préservant le texte sélectionnable, ou une compression d'image plus forte pour les numérisations et les fichiers volumineux.

Privé et gratuit

Sans compte, sans limite de pages, sans filigrane. Vos fichiers ne sont jamais téléversés — chaque opération s'exécute localement dans votre navigateur.

Foire aux questions

Quel moteur d’OCR est-ce ?
Tesseract, compilé en WebAssembly et exécuté dans votre navigateur — le moteur derrière notre outil image-vers-texte. Le modèle pèse environ 5 Mo, se télécharge une fois puis reste en cache : le deuxième document ne coûte rien de plus.
Qu’est-ce qu’un PDF interrogeable ?
Votre scan, inchangé, avec les mots reconnus écrits par-dessus en texte invisible. Les pages ont exactement la même allure — nous ne les recalculons pas, donc les images, la compression et les signets survivent — mais Ctrl-F, le copier-coller et tout extracteur de texte trouvent désormais les mots.
Mon PDF a déjà du texte. Dois-je utiliser ceci ?
Non, et l’outil vous le dira. Si une page porte déjà du texte, ce texte est ce que le document dit vraiment ; la reconnaissance ne peut que deviner les mêmes mots d’après leurs formes, et en devinera certains de travers. Le texte existant est repris tel quel, et un document entièrement interrogeable part vers le convertisseur Markdown.
Le résultat est-il bon ?
Cela dépend presque entièrement du scan. Du texte noir net et droit sur blanc à 300 ppp donne d’excellents résultats ; une photo de téléphone d’un ticket froissé, non. Il n’y a pas d’étape de nettoyage d’image ici — ni redressement ni correction de contraste — donc il lit ce que vous lui donnez. La confiance moyenne et les pages vides sont signalées pour que vous jugiez au lieu de deviner.
Gère-t-il d’autres langues que l’anglais ?
Pas encore. Le modèle livré ici est l’anglais. Un document dans une autre langue produira quelque chose, et ce quelque chose sera faux de façons difficiles à repérer : traitez l’anglais comme une limite, pas comme une préférence.
Mes PDF sont-ils envoyés sur un serveur ?
Non. Chaque opération s'exécute entièrement dans votre navigateur sur votre propre appareil. Vos fichiers ne sont jamais téléversés nulle part, et rien n'est conservé une fois l'onglet fermé.
Est-ce vraiment gratuit ? Y a-t-il des limites ?
Oui, c'est totalement gratuit et sans création de compte. Il n'y a aucune limite de nombre de pages ou de fichiers, et aucun filigrane — comme le travail s'effectue sur votre appareil, nous n'avons rien à mesurer.