RectoPDF
Français
· RectoPDF team

L'OCR qui reste sur votre appareil : transformez vos scans en documents éditables — et modifiez même le scan lui-même

La plupart des outils OCR envoient votre scan sur un serveur et vous rendent un bloc de texte brut. Voici comment l'OCR sur appareil extrait le texte d'un PDF scanné ou d'une photo, vous laisse le corriger, et peut même réécrire le texte directement sur le scan d'origine — logos, tampons et mise en page intacts.

Un document scanné est un objet étrange : il ressemble à du texte, mais pour votre ordinateur ce n’est qu’une photo. Impossible de sélectionner une phrase, de chercher un nom ou de corriger une faute. L’OCR (reconnaissance optique de caractères) est le pont du retour — et la plupart des outils OCR en ligne se trompent sur deux points : ils vous font téléverser le document sur le serveur de quelqu’un d’autre, et ils vous rendent du texte nu, sans rien du document autour.

Notre outil OCR corrige les deux. La reconnaissance s’exécute entièrement dans votre navigateur — le scan ne quitte jamais votre appareil — et le résultat ne se limite pas au texte : vous pouvez récupérer un fichier Word, une feuille Excel, un PDF cherchable, ou l’option la plus intéressante de toutes : le même scan avec le texte remplacé sur place.

Ce qu’il sait lire

Déposez un PDF scanné (le multi-pages est pris en charge) ou une photo — PNG, JPG ou WebP. L’outil prend en charge :

  • Les langues à écriture latine — français, anglais et compagnie. Très précis sur des scans imprimés propres.
  • Les langues à écriture arabe — arabe, persan, ourdou. Gestion complète du droite-à-gauche, avec les lettres correctement liées.
  • Le mode Auto — pas sûr, ou contenu mixte ? Laissez le script sur Auto et l’outil détecte page par page.

Chaque ligne reconnue revient avec sa position et son indice de confiance, et le texte s’ouvre dans un éditeur pour corriger les erreurs de lecture avant l’export. Vos corrections se répercutent dans tous les formats de sortie.

Le clou : modifier le scan lui-même

L’OCR classique extrait le texte du document. Le nôtre peut aussi remettre votre texte dedans.

Choisissez PDF (remplacer le texte sur place) et l’outil efface le texte imprimé d’origine du scan — en reconstruisant le fond du papier derrière — puis redessine votre texte (éventuellement corrigé) dans une police, une taille et une couleur d’encre assorties, exactement là où se trouvait l’ancien. Logos, tampons, signatures, tableaux et l’aspect général de la page sont préservés. Corrigez une date erronée sur un formulaire scanné, rectifiez un nom : le résultat ressemble toujours au document d’origine — pas à une capture d’écran avec un rectangle blanc collé dessus.

Deux qualités de nettoyage sont proposées : Rapide pour les travaux courants, et Haute qualité pour une reconstruction de fond plus fine sur du papier texturé ou coloré (elle charge un moteur plus gros et prend un peu plus de temps).

Six façons d’exporter

FormatCe que vous obtenez
PDF — remplacement sur placeLe scan d’origine avec le texte effacé puis redessiné (modifiable avant export).
PDF cherchableLe scan intact avec une couche de texte invisible — identique à l’œil, mais Ctrl-F fonctionne et le texte se sélectionne.
Word (.docx)Le texte reconnu dans un vrai document éditable.
Excel (.xlsx)Le contenu des lignes disposé dans un tableur.
PowerPoint (.pptx)Le texte positionné sur des diapositives, à l’image de la page.
Texte (.txt)Juste les mots, à coller n’importe où.

Privé par conception

C’est encore plus important pour les scans qu’ailleurs — ce qu’on passe à l’OCR, ce sont des contrats, des pièces d’identité, des résultats médicaux, des factures. Avec cet outil, rien n’est téléversé. Les modèles de reconnaissance sont téléchargés une fois dans votre navigateur et s’exécutent sur votre appareil ; l’image, le texte et les exports ne touchent jamais un serveur. Ça continue même de fonctionner hors ligne une fois la page chargée.

Comment l’utiliser

  1. Ouvrez l’outil OCR et déposez un PDF scanné ou une image.
  2. Choisissez le script — latin, arabe, ou laissez sur Auto.
  3. Appuyez sur Extraire le texte. Chaque page est lue sur votre appareil.
  4. Relisez le résultat dans l’éditeur et corrigez ce que la reconnaissance a mal lu.
  5. Choisissez un format de sortie et téléchargez.

Les limites, honnêtement

Sur des scans imprimés nets, la précision est très élevée pour les écritures latines et bonne pour l’arabe. Les cas difficiles : photos de basse résolution ou de travers, écriture manuscrite, et calligraphie décorative (les styles nastaʿlīq en particulier). C’est exactement pour ça que l’éditeur est dans la boucle — survolez le résultat, corrigez le mot qui cloche, exportez.

Essayez sur un vrai scan — OCR. Comme rien ne quitte votre navigateur, vous ne prenez aucun risque à le tester sur un document confidentiel.