Extraire le texte d'une photo ou d'une image (OCR)

Une photo de page de livre, une capture d'écran contenant du texte, un panneau photographié en voyage : cet outil transforme n'importe quelle image contenant du texte imprimé en texte réellement exploitable — copiable dans un e-mail, modifiable dans un traitement de texte, ou cherchable dans un lecteur PDF. Sept langues sont prises en charge, dont le yoruba, un différenciateur rare parmi les outils d'OCR gratuits.

Ce qui se passe entre l'envoi de la photo et le résultat

Avant toute reconnaissance de caractères, l'image traverse plusieurs étapes de préparation automatique, invisibles pour vous mais déterminantes pour la qualité du résultat. L'inclinaison du texte est mesurée puis corrigée : une photo prise légèrement de travers, ce qui arrive presque systématiquement à main levée, est redressée avant d'aller plus loin. Si la page entière est à l'envers ou tournée d'un quart de tour — une erreur fréquente en photographiant un livre — l'outil la détecte et la remet dans le bon sens. L'image est ensuite convertie en niveaux de gris, légèrement débruitée, puis seuillée pour séparer nettement le texte de son arrière-plan. Si les caractères paraissent trop petits pour une reconnaissance fiable, l'image est agrandie automatiquement avant la dernière étape.

Pourquoi la qualité de la photo compte plus que le moteur

La reconnaissance optique de caractères a énormément progressé ces dernières années, mais elle reste fondamentalement limitée par ce qu'elle reçoit en entrée : un moteur, aussi performant soit-il, ne peut pas deviner une lettre totalement floue ou noyée dans un reflet. C'est pourquoi cet outil affiche, après traitement, un score de confiance moyen plutôt que de prétendre à une fiabilité universelle. En dessous de 60 %, un message concret vous oriente vers les corrections les plus utiles : reprendre la photo bien à plat (un livre ouvert en angle déforme les lignes de texte vers les bords), avec un éclairage de face plutôt que rasant (pour éviter les ombres portées sur la page), sans flou de bougé (privilégier une prise d'appui ou une luminosité suffisante pour un temps de pose court).

Trois résultats pour trois usages

Le texte brut s'affiche directement dans une zone que vous pouvez copier en un clic — le plus rapide pour récupérer une citation ou un court passage. Le document Word reconstitue un paragraphe par bloc de texte détecté, prêt à être réédité ou complété. Le PDF cherchable, lui, conserve l'apparence exacte de votre photo d'origine tout en superposant une couche de texte invisible : idéal pour archiver un document en gardant la possibilité de le rechercher par mot-clé plus tard, sans perdre son aspect visuel original (cachet, signature, mise en page).

Limites à connaître

Cet outil reconnaît du texte imprimé dans une mise en page relativement simple : paragraphes, titres, listes. Un tableau complexe avec de nombreuses colonnes, une écriture manuscrite, ou une police très stylisée (calligraphie, texte artistique) donneront un résultat partiel ou incorrect. Une image de plus de 50 mégapixels est refusée pour des raisons de temps de traitement ; dans ce cas, réduisez d'abord sa taille avec l'outil de redimensionnement d'image.

Domande frequenti

Ma photo est légèrement de travers, est-ce grave ?
Non : l'outil détecte automatiquement l'inclinaison du texte et la corrige avant la reconnaissance, dans une certaine mesure. Une photo prise à main levée avec quelques degrés d'inclinaison ne pose généralement aucun problème ; un angle de prise de vue trop prononcé (photo prise très de biais plutôt que de face) reste en revanche difficile à corriger automatiquement.
Pourquoi le résultat est-il parfois de mauvaise qualité ?
La qualité de la reconnaissance dépend presque entièrement de l'image de départ : un texte flou, une photo prise dans la pénombre, un reflet sur la page ou une résolution trop faible dégradent fortement le résultat, quel que soit le moteur de reconnaissance utilisé. Un score de confiance moyen est affiché après traitement ; en dessous de 60 %, l'outil vous invite à reprendre la photo dans de meilleures conditions.
Puis-je combiner plusieurs langues, par exemple français et anglais ?
Oui : cochez toutes les langues présentes dans votre document avant de lancer la reconnaissance. Le moteur les utilise simultanément, ce qui améliore la précision sur un document bilingue par rapport à ne déclarer qu'une seule langue.
L'écriture manuscrite est-elle reconnue ?
Non, ou très mal : cet outil est conçu pour du texte imprimé (livre, document administratif, capture d'écran, panneau). L'écriture manuscrite suit des règles de reconnaissance très différentes, que ce moteur ne couvre pas.
Que se passe-t-il si ma photo contient un tableau ?
Le texte est extrait cellule par cellule dans l'ordre de lecture détecté par le moteur, mais la mise en forme du tableau (colonnes alignées, bordures) n'est pas reconstituée : pour un tableau complexe, le résultat en Word demandera une remise en forme manuelle.
Mes photos sont-elles conservées après le traitement ?
Non : le fichier envoyé et les documents générés sont supprimés automatiquement 30 minutes après le traitement, jamais journalisés ni réutilisés. Vous pouvez aussi cliquer sur "Supprimer maintenant" dès que vous avez récupéré votre résultat.
Pourquoi ne puis-je pas choisir une langue absente de la liste ?
Seules les langues dont les données de reconnaissance sont réellement installées sur le serveur sont proposées : mieux vaut une liste plus courte que fiable qu'une option qui échouerait silencieusement.