Extraire le texte d'une photo ou d'une image (OCR)
Une photo de page de livre, une capture d'écran contenant du texte, un panneau photographié en voyage : cet outil transforme n'importe quelle image contenant du texte imprimé en texte réellement exploitable — copiable dans un e-mail, modifiable dans un traitement de texte, ou cherchable dans un lecteur PDF. Sept langues sont prises en charge, dont le yoruba, un différenciateur rare parmi les outils d'OCR gratuits.
Ce qui se passe entre l'envoi de la photo et le résultat
Avant toute reconnaissance de caractères, l'image traverse plusieurs étapes de préparation automatique, invisibles pour vous mais déterminantes pour la qualité du résultat. L'inclinaison du texte est mesurée puis corrigée : une photo prise légèrement de travers, ce qui arrive presque systématiquement à main levée, est redressée avant d'aller plus loin. Si la page entière est à l'envers ou tournée d'un quart de tour — une erreur fréquente en photographiant un livre — l'outil la détecte et la remet dans le bon sens. L'image est ensuite convertie en niveaux de gris, légèrement débruitée, puis seuillée pour séparer nettement le texte de son arrière-plan. Si les caractères paraissent trop petits pour une reconnaissance fiable, l'image est agrandie automatiquement avant la dernière étape.
Pourquoi la qualité de la photo compte plus que le moteur
La reconnaissance optique de caractères a énormément progressé ces dernières années, mais elle reste fondamentalement limitée par ce qu'elle reçoit en entrée : un moteur, aussi performant soit-il, ne peut pas deviner une lettre totalement floue ou noyée dans un reflet. C'est pourquoi cet outil affiche, après traitement, un score de confiance moyen plutôt que de prétendre à une fiabilité universelle. En dessous de 60 %, un message concret vous oriente vers les corrections les plus utiles : reprendre la photo bien à plat (un livre ouvert en angle déforme les lignes de texte vers les bords), avec un éclairage de face plutôt que rasant (pour éviter les ombres portées sur la page), sans flou de bougé (privilégier une prise d'appui ou une luminosité suffisante pour un temps de pose court).
Trois résultats pour trois usages
Le texte brut s'affiche directement dans une zone que vous pouvez copier en un clic — le plus rapide pour récupérer une citation ou un court passage. Le document Word reconstitue un paragraphe par bloc de texte détecté, prêt à être réédité ou complété. Le PDF cherchable, lui, conserve l'apparence exacte de votre photo d'origine tout en superposant une couche de texte invisible : idéal pour archiver un document en gardant la possibilité de le rechercher par mot-clé plus tard, sans perdre son aspect visuel original (cachet, signature, mise en page).
Limites à connaître
Cet outil reconnaît du texte imprimé dans une mise en page relativement simple : paragraphes, titres, listes. Un tableau complexe avec de nombreuses colonnes, une écriture manuscrite, ou une police très stylisée (calligraphie, texte artistique) donneront un résultat partiel ou incorrect. Une image de plus de 50 mégapixels est refusée pour des raisons de temps de traitement ; dans ce cas, réduisez d'abord sa taille avec l'outil de redimensionnement d'image.