Image en texte (OCR)
Transformez une photo, une capture d'écran ou un scan en texte que vous pouvez copier et modifier — lu entièrement sur votre propre appareil, rien n'est téléversé.
Ce que l'OCR lit bien — et ce qu'il ne lira jamais
La reconnaissance de caractères, c'est de la reconnaissance de motifs, pas de la compréhension, donc le résultat suit l'entrée avec une franchise brutale. Une capture d'écran nette ou un scan plat et uniformément éclairé de texte imprimé en ressort presque parfait. Une photo prise au téléphone de la même page avec un léger angle, une ombre dans un coin, chute nettement — et l'écriture manuscrite, les polices décoratives, le texte sur des photos et les impressions à faible contraste (gris sur blanc, couleur sur couleur) peuvent ressortir à peine utilisables. Trois habitudes règlent l'essentiel du problème : photographier bien de face plutôt qu'en biais, remplir le cadre avec le texte et recadrer les alentours, et lorsque la source est déjà à l'écran, utiliser la capture d'écran d'origine plutôt que photographier votre moniteur. Chacune de ces étapes supprime une distorsion que le moteur de reconnaissance aurait sinon dû deviner.
Le téléchargement unique, et pourquoi il existe
La première fois que vous appuyez sur Lire le texte, votre navigateur télécharge le moteur de reconnaissance et ses données de langue anglaise — environ 7 MB, servis depuis ce site et mis en cache, si bien que les usages suivants démarrent en un instant. Ce téléchargement est le prix d'une vraie promesse : le moteur fonctionne entièrement sur votre propre appareil en WebAssembly, ce qui veut dire que la photo de votre contrat, de votre ordonnance ou de votre fiche de paie n'est jamais transmise nulle part. La plupart des services d'OCR en ligne fonctionnent à l'inverse — une page minuscule, et votre document téléversé sur leur serveur. Si le premier passage semble figé quelques secondes sur une connexion lente, c'est qu'il télécharge, pas qu'il est bloqué ; la ligne de progression vous indique dans quelle phase il se trouve. Après cette première visite, le moteur se charge depuis le cache, et la reconnaissance d'une page normale de texte prend quelques secondes, même sur un ordinateur portable modeste.
L'anglais uniquement, pour l'instant — et relisez toujours les chiffres
Cette première version lit le texte et les chiffres en anglais. D'autres langues sont prévues — chacune est un fichier de données entraînées supplémentaire, elles arriveront donc sous forme de téléchargements séparés plutôt qu'un gigantesque paquet unique — mais aujourd'hui, une lettre néerlandaise ou une facture turque ressortira brouillée dès que les mots cessent de ressembler à de l'anglais. Les chiffres méritent un avertissement à part : un 8 mal lu pour un 3 dans un IBAN, un numéro de téléphone ou un total de facture coûte bien plus cher qu'un mot mal lu, et les chiffres ne portent aucun contexte orthographique que le moteur pourrait utiliser pour se corriger. Quel que soit le texte, relisez le résultat une fois avant de vous y fier ; quels que soient les chiffres, vérifiez-les deux fois.
Le texte est sorti — maintenant, mettez-le quelque part d'utile
Copier le texte place le résultat dans votre presse-papiers, et de là il a généralement l'une de trois destinations. Directement dans un document ou un e-mail, c'est l'évidence — tout l'intérêt de l'OCR est de ne plus jamais retaper une page. Moins évident : collez-le dans /text-to-speech et la page devient de l'audio, ce qui transforme un article photographié en quelque chose que vous pouvez écouter en faisant autre chose. Et quand ce dont vous avez réellement besoin, c'est la page comme document partageable plutôt que du texte isolé, /image-to-pdf enveloppe la photo d'origine dans un vrai PDF — plus soigné à classer et à transmettre qu'une simple image, cet outil couvrant les moments où vous avez aussi besoin de ses mots.
Obtenir le meilleur résultat avec l'OCR
La reconnaissance de caractères fonctionne mieux sur des images nettes et bien éclairées, avec du texte foncé sur fond clair. Photographiez les documents bien de face plutôt que de biais, recadrez sur le texte si possible, et préférez une véritable capture d'écran à une photo d'écran. Actuellement, l'outil lit l'anglais et les chiffres ; d'autres langues sont prévues.
Mon image est-elle téléversée quelque part ?
Non — le moteur de reconnaissance fonctionne dans votre navigateur (WebAssembly). Votre image ne quitte jamais votre appareil, ce qui rend l'outil sûr même pour des documents que vous préféreriez ne pas partager avec un site web quelconque.
Pourquoi la première utilisation est-elle plus longue ?
Lors de la première utilisation, votre navigateur télécharge depuis ce site le moteur de lecture et ses données de langue anglaise (environ 7 MB). Ils sont ensuite mis en cache, ce qui rend les conversions suivantes bien plus rapides.
Pourquoi certains mots sont-ils incorrects ?
L'OCR reste une estimation, et le flou, l'écriture manuscrite, les polices décoratives ou un faible contraste réduisent sa précision. Relisez toujours le résultat — en particulier les chiffres.
