Menu
Tous les articles

Image en texte : extraire le texte de n'importe quelle photo gratuitement (OCR en ligne)

9 min de lectureGratuit · Sans inscription

Besoin de récupérer les mots d'une photo ? Qu'il s'agisse d'un ticket de caisse scanné, d'une photo de tableau blanc, d'une capture d'écran de document ou de la photo d'un panneau, l'OCR (reconnaissance optique de caractères) transforme les pixels d'une image en vrai texte que vous pouvez copier, modifier et rechercher. Ce guide explique comment utiliser l'outil gratuit OCR d'image de ce site. La reconnaissance s'exécute sur notre serveur : votre fichier est envoyé via une connexion chiffrée et supprimé dès que le texte a été extrait.


Qu'est-ce que l'OCR ?

OCR signifie reconnaissance optique de caractères. C'est la technologie qui analyse une image et identifie la forme des lettres, des chiffres et des signes de ponctuation pour produire du texte exploitable par une machine.

Les moteurs d'OCR modernes utilisent des réseaux de neurones entraînés sur des millions de caractères imprimés et manuscrits. Ils reconnaissent le texte dans un large éventail de polices, de tailles, de langues et de conditions d'image, même avec un angle modéré ou un peu de flou.

C'est grâce à l'OCR que :

  • les banques numérisent les chèques et les pièces d'identité
  • Google Search indexe le texte contenu dans les images
  • les services postaux lisent les adresses manuscrites sur les enveloppes
  • les archivistes rendent consultables des millions de livres scannés

La même technologie est disponible ici gratuitement.


Comment extraire le texte d'une image, étape par étape

L'outil OCR d'image exécute Tesseract OCR sur notre serveur. Votre image est envoyée via une connexion HTTPS chiffrée, le texte est extrait, puis le fichier envoyé est supprimé du serveur.

Étape 1 : ouvrez l'outil OCR d'image

Rendez-vous sur want2convert.com/image-to-text. Vous verrez une simple zone d'import et un sélecteur de langue.

Étape 2 : importez votre image

Glissez-déposez votre image dans la zone d'import ou cliquez pour la chercher sur votre appareil. Les formats pris en charge sont JPG, PNG, TIFF, BMP, WebP et PDF, jusqu'à 50 Mo. Pour les documents scannés, utilisez la résolution de scan la plus élevée possible : 300 DPI ou plus donne les meilleurs résultats.

Étape 3 : choisissez la langue (si nécessaire)

Par défaut, le moteur reconnaît l'anglais. L'outil prend aussi en charge le swahili (kiswahili), le français et l'arabe : choisissez dans la liste la langue du texte de votre image avant l'extraction. Utiliser le bon modèle de langue améliore nettement la précision pour les caractères accentués et les enchaînements de lettres propres à chaque langue. Les autres langues ne sont pas prises en charge pour le moment.

Étape 4 : cliquez sur « Extraire le texte »

Cliquez sur le bouton. Votre fichier est envoyé à notre serveur, où il est agrandi et converti en niveaux de gris pour améliorer la reconnaissance, puis lu par Tesseract. Le traitement prend généralement quelques secondes, selon la taille de l'image et la densité du texte ; les requêtes expirent au bout d'environ deux minutes.

Étape 5 : copiez ou téléchargez le résultat

Le texte extrait s'affiche dans une zone de texte. Vous pouvez :

  • Copier dans le presse-papiers — collez-le directement dans Word, Google Docs ou n'importe quel éditeur de texte
  • Télécharger .txt — enregistrez le résultat dans un fichier .txt

Ce qui fait une bonne image source pour l'OCR

La précision de l'OCR dépend fortement de la qualité de l'image d'origine. Voici ce qui compte le plus :

Résolution : Le texte a besoin d'assez de pixels pour être lisible. Les photos de documents prises au smartphone avec une bonne lumière et à une distance raisonnable (30–50 cm) donnent généralement de bons résultats. La résolution minimale pratique pour du petit texte net est d'environ 150–200 DPI ; 300 DPI est la norme OCR pour la numérisation d'archives.

Contraste : Du texte sombre sur fond clair offre au moteur le signal le plus net. Une encre pâle, un texte gris clair sur papier blanc ou un texte coloré sur un fond à motifs réduisent la précision.

Netteté : Les images floues, dues à un tremblement de l'appareil ou à un problème de mise au point, sont la première cause d'erreurs d'OCR. Posez votre appareil sur une surface stable pour photographier les documents. Les modes macro des smartphones conviennent bien aux documents en petits caractères.

Orientation : Un texte très incliné ou tourné réduit la précision. Le moteur gère une légère inclinaison (quelques degrés), mais les pages photographiées sous un angle prononcé donnent de moins bons résultats. Utilisez d'abord l'outil Pivoter une image pour remettre votre photo à l'endroit si besoin.

Bruit et ombres : Les plis, les ombres sur la page et les textures d'arrière-plan réduisent la précision. Photographiez les documents à plat sur un bureau de couleur claire, avec un éclairage uniforme.


Précision : ce que l'OCR peut et ne peut pas faire

L'OCR est très précis sur des documents imprimés propres et bien contrastés, avec souvent plus de 99 % de caractères corrects sur une bonne source. La technologie a toutefois de vraies limites à connaître :

| Type de source | Précision attendue | |------------|------------------| | Document imprimé scanné et propre (300 DPI) | 98–99 %+ | | Photo nette au smartphone d'un texte imprimé | 90–97 % | | Impression pâle ou peu contrastée | 70–85 % | | Écriture manuscrite (soignée et régulière) | 60–80 % | | Écriture manuscrite (cursive et irrégulière) | 40–65 % | | Polices très stylisées ou logos | 30–60 % | | Texte dans une image très bruitée ou à l'arrière-plan chargé | 50–75 % |

Pour du texte imprimé dans de bonnes conditions, attendez-vous à des résultats quasi parfaits. Relisez toujours le résultat : une seule erreur dans un nombre ou un nom peut avoir de vraies conséquences.


Usages courants de l'image en texte

Documents scannés et PDF

Les bureaux croulent encore sous le papier. Quand vous recevez un contrat, un formulaire ou un courrier scanné en PDF ou en image, l'OCR le transforme en document consultable et modifiable. Après l'extraction, collez le texte dans Word ou Google Docs pour le modifier, ou enregistrez-le dans un fichier où vous pourrez chercher avec Ctrl+F.

Tickets de caisse et factures

Photographier ses tickets de caisse est une habitude courante pour suivre ses dépenses. L'OCR extrait les lignes, les totaux et les noms des fournisseurs pour que vous puissiez les coller directement dans un tableur ou une note de frais sans tout retaper.

Cartes de visite

Une photo rapide d'une carte de visite au smartphone, passée à l'OCR, vous donne le nom, le poste, le numéro de téléphone, l'e-mail et l'entreprise du contact, prêts à être copiés dans votre application de contacts.

Captures d'écran d'articles et de pages web

Si vous devez citer une capture d'écran ou copier le texte d'un PDF composé d'images (un livre scanné, un PDF dont le texte n'est pas sélectionnable), l'OCR l'extrait sous forme de vrai texte utilisable.

Photos de tableau blanc

Après une réunion, les photos de notes sur tableau blanc dorment souvent dans la pellicule sans jamais servir. L'OCR les transforme en fichiers texte ou en notes consultables.

Numérisation de livres et d'archives

Les chercheurs et les généalogistes qui scannent de vieux livres, des journaux et des registres historiques utilisent l'OCR pour rendre ces archives consultables. Tesseract, le moteur open source utilisé ici, est très répandu dans les projets de numérisation d'archives.

Flux de traduction

Extrayez d'abord le texte d'une image, puis collez-le dans un outil de traduction. C'est bien plus rapide que de retaper à la main le texte d'une photo de document, de menu ou de panneau en langue étrangère.


OCR ou copier-coller : quand utiliser chacun

Si vous travaillez avec un PDF numérique contenant une couche de texte, Ctrl+A + Ctrl+C (tout sélectionner, copier) est plus rapide et plus précis que l'OCR. Utilisez l'OCR quand :

  • le PDF est une image scannée (pas de couche de texte)
  • la source est une photo ou une capture d'écran
  • le document ne permet pas de sélectionner le texte (PDF verrouillés, même si vous voudrez peut-être aussi le déverrouiller d'abord)
  • le texte se trouve sur un document papier, un panneau ou un tableau blanc

Questions fréquentes

L'outil d'OCR est-il vraiment gratuit ?
Oui, entièrement gratuit. Pas de compte, pas d'abonnement, pas de filigrane sur le résultat.

Mes images sont-elles en sécurité ?
Votre image ou votre PDF est envoyé à notre serveur via une connexion chiffrée (HTTPS), traité là-bas avec Tesseract OCR, puis supprimé dès que le texte a été extrait. Nous ne conservons aucune copie et aucun compte n'est nécessaire. Le fichier étant traité sur un serveur, évitez d'envoyer des documents que vous ne voudriez pas transmettre sur internet.

Quelles langues sont prises en charge ?
L'anglais est la langue par défaut. Vous pouvez aussi choisir le swahili (kiswahili), le français ou l'arabe dans le sélecteur de langue. Les autres langues ne sont pas prises en charge pour le moment.

Quelle est sa précision ?
Pour du texte imprimé propre à une résolution suffisante, la précision est généralement très élevée. Pour l'écriture manuscrite ou des images de mauvaise qualité, elle est plus faible. Relisez toujours le résultat pour les documents importants.

Peut-il lire l'écriture manuscrite ?
L'OCR reconnaît l'écriture manuscrite de façon limitée. Il fonctionne mieux avec du texte imprimé, et les notes manuscrites peuvent donner de mauvais résultats, surtout en écriture cursive.

Quelle est la taille maximale d'image ?
Les envois sont limités à 50 Mo et les requêtes expirent au bout d'environ deux minutes. Les très grandes images peuvent être lentes ; les réduire à 2000–3000 pixels de large avec l'outil Redimensionner une image avant l'OCR accélère souvent le traitement sans nuire à la précision.

Puis-je extraire le texte d'un PDF ?
Oui, vous pouvez envoyer directement un PDF ; ses pages sont affichées et lues une à une. Si un PDF est volumineux ou si vous voulez plus de contrôle, vous pouvez aussi enregistrer d'abord les pages en JPG ou PNG avec l'outil PDF en JPG puis lancer l'OCR sur les images.

Pourquoi certains caractères sont-ils faux ?
Les erreurs d'OCR viennent le plus souvent d'une faible résolution, d'un flou, d'un faible contraste ou de polices inhabituelles. Essayez d'améliorer la qualité de l'image source et relancez. Pour les erreurs systématiques (par exemple un l lu comme un 1), corrigez le résultat à la main après l'extraction.


Outils associés

  • Redimensionner une image — agrandissez une petite image avant l'OCR pour améliorer la précision
  • Pivoter une image — redressez une photo penchée avant l'OCR
  • PDF en JPG — convertissez des pages de PDF scannées en images pour l'OCR
  • Compresser une image — réduisez le poids de l'image sans perdre la résolution dont l'OCR a besoin
  • JPG en PNG — convertissez en PNG pour une qualité sans perte avant l'OCR sur des documents en petits caractères
  • Rogner une image — isolez la zone de texte d'une photo avant de lancer l'OCR

Essayez gratuitement — sans inscription

La plupart des outils s'exécutent dans votre navigateur : vos fichiers restent sur votre appareil. Quelques-uns envoient le fichier à notre serveur, qui le supprime ensuite.

Parcourir tous les outils