Récupérez le texte des photos et captures d'écran. Le français et l'anglais sont lus ensemble, et chaque ligne porte son propre indice de confiance.
Comment faire
- Téléversez des images contenant du texte. Plusieurs à la fois, sans problème.
- Choisissez la langue. Pour un document sans anglais, la langue seule fait moins d'erreurs.
- Appuyez sur « Lire le texte ». Le premier lancement prend quelques secondes de plus pour charger le modèle.
- Copiez le résultat ou téléchargez-le en .txt. Les lignes affichées en pâle ont un score faible : vérifiez-les.
Mon image est-elle téléversée ?
Non. Le moteur de reconnaissance et les données de langue sont chargés dans votre navigateur et tout se passe sur votre appareil. Cartes de visite, pièces d'identité et contrats peuvent donc y passer sans risque.
Pourquoi le premier lancement est-il lent ?
Il télécharge une seule fois le moteur (environ 2,7 Mo) et les données de langue. Ensuite, tout reste dans le cache du navigateur et la reconnaissance démarre immédiatement.
Lit-il l'écriture manuscrite ?
À peine. Le moteur est entraîné sur des caractères imprimés ; la précision chute fortement sur du manuscrit. Utilisez-le pour l'imprimé, les captures d'écran et la signalétique.
Comment améliorer la précision ?
Des caractères plus grands et plus nets aident le plus. Redressez d'abord une photo penchée avec l'outil de recadrage. Si la résolution est très faible, reprendre la photo vaut mieux qu'agrandir. Limiter la langue à ce que contient réellement le document change aussi les choses.
Une seule langue est-elle toujours plus précise ?
Non. C'est mieux pour un document purement monolingue, mais cela se dégrade dès qu'un autre alphabet apparaît. Sur la même image de test, le réglage mixte a lu correctement l'adresse e-mail mais s'est trompé sur un mot, et le réglage à une langue exactement l'inverse. Alignez le réglage sur le contenu réel.
La mise en forme des tableaux est-elle conservée ?
Non. Seul le texte est extrait, ligne par ligne. La structure des tableaux, les polices et les couleurs ne sont pas reprises.
Puis-je extraire le texte d'un PDF ?
Téléverser un PDF convertit sa première page en image et la lit. Si le PDF contient déjà du vrai texte, le copier depuis un lecteur PDF est plus fiable. L'OCR est fait pour les scans, où le texte n'existe que sous forme d'image.