OCR avancé

OCR pleine page · PDF consultable · Sortie multiple · Traitement par lots. Directement dans votre navigateur. 100 % gratuit, confidentialité protégée.

L'OCR lit le texte des pages numérisées et des photographies et le transforme en texte réel et sélectionnable. Appliquez-le sur un contrat numérisé ou une page photographiée, et vous obtenez un PDF consultable qui semble identique mais qui possède une couche de texte en dessous, de sorte que Ctrl+F fonctionne, le texte peut être copié et d'autres outils peuvent l'extraire. Le résultat peut également être du texte brut ou un document structuré. La reconnaissance utilise Tesseract compilé en WebAssembly et s'exécute entièrement dans votre navigateur, ce qui est inhabituel pour l'OCR — la plupart des services nécessitent le téléversement du document — et elle prend en charge un large éventail de langues, y compris les écritures non latines.

  1. Télécharger — Faites glisser et déposez vos fichiers dans la zone de téléchargement, ou cliquez pour parcourir et sélectionner des fichiers depuis votre appareil.
  2. Configurer — OCR pleine page · PDF consultable · Sortie multiple · Traitement par lots
  3. Télécharger — Cliquez sur le bouton de téléchargement pour enregistrer votre fichier traité. Il est prêt instantanément !

Foire aux questions

Quelles langues sont prises en charge ?

Un large éventail incluant l'anglais, le coréen, le japonais, le chinois et les principales langues européennes, ainsi que les écritures non latines. La sélection de la bonne langue avant l'exécution améliore considérablement la précision.

Quelle est sa précision ?

Sur un scan propre de 300 DPI de texte imprimé, la précision est élevée. Elle se dégrade avec une faible résolution, une inclinaison, des ombres, un mauvais contraste et l'écriture manuscrite — l'écriture manuscrite en particulier n'est pas reconnue de manière fiable.

Mon document est-il téléversé sur un serveur OCR ?

Non. La reconnaissance s'exécute dans votre navigateur via WebAssembly. Le fichier ne quitte jamais votre appareil, ce qui est la principale raison d'utiliser ceci plutôt qu'un service OCR dans le cloud pour les documents sensibles.

Comment obtenir les meilleurs résultats ?

Numérisez à 300 DPI, maintenez la page droite, évitez les ombres et choisissez la bonne langue. Le redressement et l'ajustement du contraste avant la reconnaissance aident également de manière significative.

Optimiser