OT OCR Tools

OCR par lot

Extrayez le texte de plusieurs images à la fois grâce à un OCR privé dans le navigateur. Traitez scans et captures en local, puis téléchargez le texte combiné.

🔒 S'exécute entièrement dans votre navigateur — rien n'est téléchargé

Drop multiple images here or click to browse

Images are OCRed one at a time in this browser tab.

Choose images to begin.

0%

Advertisement

OCR de plusieurs images dans un seul onglet du navigateur

L'OCR par lot fait gagner du temps lorsque vous avez plusieurs captures d'écran, pages numérisées, reçus ou photos dont vous voulez extraire du texte modifiable. Au lieu d'envoyer des fichiers à un serveur ou de traiter les images une par une à la main, vous sélectionnez un groupe et laissez cet outil les traiter à la suite dans votre navigateur. Chaque résultat s'affiche sur la page dès que l'image est terminée, et le téléchargement combiné conserve des en-têtes avec le nom de fichier, ce qui permet de retrouver facilement l'origine du texte extrait.

Le fonctionnement est privé par conception. Tesseract.js exécute la reconnaissance optique de caractères en local avec WebAssembly : les images restent sur votre appareil. Il n'y a ni file d'attente sur un serveur, ni compte, ni étape d'envoi. Le traitement séquentiel rend aussi l'état plus lisible : la barre de progression indique le fichier en cours et son pourcentage de reconnaissance, tandis que les fichiers terminés restent visibles en dessous. C'est un moyen pratique de gérer de petits lots du quotidien sans installer de logiciel d'OCR sur ordinateur.

Préparer les fichiers pour un lot plus propre

Pour de meilleurs résultats, regroupez des images dans la même langue et de qualité similaire. Des captures nettes et des scans bien droits donnent généralement un meilleur texte que des photos floues. Si ce sont des photos prises au téléphone, rognez l'arrière-plan, évitez les ombres et gardez la page bien en face de l'appareil photo. L'OCR peut avoir du mal avec l'écriture manuscrite, les tableaux, les polices décoratives et les textes très petits : vérifiez donc chaque résultat avant de vous y fier pour des documents importants.

Le premier fichier peut prendre plus de temps car le navigateur télécharge le moteur d'OCR et le modèle de la langue choisie. Ensuite, la suite du traitement et les visites futures sont généralement plus rapides, car le modèle est mis en cache. Les grandes images consomment plus de mémoire et de temps : réduisez donc les photos en très haute résolution si la vitesse compte plus que le détail. Gardez l'onglet ouvert pendant le traitement du lot et évitez de fermer le navigateur avant le téléchargement du fichier texte combiné.

Utiliser le texte OCR combiné

Une fois le lot terminé, téléchargez le fichier .txt combiné pour vos notes, archives, index de recherche ou une relecture manuelle. Chaque section commence par le nom du fichier d'origine, suivi du texte reconnu pour cette image. Ce format se colle facilement dans des documents, se découpe plus tard ou se compare aux images sources. Si un fichier donne un mauvais résultat, reprenez la photo ou le scan de cette seule image et relancez-la avec l'outil d'image unique. Pour les PDF numérisés, utilisez l'outil d'OCR de PDF afin que l'ordre et les séparateurs de pages soient gérés automatiquement.

Comment utiliser

  1. Ajoutez des imagesDéposez plusieurs captures, scans ou photos, ou cliquez pour parcourir.
  2. Choisissez la langueSélectionnez la langue d'OCR utilisée pour tous les fichiers du lot.
  3. Lancez l'OCR séquentielLe navigateur reconnaît une image à la fois et affiche la progression de chaque fichier.
  4. Téléchargez le texte combinéVérifiez chaque résultat, puis enregistrez un seul fichier .txt avec des en-têtes de noms de fichiers.

Questions fréquemment posées

Les images de l'OCR par lot sont-elles envoyées sur un serveur ?
Non. Chaque image est traitée localement dans votre navigateur avec Tesseract.js. Les fichiers et le texte extrait ne sont pas envoyés.
Pourquoi le premier fichier prend-il plus de temps ?
Le premier OCR télécharge le moteur et le modèle de la langue choisie. Les navigateurs mettent généralement ces fichiers en cache : les fichiers suivants et les utilisations futures sont donc plus rapides.
Puis-je faire l'OCR de nombreuses images à la fois ?
Oui, mais l'outil les traite l'une après l'autre pour garder une progression claire et limiter la charge du navigateur. Les très gros lots peuvent prendre du temps.
Comment le texte combiné est-il organisé ?
Le téléchargement .txt combiné inclut un en-tête avec le nom de fichier avant le résultat de chaque image, afin de retrouver le fichier source du texte.
Advertisement