OCR par lot
Extrayez le texte de plusieurs images à la fois grâce à un OCR privé dans le navigateur. Traitez scans et captures en local, puis téléchargez le texte combiné.
🔒 S'exécute entièrement dans votre navigateur — rien n'est téléchargéOCR de plusieurs images dans un seul onglet du navigateur
L'OCR par lot fait gagner du temps lorsque vous avez plusieurs captures d'écran, pages numérisées, reçus ou photos dont vous voulez extraire du texte modifiable. Au lieu d'envoyer des fichiers à un serveur ou de traiter les images une par une à la main, vous sélectionnez un groupe et laissez cet outil les traiter à la suite dans votre navigateur. Chaque résultat s'affiche sur la page dès que l'image est terminée, et le téléchargement combiné conserve des en-têtes avec le nom de fichier, ce qui permet de retrouver facilement l'origine du texte extrait.
Le fonctionnement est privé par conception. Tesseract.js exécute la reconnaissance optique de caractères en local avec WebAssembly : les images restent sur votre appareil. Il n'y a ni file d'attente sur un serveur, ni compte, ni étape d'envoi. Le traitement séquentiel rend aussi l'état plus lisible : la barre de progression indique le fichier en cours et son pourcentage de reconnaissance, tandis que les fichiers terminés restent visibles en dessous. C'est un moyen pratique de gérer de petits lots du quotidien sans installer de logiciel d'OCR sur ordinateur.
Préparer les fichiers pour un lot plus propre
Pour de meilleurs résultats, regroupez des images dans la même langue et de qualité similaire. Des captures nettes et des scans bien droits donnent généralement un meilleur texte que des photos floues. Si ce sont des photos prises au téléphone, rognez l'arrière-plan, évitez les ombres et gardez la page bien en face de l'appareil photo. L'OCR peut avoir du mal avec l'écriture manuscrite, les tableaux, les polices décoratives et les textes très petits : vérifiez donc chaque résultat avant de vous y fier pour des documents importants.
Le premier fichier peut prendre plus de temps car le navigateur télécharge le moteur d'OCR et le modèle de la langue choisie. Ensuite, la suite du traitement et les visites futures sont généralement plus rapides, car le modèle est mis en cache. Les grandes images consomment plus de mémoire et de temps : réduisez donc les photos en très haute résolution si la vitesse compte plus que le détail. Gardez l'onglet ouvert pendant le traitement du lot et évitez de fermer le navigateur avant le téléchargement du fichier texte combiné.
Utiliser le texte OCR combiné
Une fois le lot terminé, téléchargez le fichier .txt combiné pour vos notes, archives, index de recherche ou une relecture manuelle. Chaque section commence par le nom du fichier d'origine, suivi du texte reconnu pour cette image. Ce format se colle facilement dans des documents, se découpe plus tard ou se compare aux images sources. Si un fichier donne un mauvais résultat, reprenez la photo ou le scan de cette seule image et relancez-la avec l'outil d'image unique. Pour les PDF numérisés, utilisez l'outil d'OCR de PDF afin que l'ordre et les séparateurs de pages soient gérés automatiquement.
Comment utiliser
- Ajoutez des imagesDéposez plusieurs captures, scans ou photos, ou cliquez pour parcourir.
- Choisissez la langueSélectionnez la langue d'OCR utilisée pour tous les fichiers du lot.
- Lancez l'OCR séquentielLe navigateur reconnaît une image à la fois et affiche la progression de chaque fichier.
- Téléchargez le texte combinéVérifiez chaque résultat, puis enregistrez un seul fichier .txt avec des en-têtes de noms de fichiers.