Пакетное OCR
Извлекайте текст из нескольких изображений сразу с помощью приватного OCR в браузере. Обрабатывайте сканы и скриншоты локально и скачайте объединённый текст.
🔒 Работает полностью в вашем браузере — ничего не загружаетсяOCR нескольких изображений в одной вкладке браузера
Пакетное OCR экономит время, когда у вас есть несколько скриншотов, отсканированных страниц, чеков или фото, из которых нужен редактируемый текст. Вместо загрузки файлов на сервер или ручной обработки по одному изображению вы выбираете группу, а этот инструмент последовательно обрабатывает их в вашем браузере. Каждый результат появляется на странице сразу после завершения изображения, а объединённая загрузка сохраняет заголовки с именами файлов, так что извлечённый текст легко сопоставить с оригиналом.
Рабочий процесс изначально приватный. Tesseract.js выполняет оптическое распознавание символов локально с помощью WebAssembly, поэтому изображения остаются на вашем устройстве. Нет очереди на бэкенде, учётной записи или шага загрузки. Последовательная обработка также делает статус понятнее: индикатор прогресса показывает текущий файл и процент его распознавания, а завершённые файлы остаются видны ниже. Это практичный способ обрабатывать небольшие повседневные пакеты без установки настольного OCR-программного обеспечения.
Подготовка файлов для более чистого результата
Для лучших результатов группируйте изображения на одном языке и схожего качества. Чёткие скриншоты и ровные сканы обычно дают более качественный текст, чем размытые фото. Если изображения — снимки с телефона, обрежьте фон, избегайте теней и держите страницу параллельно камере. OCR может испытывать трудности с рукописным текстом, таблицами, декоративными шрифтами и очень мелким текстом, поэтому проверяйте каждый результат, прежде чем полагаться на него в важных документах.
Первый файл может обрабатываться дольше, поскольку браузер загружает движок OCR и выбранную языковую модель. После этого тот же запуск и будущие визиты обычно быстрее, так как модель кэшируется. Большие изображения потребляют больше памяти и времени, поэтому уменьшайте фото сверхвысокого разрешения, если скорость важнее детализации. Не закрывайте вкладку, пока выполняется пакет, и не закрывайте браузер, пока объединённый текстовый файл не будет скачан.
Использование объединённого текста OCR
Когда пакет завершён, скачайте объединённый файл .txt для заметок, архивов, поисковых индексов или ручной проверки. Каждый раздел начинается с исходного имени файла, за которым следует распознанный текст этого изображения. Такой формат легко вставить в документы, позже разделить или сравнить с исходными изображениями. Если один файл дал плохой результат, переснимите или пересканируйте только это изображение и запустите его снова в инструменте для одиночных изображений. Для отсканированных PDF используйте инструмент OCR для PDF, чтобы порядок страниц и разделители страниц обрабатывались автоматически.
Как использовать
- Добавьте изображенияПеретащите несколько скриншотов, сканов или фото либо нажмите, чтобы выбрать файлы.
- Выберите языкВыберите язык OCR, который будет использоваться для всех файлов пакета.
- Запустите последовательное OCRБраузер распознаёт по одному изображению и показывает прогресс для каждого файла.
- Скачайте объединённый текстПросмотрите каждый результат, затем сохраните один файл .txt с заголовками имён файлов.