OT OCR Tools

Изображение в PDF с возможностью поиска

Превратите скан, скриншот или фото в PDF с поиском прямо в браузере с помощью OCR Tesseract.js и pdf-lib. Без загрузки файлов на сервер.

🔒 Работает полностью в вашем браузере — ничего не загружается

Drop one image here or click to browse

The visible image and OCR text layer are assembled locally.

Choose an image to begin.

0%

Advertisement

Сделайте отсканированное изображение доступным для поиска

Фотографией или скриншотом документа легко поделиться, но искать в нём трудно. Слова являются частью картинки, поэтому PDF-просмотрщик не может найти в таком файле имя, номер счёта или абзац. Этот инструмент Изображение в PDF с возможностью поиска сохраняет ваше исходное изображение в качестве видимой страницы и добавляет в PDF текст OCR, чтобы просмотрщики могли искать и выделять распознанное содержимое. Он полезен для одностраничных сканов, чеков, писем, форм, фотографий досок и скриншотов, которые вы хотите архивировать как PDF.

Всё работает в браузере. Tesseract.js считывает загруженное изображение с помощью OCR на WebAssembly, а pdf-lib создаёт новый PDF-документ без обращения к серверу. Размер страницы соответствует изображению, поэтому PDF выглядит как исходный файл. Поверх изображения рисуется небольшой малозаметный текстовый слой, чтобы распознанные слова были доступны для поиска по PDF и инструментов выделения текста. Изображение, результат OCR и готовый PDF остаются в локальной памяти браузера, пока вы не скачаете файл.

Как получить более качественные PDF с поиском

Начните с самого чёткого изображения, которое у вас есть. Ровные сканы и чёткие скриншоты обычно работают лучше, чем снимки телефоном под углом. Если вы фотографируете бумагу, положите документ на ровную поверхность, используйте равномерное освещение и держите камеру параллельно странице. По возможности обрежьте стол, края и тени перед загрузкой. Высокий контраст между буквами и фоном помогает OCR разделять символы, особенно в мелком шрифте.

Перед созданием PDF выберите язык, соответствующий документу. При первом использовании языка браузер может загрузить движок OCR и модель, из-за чего первая задача выполнится медленнее; последующие обычно быстрее, так как файлы кэшируются. OCR несовершенен, поэтому найдите важные термины в готовом PDF и сравните их с исходным изображением, прежде чем использовать файл для учёта, договоров, счетов или других задач, требующих высокой точности.

Что содержит созданный PDF

Выходной PDF содержит одну страницу с исходным изображением в полном размере и выделяемым текстовым слоем, созданным с помощью OCR. Это делает файл удобным для личных архивов, приложений для заметок, папок с документами и вложений электронной почты, где PDF предпочтительнее изображения. Текстовый слой предназначен для поиска, а не для идеального визуального воспроизведения, поэтому сложные колонки, таблицы или рукописный текст могут не совпадать точно. Для многостраничных задач используйте инструменты OCR для PDF или пакетного OCR и при необходимости объедините файлы в отдельном PDF-редакторе.

Как использовать

  1. Добавьте изображениеПеретащите скан, скриншот или фото в область загрузки либо нажмите, чтобы выбрать файл.
  2. Выберите языкВыберите язык, который лучше всего соответствует тексту на изображении.
  3. Создайте PDFЗапустите OCR, встройте изображение на страницу PDF и добавьте текстовый слой для поиска.
  4. СкачайтеСохраните PDF с поиском прямо из браузера.

Часто задаваемые вопросы

Загружается ли моё изображение для создания PDF?
Нет. OCR выполняется локально с помощью Tesseract.js, а pdf-lib создаёт PDF в вашем браузере. Изображение и PDF с поиском остаются на вашем устройстве.
Почему первый PDF с поиском создаётся медленнее?
При первом запуске загружаются движок OCR и выбранная языковая модель. Браузер обычно кэширует их, поэтому последующие запуски быстрее.
Будет ли текст идеально совпадать с изображением?
PDF сохраняет исходное изображение в качестве видимой страницы и добавляет небольшой малозаметный текстовый слой для поиска и выделения. Это не OCR-редактор с идеальной вёрсткой.
Какие форматы изображений поддерживаются?
Используйте распространённые форматы изображений для браузера, такие как PNG, JPG, WebP, или скриншоты. Инструмент локально преобразует изображение в страницу PDF.
Advertisement