Изображение в PDF с возможностью поиска
Превратите скан, скриншот или фото в PDF с поиском прямо в браузере с помощью OCR Tesseract.js и pdf-lib. Без загрузки файлов на сервер.
🔒 Работает полностью в вашем браузере — ничего не загружаетсяСделайте отсканированное изображение доступным для поиска
Фотографией или скриншотом документа легко поделиться, но искать в нём трудно. Слова являются частью картинки, поэтому PDF-просмотрщик не может найти в таком файле имя, номер счёта или абзац. Этот инструмент Изображение в PDF с возможностью поиска сохраняет ваше исходное изображение в качестве видимой страницы и добавляет в PDF текст OCR, чтобы просмотрщики могли искать и выделять распознанное содержимое. Он полезен для одностраничных сканов, чеков, писем, форм, фотографий досок и скриншотов, которые вы хотите архивировать как PDF.
Всё работает в браузере. Tesseract.js считывает загруженное изображение с помощью OCR на WebAssembly, а pdf-lib создаёт новый PDF-документ без обращения к серверу. Размер страницы соответствует изображению, поэтому PDF выглядит как исходный файл. Поверх изображения рисуется небольшой малозаметный текстовый слой, чтобы распознанные слова были доступны для поиска по PDF и инструментов выделения текста. Изображение, результат OCR и готовый PDF остаются в локальной памяти браузера, пока вы не скачаете файл.
Как получить более качественные PDF с поиском
Начните с самого чёткого изображения, которое у вас есть. Ровные сканы и чёткие скриншоты обычно работают лучше, чем снимки телефоном под углом. Если вы фотографируете бумагу, положите документ на ровную поверхность, используйте равномерное освещение и держите камеру параллельно странице. По возможности обрежьте стол, края и тени перед загрузкой. Высокий контраст между буквами и фоном помогает OCR разделять символы, особенно в мелком шрифте.
Перед созданием PDF выберите язык, соответствующий документу. При первом использовании языка браузер может загрузить движок OCR и модель, из-за чего первая задача выполнится медленнее; последующие обычно быстрее, так как файлы кэшируются. OCR несовершенен, поэтому найдите важные термины в готовом PDF и сравните их с исходным изображением, прежде чем использовать файл для учёта, договоров, счетов или других задач, требующих высокой точности.
Что содержит созданный PDF
Выходной PDF содержит одну страницу с исходным изображением в полном размере и выделяемым текстовым слоем, созданным с помощью OCR. Это делает файл удобным для личных архивов, приложений для заметок, папок с документами и вложений электронной почты, где PDF предпочтительнее изображения. Текстовый слой предназначен для поиска, а не для идеального визуального воспроизведения, поэтому сложные колонки, таблицы или рукописный текст могут не совпадать точно. Для многостраничных задач используйте инструменты OCR для PDF или пакетного OCR и при необходимости объедините файлы в отдельном PDF-редакторе.
Как использовать
- Добавьте изображениеПеретащите скан, скриншот или фото в область загрузки либо нажмите, чтобы выбрать файл.
- Выберите языкВыберите язык, который лучше всего соответствует тексту на изображении.
- Создайте PDFЗапустите OCR, встройте изображение на страницу PDF и добавьте текстовый слой для поиска.
- СкачайтеСохраните PDF с поиском прямо из браузера.