OT OCR Tools

Imagen a PDF con texto buscable

Convierte un escaneo, una captura o una foto en un PDF con texto buscable en tu navegador con OCR Tesseract.js y pdf-lib. Sin subir archivos.

🔒 Se ejecuta completamente en tu navegador — nada se carga

Drop one image here or click to browse

The visible image and OCR text layer are assembled locally.

Choose an image to begin.

0%

Advertisement

Haz que una imagen escaneada sea buscable

Una foto o captura de pantalla de un documento es fácil de compartir, pero difícil de buscar. Las palabras forman parte de la imagen, por lo que un visor de PDF no puede encontrar un nombre, un número de factura o un párrafo dentro del archivo. Esta herramienta de Imagen a PDF con texto buscable conserva tu imagen original como página visible y añade al PDF el texto OCR para que los visores puedan buscar y seleccionar el contenido reconocido. Es útil para escaneos de una sola página, recibos, cartas, formularios, fotos de pizarras y capturas que quieras archivar como PDF.

Todo se ejecuta en el navegador. Tesseract.js lee la imagen cargada con OCR WebAssembly y pdf-lib crea un nuevo documento PDF sin contactar con ningún servidor. La página tiene el tamaño de la imagen, de modo que el PDF se ve igual que el archivo de origen. Sobre la imagen se dibuja una pequeña capa de texto de baja opacidad para que las palabras reconocidas estén disponibles en la búsqueda del PDF y en las herramientas de selección de texto. La imagen, el resultado del OCR y el PDF final permanecen en la memoria local del navegador hasta que descargas el archivo.

Cómo conseguir mejores PDF buscables

Empieza con la imagen más nítida que tengas. Los escaneos rectos y las capturas nítidas suelen funcionar mejor que las fotos de móvil tomadas en ángulo. Si fotografías papel, coloca el documento sobre una superficie plana, usa una iluminación uniforme y mantén la cámara paralela a la página. Siempre que puedas, recorta escritorios, bordes y sombras antes de subir la imagen. Un buen contraste entre las letras y el fondo ayuda al OCR a separar los caracteres, sobre todo con letra pequeña.

Selecciona el idioma que corresponda al documento antes de crear el PDF. La primera vez que uses un idioma, el navegador puede descargar el motor OCR y el modelo, lo que puede hacer más lenta la primera tarea; las siguientes suelen ser más rápidas porque los archivos quedan en caché. El OCR no es perfecto, así que busca los términos importantes en el PDF terminado y compáralos con la imagen original antes de usar el archivo para registros, contratos, facturas u otros flujos de trabajo de alta precisión.

Qué contiene el PDF generado

El PDF de salida contiene una página con la imagen original a tamaño completo y una capa de texto seleccionable generada por OCR. Esto hace que el archivo sea cómodo para archivos personales, aplicaciones de notas, carpetas de documentos y adjuntos de correo donde se prefiere el PDF a una imagen. La capa de texto está pensada para facilitar la búsqueda y no para una reconstrucción visual perfecta, por lo que las columnas complejas, las tablas o la escritura a mano pueden no alinearse exactamente. Para trabajos de varias páginas, usa las herramientas de OCR de PDF o de OCR por lotes y combina los archivos con un editor de PDF específico si es necesario.

Cómo usar

  1. Añade una imagenArrastra un escaneo, una captura o una foto al cuadro de carga, o haz clic para explorar.
  2. Elige el idiomaSelecciona el idioma que mejor coincida con el texto de la imagen.
  3. Crea el PDFEjecuta el OCR, incrusta la imagen en una página PDF y añade una capa de texto buscable.
  4. DescargaGuarda el PDF buscable directamente desde tu navegador.

Preguntas frecuentes

¿Se sube mi imagen para crear el PDF?
No. El OCR se ejecuta de forma local con Tesseract.js y pdf-lib crea el PDF en tu navegador. La imagen y el PDF buscable permanecen en tu dispositivo.
¿Por qué el primer PDF buscable es más lento?
La primera ejecución descarga el motor OCR y el modelo del idioma seleccionado. El navegador suele guardarlos en caché para que las siguientes ejecuciones sean más rápidas.
¿El texto quedará perfectamente alineado con la imagen?
El PDF conserva la imagen original como página visible y añade una pequeña capa de texto de baja opacidad para buscar y seleccionar. No es un editor OCR con maquetación perfecta.
¿Qué formatos de imagen funcionan?
Usa formatos de imagen habituales del navegador como PNG, JPG, WebP o capturas de pantalla. La herramienta convierte la imagen en una página PDF de forma local.
Advertisement