Imagen a PDF con texto buscable
Convierte un escaneo, una captura o una foto en un PDF con texto buscable en tu navegador con OCR Tesseract.js y pdf-lib. Sin subir archivos.
🔒 Se ejecuta completamente en tu navegador — nada se cargaHaz que una imagen escaneada sea buscable
Una foto o captura de pantalla de un documento es fácil de compartir, pero difícil de buscar. Las palabras forman parte de la imagen, por lo que un visor de PDF no puede encontrar un nombre, un número de factura o un párrafo dentro del archivo. Esta herramienta de Imagen a PDF con texto buscable conserva tu imagen original como página visible y añade al PDF el texto OCR para que los visores puedan buscar y seleccionar el contenido reconocido. Es útil para escaneos de una sola página, recibos, cartas, formularios, fotos de pizarras y capturas que quieras archivar como PDF.
Todo se ejecuta en el navegador. Tesseract.js lee la imagen cargada con OCR WebAssembly y pdf-lib crea un nuevo documento PDF sin contactar con ningún servidor. La página tiene el tamaño de la imagen, de modo que el PDF se ve igual que el archivo de origen. Sobre la imagen se dibuja una pequeña capa de texto de baja opacidad para que las palabras reconocidas estén disponibles en la búsqueda del PDF y en las herramientas de selección de texto. La imagen, el resultado del OCR y el PDF final permanecen en la memoria local del navegador hasta que descargas el archivo.
Cómo conseguir mejores PDF buscables
Empieza con la imagen más nítida que tengas. Los escaneos rectos y las capturas nítidas suelen funcionar mejor que las fotos de móvil tomadas en ángulo. Si fotografías papel, coloca el documento sobre una superficie plana, usa una iluminación uniforme y mantén la cámara paralela a la página. Siempre que puedas, recorta escritorios, bordes y sombras antes de subir la imagen. Un buen contraste entre las letras y el fondo ayuda al OCR a separar los caracteres, sobre todo con letra pequeña.
Selecciona el idioma que corresponda al documento antes de crear el PDF. La primera vez que uses un idioma, el navegador puede descargar el motor OCR y el modelo, lo que puede hacer más lenta la primera tarea; las siguientes suelen ser más rápidas porque los archivos quedan en caché. El OCR no es perfecto, así que busca los términos importantes en el PDF terminado y compáralos con la imagen original antes de usar el archivo para registros, contratos, facturas u otros flujos de trabajo de alta precisión.
Qué contiene el PDF generado
El PDF de salida contiene una página con la imagen original a tamaño completo y una capa de texto seleccionable generada por OCR. Esto hace que el archivo sea cómodo para archivos personales, aplicaciones de notas, carpetas de documentos y adjuntos de correo donde se prefiere el PDF a una imagen. La capa de texto está pensada para facilitar la búsqueda y no para una reconstrucción visual perfecta, por lo que las columnas complejas, las tablas o la escritura a mano pueden no alinearse exactamente. Para trabajos de varias páginas, usa las herramientas de OCR de PDF o de OCR por lotes y combina los archivos con un editor de PDF específico si es necesario.
Cómo usar
- Añade una imagenArrastra un escaneo, una captura o una foto al cuadro de carga, o haz clic para explorar.
- Elige el idiomaSelecciona el idioma que mejor coincida con el texto de la imagen.
- Crea el PDFEjecuta el OCR, incrusta la imagen en una página PDF y añade una capa de texto buscable.
- DescargaGuarda el PDF buscable directamente desde tu navegador.