OT OCR Tools

Bild in durchsuchbares PDF

Wandeln Sie Scan, Screenshot oder Foto im Browser mit Tesseract.js-OCR und pdf-lib in ein durchsuchbares PDF um. Ohne Upload, alles lokal.

🔒 Läuft vollständig in Ihrem Browser — nichts wird hochgeladen

Drop one image here or click to browse

The visible image and OCR text layer are assembled locally.

Choose an image to begin.

0%

Advertisement

Ein gescanntes Bild durchsuchbar machen

Ein Foto oder Screenshot eines Dokuments lässt sich leicht teilen, ist aber schwer zu durchsuchen. Die Wörter sind Teil des Bildes, sodass ein PDF-Viewer einen Namen, eine Rechnungsnummer oder einen Absatz in der Datei nicht finden kann. Dieses Tool Bild in durchsuchbares PDF behält Ihr Originalbild als sichtbare Seite und fügt dem PDF OCR-Text hinzu, damit Viewer den erkannten Inhalt durchsuchen und markieren können. Es eignet sich für einseitige Scans, Belege, Briefe, Formulare, Whiteboard-Aufnahmen und Screenshots, die Sie als PDF archivieren möchten.

Alles läuft im Browser. Tesseract.js liest das hochgeladene Bild mit WebAssembly-OCR, und pdf-lib erstellt ein neues PDF-Dokument, ohne einen Server zu kontaktieren. Die Seite hat die Größe des Bildes, sodass das PDF wie die Quelldatei aussieht. Über dem Bild wird eine kleine, kaum sichtbare Textebene gezeichnet, damit die erkannten Wörter für die PDF-Suche und Textmarkierung verfügbar sind. Bild, OCR-Ergebnis und fertiges PDF bleiben im lokalen Browserspeicher, bis Sie die Datei herunterladen.

So erhalten Sie bessere durchsuchbare PDFs

Beginnen Sie mit dem klarsten Bild, das Sie haben. Gerade Scans und scharfe Screenshots funktionieren meist besser als schräg aufgenommene Handyfotos. Wenn Sie Papier fotografieren, legen Sie das Dokument auf eine ebene Fläche, sorgen Sie für gleichmäßiges Licht und halten Sie die Kamera parallel zur Seite. Schneiden Sie Tischflächen, Ränder und Schatten möglichst vor dem Hochladen weg. Ein hoher Kontrast zwischen Buchstaben und Hintergrund hilft der OCR, Zeichen zu trennen, besonders bei kleiner Schrift.

Wählen Sie vor dem Erstellen des PDFs die Sprache, die zum Dokument passt. Bei der ersten Verwendung einer Sprache lädt der Browser unter Umständen die OCR-Engine und das Modell herunter, wodurch der erste Durchlauf langsamer sein kann; spätere Durchläufe sind meist schneller, weil die Dateien im Cache liegen. OCR ist nicht perfekt. Suchen Sie daher im fertigen PDF nach wichtigen Begriffen und vergleichen Sie sie mit dem Originalbild, bevor Sie die Datei für Unterlagen, Verträge, Rechnungen oder andere Arbeitsabläufe mit hohen Genauigkeitsanforderungen verwenden.

Was das erzeugte PDF enthält

Das Ausgabe-PDF enthält eine Seite mit dem Originalbild in voller Größe und einer per OCR erzeugten, markierbaren Textebene. Damit eignet sich die Datei für persönliche Archive, Notiz-Apps, Dokumentenordner und E-Mail-Anhänge, bei denen PDF gegenüber einem Bild bevorzugt wird. Die Textebene dient der Durchsuchbarkeit und nicht der perfekten optischen Rekonstruktion, daher können komplexe Spalten, Tabellen oder Handschrift nicht exakt ausgerichtet sein. Verwenden Sie für mehrseitige Aufgaben die Tools für PDF-OCR oder Batch-OCR und führen Sie die Dateien bei Bedarf mit einem speziellen PDF-Editor zusammen.

So verwenden Sie

  1. Bild hinzufügenZiehen Sie einen Scan, Screenshot oder ein Foto in das Upload-Feld oder klicken Sie, um eine Datei auszuwählen.
  2. Sprache wählenWählen Sie die Sprache, die am besten zum Text im Bild passt.
  3. PDF erstellenStarten Sie die OCR, binden Sie das Bild in eine PDF-Seite ein und fügen Sie eine durchsuchbare Textebene hinzu.
  4. HerunterladenSpeichern Sie das durchsuchbare PDF direkt aus Ihrem Browser.

Häufig gestellte Fragen

Wird mein Bild zum Erstellen des PDFs hochgeladen?
Nein. Die OCR läuft lokal mit Tesseract.js, und pdf-lib erstellt das PDF in Ihrem Browser. Bild und durchsuchbares PDF bleiben auf Ihrem Gerät.
Warum ist das erste durchsuchbare PDF langsamer?
Beim ersten Durchlauf werden die OCR-Engine und das gewählte Sprachmodell heruntergeladen. Der Browser speichert sie in der Regel im Cache, sodass spätere Durchläufe schneller sind.
Wird der Text perfekt am Bild ausgerichtet sein?
Das PDF behält das Originalbild als sichtbare Seite und fügt eine kleine, kaum sichtbare Textebene für Suche und Markierung hinzu. Es ist kein OCR-Editor mit perfektem Layout.
Welche Bildformate funktionieren?
Verwenden Sie gängige Browser-Bildformate wie PNG, JPG, WebP oder Screenshots. Das Tool wandelt das Bild lokal in eine PDF-Seite um.
Advertisement