Wsadowy OCR
Wyodrębniaj tekst z wielu obrazów naraz dzięki prywatnemu OCR w przeglądarce. Przetwarzaj skany i zrzuty ekranu lokalnie i pobierz połączony tekst.
🔒 Działa całkowicie w Twojej przeglądarce — nic nie jest przesyłaneOCR wielu obrazów w jednej karcie przeglądarki
Wsadowy OCR oszczędza czas, gdy masz kilka zrzutów ekranu, zeskanowanych stron, paragonów lub zdjęć, z których potrzebujesz edytowalnego tekstu. Zamiast wysyłać pliki na serwer lub ręcznie przetwarzać obrazy jeden po drugim, wybierasz grupę plików, a to narzędzie przetwarza je po kolei w Twojej przeglądarce. Każdy wynik pojawia się na stronie zaraz po zakończeniu danego obrazu, a połączony plik do pobrania zawiera nagłówki z nazwami plików, dzięki czemu wyodrębniony tekst łatwo przypisać do oryginału.
Przebieg pracy jest prywatny z założenia. Tesseract.js uruchamia optyczne rozpoznawanie znaków lokalnie przy użyciu WebAssembly, więc obrazy pozostają na Twoim urządzeniu. Nie ma kolejki na serwerze, konta ani etapu wysyłania. Przetwarzanie sekwencyjne ułatwia też zrozumienie stanu: pasek postępu pokazuje bieżący plik i procent rozpoznania, a ukończone pliki pozostają widoczne poniżej. To praktyczny sposób na obsługę niewielkich codziennych partii bez instalowania programu OCR na komputerze.
Przygotowanie plików dla lepszego wyniku
Aby uzyskać najlepsze rezultaty, grupuj obrazy w tym samym języku i o podobnej jakości. Wyraźne zrzuty ekranu i proste skany zwykle dają lepszy tekst niż rozmazane zdjęcia. Jeśli obrazy to zdjęcia z telefonu, przytnij tło, unikaj cieni i trzymaj kartkę równolegle do aparatu. OCR może mieć problemy z pismem odręcznym, tabelami, czcionkami ozdobnymi i bardzo małym tekstem, dlatego sprawdź każdy wynik, zanim zaufasz mu w przypadku ważnych dokumentów.
Pierwszy plik może potrwać dłużej, ponieważ przeglądarka pobiera silnik OCR i wybrany model językowy. Potem ten sam przebieg i przyszłe wizyty są zwykle szybsze, bo model jest zapisany w pamięci podręcznej. Duże obrazy zużywają więcej pamięci i wymagają więcej czasu, więc zmniejsz zdjęcia o bardzo wysokiej rozdzielczości, jeśli szybkość jest ważniejsza niż szczegółowość. Nie zamykaj karty podczas przetwarzania wsadu i nie zamykaj przeglądarki, dopóki połączony plik tekstowy nie zostanie pobrany.
Korzystanie z połączonego tekstu OCR
Po zakończeniu przetwarzania pobierz połączony plik .txt do notatek, archiwów, indeksów wyszukiwania lub ręcznej weryfikacji. Każda sekcja zaczyna się od oryginalnej nazwy pliku, po której następuje rozpoznany tekst z tego obrazu. Taki format łatwo wkleić do dokumentów, później podzielić lub porównać z obrazami źródłowymi. Jeśli któryś plik daje słaby wynik, zrób ponownie zdjęcie lub skan tylko tego obrazu i uruchom go jeszcze raz w narzędziu do pojedynczych obrazów. W przypadku zeskanowanych plików PDF użyj narzędzia OCR dla PDF, aby kolejność stron i separatory stron były obsługiwane automatycznie.
Jak używać
- Dodaj obrazyUpuść wiele zrzutów ekranu, skanów lub zdjęć albo kliknij, aby wybrać pliki.
- Wybierz językWybierz język OCR używany dla wszystkich plików we wsadzie.
- Uruchom sekwencyjny OCRPrzeglądarka rozpoznaje jeden obraz naraz i pokazuje postęp dla każdego pliku.
- Pobierz połączony tekstSprawdź każdy wynik, a następnie zapisz jeden plik .txt z nagłówkami nazw plików.