0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR: obraz i PDF na tekst
Wyodrębnij tekst z obrazu, zrzutu ekranu lub pliku PDF. W plikach PDF łączy własny tekst dokumentu —w tym podpisy i pola— z optycznym rozpoznawaniem znaków (OCR) obrazów. Cały proces odbywa się w Twojej przeglądarce, bez wysyłania pliku na żaden serwer.

Przeciągnij obraz lub plik PDF albo kliknij, aby wybrać

PDF, PNG, JPEG, WebP, GIF, BMP

Wybierz jeden lub więcej języków obecnych na obrazie

Jak to działa

OCR (optyczne rozpoznawanie znaków) zamienia tekst widoczny na obrazie lub w pliku PDF —zdjęciu, zrzucie ekranu czy zeskanowanym dokumencie— w edytowalny tekst, który możesz skopiować, wyszukać lub wkleić w dowolnym miejscu.

Możesz wybrać jeden lub więcej języków, aby poprawić dokładność: wskazanie właściwego języka pomaga silnikowi lepiej interpretować akcenty, znaki specjalne i całe słowa. Przy pierwszym użyciu danego języka jego model jest pobierany, a następnie zapisywany na następne razy.

Całe rozpoznawanie odbywa się w Twojej przeglądarce za pomocą WebAssembly: plik nie jest wysyłany na żaden serwer. Wynik zawiera szacowaną pewność, dzięki czemu wiesz, jak wiarygodny był odczyt.

Przypadki użycia

  • Skopiowanie tekstu ze zrzutu ekranu, gdy nie da się go zaznaczyć.
  • Zdigitalizowanie zeskanowanego dokumentu, faktury lub paragonu w celu edycji.
  • Wyodrębnienie fragmentu kodu lub komunikatu o błędzie ze zdjęcia.
  • Odzyskanie tekstu z obrazu w celu przetłumaczenia lub wyszukania.
  • Wyodrębnienie tekstu z pliku PDF —cyfrowego lub zeskanowanego— w celu ponownego użycia.

Najczęstsze pytania

Czy mój obraz jest wysyłany na jakiś serwer?

Nie. Rozpoznawanie działa w całości w Twojej przeglądarce; obraz nigdy nie opuszcza Twojego urządzenia. Pobierane są tylko wybrane przez Ciebie modele językowe, jednorazowo.

Dlaczego mam wybierać język tekstu?

Każdy język ma własny wytrenowany model. Wybór właściwego języka wyraźnie poprawia dokładność, zwłaszcza przy akcentach i znakach charakterystycznych dla danego języka. Jeśli obraz miesza języki, możesz wybrać kilka naraz.

Jak uzyskać lepsze wyniki?

Używaj wyraźnych, dobrze oświetlonych obrazów z dobrym kontrastem między tekstem a tłem. Tekst poziomy i bez zniekształceń działa lepiej niż zdjęcia pod kątem, rozmyte lub pismo odręczne.

Jakich formatów mogę używać?

Możesz używać obrazów w typowych formatach (PNG, JPEG, WebP, GIF i BMP), a także plików PDF. W przypadku dokumentów zrzut ekranu lub skan w dobrej rozdzielczości daje lepsze wyniki.

Jak przetwarzane są pliki PDF?

Są przetwarzane strona po stronie, łącząc cały dostępny tekst: własny tekst pliku PDF —w tym pola formularzy i podpisy cyfrowe— jest wyodrębniany bezpośrednio i dokładnie, a tekst wewnątrz obrazów jest dodatkowo rozpoznawany za pomocą OCR. „Cyfrowe” pliki PDF są odczytywane natychmiast; zeskanowane lub zawierające wiele obrazów mogą trwać dłużej.