Przejdź do głównej treści
Renamed.to logorenamed.to
Darmowe narzędzie

Wyodrębniaj tekst z obrazów i skanowanych PDF-ów — darmowy, prywatny OCR w przeglądarce

  • Prześlij obraz lub skanowany PDF
  • Wybierz język OCR i opcjonalne wstępne przetwarzanie
  • Przejrzyj, edytuj i wyeksportuj wyodrębniony tekst

Proof: Obsługuje 14 języków z przetwarzaniem po stronie klienta. Twoje pliki nigdy nie opuszczają przeglądarki.

Wyodrębniaj tekst ze zdjęć, zrzutów ekranu, skanowanych dokumentów i PDF-ów — w całości w przeglądarce, bez przesyłania plików na serwer.

  • Obsługuje 14 języków: angielski, hiszpański, francuski, niemiecki, włoski, portugalski i 8 innych.
  • Obsługuje wielostronicowe skanowane PDF-y z wyodrębnianiem tekstu dla każdej strony i separatorami stron.
  • Wbudowane wstępne przetwarzanie: skala szarości i wysoki kontrast poprawiają dokładność przy słabych skanach.

Większość darmowych narzędzi OCR przesyła pliki na nieznane serwery, ogranicza się do jednej strony albo ukrywa wyniki za reklamami i wymogiem rejestracji. To narzędzie działa w całości w przeglądarce z użyciem WebAssembly — Twoje pliki nigdy nie opuszczają urządzenia.

Oparte na Tesseract.js, tym samym silniku OCR open source używanym przez Google i LibreOffice.

OCR do wyodrębniania

Prześlij poniżej obraz lub PDF. Przetwarzanie odbywa się lokalnie w przeglądarce.

Jak wyodrębnić tekst z obrazów i skanowanych PDF-ów

1. Prześlij plik

Przeciągnij lub wybierz plik JPEG, PNG, TIFF, WebP, BMP albo skanowany PDF do 20 MB. Wielostronicowe PDF-y do 20 stron są przetwarzane strona po stronie z wyraźnymi separatorami w wyniku.

2. Wybierz język i ustawienia

Wybierz spośród 14 języków. Włącz skalę szarości lub wysoki kontrast, aby uzyskać lepszą dokładność przy słabych skanach.

3. Tekst jest wyodrębniany lokalnie

Silnik OCR Tesseract działa w przeglądarce przez WebAssembly. Żadne pliki nigdzie nie są wysyłane.

4. Edytuj i eksportuj

Przejrzyj wyodrębniony tekst, popraw ewentualne błędy OCR bezpośrednio w tekście, a następnie skopiuj do schowka lub pobierz jako plik .txt.

Najlepsze praktyki OCR

01

Używaj skanów o wysokiej rozdzielczości

Dokładność OCR znacznie rośnie wraz z rozdzielczością. Warto dążyć do 300 DPI lub więcej. Jeśli skanujesz, użyj najwyższego dostępnego ustawienia jakości.

02

Wypróbuj wstępne przetwarzanie dla wyblakłego tekstu

Włącz tryb wysokiego kontrastu dla paragonów, starych dokumentów lub wyblakłych wydruków. Skala szarości pomaga przy kolorowych tłach, które utrudniają OCR.

03

Sprawdzaj wskaźniki pewności

Wskaźnik pewności poniżej 60% zwykle oznacza, że jakość skanu jest zbyt niska. Spróbuj zeskanować ponownie w wyższej rozdzielczości lub dostosować ustawienia wstępnego przetwarzania.

04

Popraw wyniki przed udostępnieniem

OCR nigdy nie jest w 100% dokładny. Zawsze sprawdź wynik, szczególnie liczby, nazwy własne i znaki specjalne, które OCR często odczytuje błędnie.

Uporządkuj dokumenty na podstawie ich treści

Gdy wyodrębnisz już tekst z dokumentów, renamed.to może automatycznie uporządkować i zmienić nazwy plików na podstawie ich treści.

50 darmowych zmian nazw na start. Karta kredytowa nie jest wymagana.

Często zadawane pytania

Jak dokładne jest to narzędzie OCR?

Dokładność zależy od jakości obrazu. Wyraźne skany drukowanego tekstu w wysokiej rozdzielczości zwykle osiągają 90-98% dokładności. Tekst odręczny, obrazy w niskiej rozdzielczości i nietypowe czcionki dadzą niższą dokładność. Użyj opcji wstępnego przetwarzania, aby poprawić wyniki przy trudnych skanach.

Czy moje pliki są przesyłane na serwer?

Nie. Całe przetwarzanie OCR odbywa się lokalnie w przeglądarce z użyciem WebAssembly (Tesseract.js). Twoje pliki nigdy nie opuszczają urządzenia. Jedyne żądania sieciowe służą do załadowania silnika OCR i danych językowych z publicznego CDN przy pierwszym użyciu.

Jakie formaty obrazów są obsługiwane?

Obsługiwane są obrazy JPEG, PNG, TIFF, WebP i BMP, a także skanowane dokumenty PDF do 20 stron. Maksymalny rozmiar pliku to 20 MB.

Czy mogę używać OCR dla tekstu w innych językach?

Tak. Narzędzie obsługuje 14 języków: angielski, hiszpański, francuski, niemiecki, włoski, portugalski, niderlandzki, polski, rosyjski, chiński (uproszczony), japoński, koreański, arabski i turecki. Aby uzyskać najlepsze wyniki, wybierz język przed uruchomieniem OCR.

Jak mogę poprawić dokładność OCR?

Najbardziej pomagają trzy rzeczy: (1) używanie skanów o wysokiej rozdzielczości (300+ DPI), (2) włączenie opcji wstępnego przetwarzania, takich jak skala szarości i wysoki kontrast, oraz (3) upewnienie się, że dokument jest dobrze oświetlony i nie jest przekrzywiony. W przypadku wielostronicowych PDF-ów każda strona jest przetwarzana niezależnie.