Wyodrębniaj tekst z obrazów i skanowanych PDF-ów — darmowy, prywatny OCR w przeglądarce
- Prześlij obraz lub skanowany PDF
- Wybierz język OCR i opcjonalne wstępne przetwarzanie
- Przejrzyj, edytuj i wyeksportuj wyodrębniony tekst
Proof: Obsługuje 14 języków z przetwarzaniem po stronie klienta. Twoje pliki nigdy nie opuszczają przeglądarki.
Wyodrębniaj tekst ze zdjęć, zrzutów ekranu, skanowanych dokumentów i PDF-ów — w całości w przeglądarce, bez przesyłania plików na serwer.
- Obsługuje 14 języków: angielski, hiszpański, francuski, niemiecki, włoski, portugalski i 8 innych.
- Obsługuje wielostronicowe skanowane PDF-y z wyodrębnianiem tekstu dla każdej strony i separatorami stron.
- Wbudowane wstępne przetwarzanie: skala szarości i wysoki kontrast poprawiają dokładność przy słabych skanach.
Większość darmowych narzędzi OCR przesyła pliki na nieznane serwery, ogranicza się do jednej strony albo ukrywa wyniki za reklamami i wymogiem rejestracji. To narzędzie działa w całości w przeglądarce z użyciem WebAssembly — Twoje pliki nigdy nie opuszczają urządzenia.
Oparte na Tesseract.js, tym samym silniku OCR open source używanym przez Google i LibreOffice.
OCR do wyodrębniania
Prześlij poniżej obraz lub PDF. Przetwarzanie odbywa się lokalnie w przeglądarce.
Jak wyodrębnić tekst z obrazów i skanowanych PDF-ów
1. Prześlij plik
Przeciągnij lub wybierz plik JPEG, PNG, TIFF, WebP, BMP albo skanowany PDF do 20 MB. Wielostronicowe PDF-y do 20 stron są przetwarzane strona po stronie z wyraźnymi separatorami w wyniku.
2. Wybierz język i ustawienia
Wybierz spośród 14 języków. Włącz skalę szarości lub wysoki kontrast, aby uzyskać lepszą dokładność przy słabych skanach.
3. Tekst jest wyodrębniany lokalnie
Silnik OCR Tesseract działa w przeglądarce przez WebAssembly. Żadne pliki nigdzie nie są wysyłane.
4. Edytuj i eksportuj
Przejrzyj wyodrębniony tekst, popraw ewentualne błędy OCR bezpośrednio w tekście, a następnie skopiuj do schowka lub pobierz jako plik .txt.
Najlepsze praktyki OCR
Używaj skanów o wysokiej rozdzielczości
Dokładność OCR znacznie rośnie wraz z rozdzielczością. Warto dążyć do 300 DPI lub więcej. Jeśli skanujesz, użyj najwyższego dostępnego ustawienia jakości.
Wypróbuj wstępne przetwarzanie dla wyblakłego tekstu
Włącz tryb wysokiego kontrastu dla paragonów, starych dokumentów lub wyblakłych wydruków. Skala szarości pomaga przy kolorowych tłach, które utrudniają OCR.
Sprawdzaj wskaźniki pewności
Wskaźnik pewności poniżej 60% zwykle oznacza, że jakość skanu jest zbyt niska. Spróbuj zeskanować ponownie w wyższej rozdzielczości lub dostosować ustawienia wstępnego przetwarzania.
Popraw wyniki przed udostępnieniem
OCR nigdy nie jest w 100% dokładny. Zawsze sprawdź wynik, szczególnie liczby, nazwy własne i znaki specjalne, które OCR często odczytuje błędnie.
Uporządkuj dokumenty na podstawie ich treści
Gdy wyodrębnisz już tekst z dokumentów, renamed.to może automatycznie uporządkować i zmienić nazwy plików na podstawie ich treści.
50 darmowych zmian nazw na start. Karta kredytowa nie jest wymagana.
Często zadawane pytania
Jak dokładne jest to narzędzie OCR?
Dokładność zależy od jakości obrazu. Wyraźne skany drukowanego tekstu w wysokiej rozdzielczości zwykle osiągają 90-98% dokładności. Tekst odręczny, obrazy w niskiej rozdzielczości i nietypowe czcionki dadzą niższą dokładność. Użyj opcji wstępnego przetwarzania, aby poprawić wyniki przy trudnych skanach.
Czy moje pliki są przesyłane na serwer?
Nie. Całe przetwarzanie OCR odbywa się lokalnie w przeglądarce z użyciem WebAssembly (Tesseract.js). Twoje pliki nigdy nie opuszczają urządzenia. Jedyne żądania sieciowe służą do załadowania silnika OCR i danych językowych z publicznego CDN przy pierwszym użyciu.
Jakie formaty obrazów są obsługiwane?
Obsługiwane są obrazy JPEG, PNG, TIFF, WebP i BMP, a także skanowane dokumenty PDF do 20 stron. Maksymalny rozmiar pliku to 20 MB.
Czy mogę używać OCR dla tekstu w innych językach?
Tak. Narzędzie obsługuje 14 języków: angielski, hiszpański, francuski, niemiecki, włoski, portugalski, niderlandzki, polski, rosyjski, chiński (uproszczony), japoński, koreański, arabski i turecki. Aby uzyskać najlepsze wyniki, wybierz język przed uruchomieniem OCR.
Jak mogę poprawić dokładność OCR?
Najbardziej pomagają trzy rzeczy: (1) używanie skanów o wysokiej rozdzielczości (300+ DPI), (2) włączenie opcji wstępnego przetwarzania, takich jak skala szarości i wysoki kontrast, oraz (3) upewnienie się, że dokument jest dobrze oświetlony i nie jest przekrzywiony. W przypadku wielostronicowych PDF-ów każda strona jest przetwarzana niezależnie.
Powiązane materiały
Przeglądaj i usuwaj ukryte metadane z PDF-ów
Sprawdź, czy nazwy plików działają na różnych platformach
Podgląd operacji zmiany nazw plików przed wykonaniem
Przeglądaj i usuwaj metadane z obrazów
Przeglądaj pełną kolekcję narzędzi do zarządzania plikami
50 darmowych zmian nazw. Płać w miarę rozwoju.