1Wyślij skanowany PDF documents; czysty skan od szarego kąta 300 DPI daje rozpoznawcy najwięcej do pracy.
2Powiedz, który język można oczekiwać — nazwa języka to lepsze niż to, by zgadnąć o szerokim stopniu.
3Uruchom przepustkę rozpoznawania; słowa są zapisane jako niewidzialna warstwa siedząca nad oryginalnym obrazem strony.
4Pobierz plik wyszukiwalny PDF — wygląda identyczny, ale teraz możesz wyszukać i wybrać tekst w nim.
OCR PDF Często zadawane pytania
Co powinienem zrobić, żeby znaleźć najlepszy wynik?
+
300 DPI w cenie szarości jest słodkim miejscem. Poniżej 200 DPI kształtów znaków zaczynają się rozkładać; powyżej 400 DPI nie osiągasz prawie nic i nie płacisz za to w rozmiarze pliku i czasie przetwarzania.
Jakie języki można rozpoznać?
+
Ponad 100, w tym latyno, cyrylika, grecki, arabski, hebrajski, chiński, japoński, koreańskindycki skrypt. Mówiąc, który język, aby oczekiwać materialnie poprawia dokładność nad dając jej zgadnąć.
Czy format źródła wpływa na rozpoznanie?
+
Tak jest. PDF poprawia stronę: czcionki, wektory, rastrowe obrazy i współrzędne tekstu są zamrożone, tak aby każdy czytelnik widział identyczny układ. Jak przechowywana jest strona decyduje, z jakiej rozdzielczością i kolorem musi pracować rozpoznawca.
Coś konkretnego do PDF?
+
Tak – a PDF to wykres obiektu, a nie obraz strony, więc tekst pozostaje wybrany i wektory pozostają ostre, bez względu na to, co się stanie z zawartością rasteru wewnątrz. To wpływa na to, co widzi rozpoznawca.
Czy OCR PDF obniżyć jakość mojego PDF documents?
+
Tekst i wektorowe grafiki to obiekty, a nie piksele, więc pozostają one doskonale ostre w każdym powiększeniu, nieważne co się stanie. Tylko wbudowane obrazy rasterowe mogą zniższyć, i tylko jeśli operacja, którą wybrałeś, je przeprodukuje.
Mogę sprawdzić OCR PDF na kilku PDF documents natychmiast?
+
Tak — wysyłanie zestawu i przetwarzanie równoległe pod jednym zestawem ustawień, co jest punktem wykonywania dokumentu przepływu pracy tutaj zamiast kliknięcia przez czytacz pulpitu.
Czy zakładki, linki i formy przetrwają?
+
Określenia, wewnętrzne linki i anotacje są zachowane wszędzie, gdzie to pozwala na operację. Podpisy cyfrowe są wyjątkiem: każda zmiana pliku musi koniecznie unieważnić podpis, ponieważ właśnie to jest podpis.
Czy OCR PDF kosztuje coś?
+
Nie. OCR PDF jest bezpłatny bez konta, a na stronach nic nie jest znaczone. Wysłane dokumenty są usuwane od pracowników wkrótce po zakończeniu pracy.
Dlaczego serwer WebM jest serwerem OCR PDF?
+
WEBM.to jest zbudowany wokół pojemnika, który wybrała otwarta strona — VP9 lub AV1 z Opus audio, dekodowany na własny rachunek przez każdą nowoczesną przeglądarkę i nie potrzebuje wtyczki, licencji lub odtwarzacza. Wideo jest przypadkiem, gdy dodatkowe okrągłe wycieczki bolą najbardziej — pliki są duże i każdy koszt przesyłania realne minuty. Bieganie OCR PDF na tym samym rurociągu co konwersje oznacza jedno przesyłka pokrywa całe zadanie zamiast jednego przesyłki na narzędzie.
Co mam zrobić z wynikiem po skończeniu OCR PDF?
+
Konwerter na tej stronie przenosi filmy między WebM, MP4, MKV, MOV i resztą, lub wyciąga dźwięki w całości, bez kolejnego przenoszenia. Sekwencjonowanie tego sposobu ma większe znaczenie dla wideo niż gdziekolwiek indziej: każde ponowne kodowanie to kolejne pokolenie, więc im mniej z nich stoi między źródłem a plikiem, który publikujesz, tym lepiej wygląda.
Czy OCR PDF jest to samo narzędzie, które prowadzi się przez rodzynnych stron?
+
Silniki są wspólne – ta sama ffmpeg budowa z x264, x265 i libvpx, te same pracownicy, te same granice. Co WebM strona dodaje jest widok na pojemniki i kodeki: które kombinacje grać wszędzie, które potrzebują ponownego kodu i które można po prostu skopiować. Zaczyna się również z jednego faktu o formatie tej strony nazwana jest po: WebM to VP9 lub AV1 z audio Opus, które przeglądarki dekodują natywnie, ale które większość edytorów pulpitu nadal transkoduje przy importie.
Potrzebuję konta i czy coś się zachowuje?
+
Nie ma konta i nic nie jest przechowywane: wysłane wideo jest usunięte z pracowników wkrótce po zakończeniu pracy, nic nie jest obserwowane i nic nie jest indeksowane. Darmowe konta istnieją dla historii i rozmiarów partii, a nie dla dostępu.