1Nahrajte naskenovaný PDF documents; čistý 300 DPI šedý sken dává rozpoznávači nejvíce pracovat.
2Řekni mu, který jazyk očekávat? jméno jazyk beats nechat ho hádat o široké rozpětí.
3Spusťte rozpoznávací pas; slova jsou napsána zpět jako neviditelná vrstva, která sedí nad originálním obrazem stránky.
4Stáhněte si vyhledávací soubor PDF? vypadá stejně, ale nyní můžete hledat a vyberte text v něm.
OCR PDF Často kladené otázky
Na co bych měl skenovat nejlepší výsledek?
+
300 DPI v šedé škále je sladké místo. Pod 200 DPI znak tvary začínají rozpadat; nad 400 DPI získáte téměř nic a platit za něj ve velikosti souboru a zpracování času.
Které jazyky může rozpoznat?
+
Více než 100, včetně latinsky, cyrilice, řečtina, arabsky, hebrejsky, čínština, japonština, korejština a indičtí skripty. Řekněte mu, který jazyk má očekávat, že podstatně zlepší přesnost nad tím, aby to hádal.
Ovlivňuje zdrojový formát rozpoznávání?
+
To ano. PDF opraví stránku: písma, vektory, rastrové obrázky a textové souřadnice jsou zmraženy, takže každý čtenář vidí stejné rozložení. Jak je stránka uložena, rozhoduje o tom, s jakým rozlišením a barevnými informacemi musí rozpoznávač pracovat.
Něco konkrétního pro PDF tady?
+
Ano, PDF je graf objektu, ne obrázek stránky, takže text zůstane volitelný a vektory zůstanou ostré bez ohledu na to, co se stane s rastrovým obsahem uvnitř. To ovlivňuje to, co rozpoznávač může vidět.
Sníží OCR PDF kvalitu mé PDF documents?
+
Text a vektorové umění jsou spíše objekty než pixely, takže zůstávají perfektně ostré v každém zoomu bez ohledu na to, co se stane. Pouze vložené rastrové obrázky mohou degradovat, a pouze pokud operace, kterou jste si vybrali, je znovu ochutná.
Can I run OCR PDF on several PDF documents at once?
+
Ano?Nahrát soubor a oni se zpracovávají paralelně pod jedním souborem nastavení, což je bod, kdy se dokument pracovní postup zde, spíše než kliknutí přes stolní čtečku.
Přežívají záložky, odkazy a tvarová pole?
+
Výjimkou jsou mimořádky, interní odkazy a anotace. Digitální podpisy: každá změna souboru nutně zneplatňuje podpis, protože právě k tomu je podpis.
Stojí OCR PDF něco?
+
Ne. OCR PDF je zdarma bez účtu, a nic není orazítkován na stránky. Nahrané dokumenty jsou vymazány z pracovníků krátce po dokončení práce.
Proč WebM místo hostitele OCR PDF?
+
WEBM.to je postaven kolem kontejneru otevřené webové vlastně vybral VP9 nebo AV1 s Opus audio, dekódován nativně každý moderní prohlížeč a nepotřebuje plugin, licence nebo hráč. Video je případ, kdy navíc kulaté výlety bolí nejvíce ~ soubory jsou velké a každý nahrávání stojí reálné minuty. Během OCR PDF na stejném potrubí jako konverze znamená, že jeden nahrát pokrývá celou práci místo jednoho nahrát na nástroj.
Co mám dělat s výsledkem, až bude OCR PDF hotovo?
+
Převodník na této stránce pohybuje video mezi WebM, MP4, MKV, MOV a zbytek, nebo vytáhne soundtrack úplně, bez dalšího nahrávání. Sekvenování takhle záleží více na videu než kdekoli jinde: každý překódování je další generace, takže čím méně z nich stojí mezi zdrojem a souborem, který zveřejníte, tím lépe to vypadá.
Is OCR PDF here the same tool the sibling sites run?
+
Motory jsou sdíleny ~ stejný ffmpeg stavět s x264, x265 a libvpx, stejné dělníky, stejné limity. Co WebM místo dodává je pohled na kontejnery a kodek: které kombinace hrají všude, které potřebují re-kód a které mohou být jednoduše kopírovat napříč. To také začíná z jedné skutečnosti o formátu tato stránka je pojmenována po: WebM je VP9 nebo AV1 s Opus audio, který prohlížeče dekódují nativně, ale který většina desktop editorů stále překóduje při importu.
Potřebuju účet a je něco udržované?
+
Žádný účet, a nic není uchováno: nahrané video je vymazáno z pracovníků krátce po dokončení práce, nic není sledováno a nic není indexováno. Volný účet existuje pro historii a velikost šarže, není pro přístup.