Volný plán: 1 převod/hod, 1 soubor najednou
Go Unlimited →

OCR PDF

Extrahování textu ze skenovaných PDF souborů

Vyberte si soubory

*Soubory smazány po 24 hodinách

Převod souborů až do velikosti 1 GB zdarma, uživatelé Pro mohou převést soubory až do velikosti 100 GB; Zaregistrujte se nyní

Nahrávání

0%

Jak se OCR PDF

1 Nahrajte naskenovaný PDF documents; čistý 300 DPI šedý sken dává rozpoznávači nejvíce pracovat.
2 Řekni mu, který jazyk očekávat? jméno jazyk beats nechat ho hádat o široké rozpětí.
3 Spusťte rozpoznávací pas; slova jsou napsána zpět jako neviditelná vrstva, která sedí nad originálním obrazem stránky.
4 Stáhněte si vyhledávací soubor PDF? vypadá stejně, ale nyní můžete hledat a vyberte text v něm.

OCR PDF Často kladené otázky

Na co bych měl skenovat nejlepší výsledek?
+
300 DPI v šedé škále je sladké místo. Pod 200 DPI znak tvary začínají rozpadat; nad 400 DPI získáte téměř nic a platit za něj ve velikosti souboru a zpracování času.
Více než 100, včetně latinsky, cyrilice, řečtina, arabsky, hebrejsky, čínština, japonština, korejština a indičtí skripty. Řekněte mu, který jazyk má očekávat, že podstatně zlepší přesnost nad tím, aby to hádal.
To ano. PDF opraví stránku: písma, vektory, rastrové obrázky a textové souřadnice jsou zmraženy, takže každý čtenář vidí stejné rozložení. Jak je stránka uložena, rozhoduje o tom, s jakým rozlišením a barevnými informacemi musí rozpoznávač pracovat.
Ano, PDF je graf objektu, ne obrázek stránky, takže text zůstane volitelný a vektory zůstanou ostré bez ohledu na to, co se stane s rastrovým obsahem uvnitř. To ovlivňuje to, co rozpoznávač může vidět.
Text a vektorové umění jsou spíše objekty než pixely, takže zůstávají perfektně ostré v každém zoomu bez ohledu na to, co se stane. Pouze vložené rastrové obrázky mohou degradovat, a pouze pokud operace, kterou jste si vybrali, je znovu ochutná.
Ano?Nahrát soubor a oni se zpracovávají paralelně pod jedním souborem nastavení, což je bod, kdy se dokument pracovní postup zde, spíše než kliknutí přes stolní čtečku.
Výjimkou jsou mimořádky, interní odkazy a anotace. Digitální podpisy: každá změna souboru nutně zneplatňuje podpis, protože právě k tomu je podpis.
Ne. OCR PDF je zdarma bez účtu, a nic není orazítkován na stránky. Nahrané dokumenty jsou vymazány z pracovníků krátce po dokončení práce.
WEBM.to je postaven kolem kontejneru otevřené webové vlastně vybral VP9 nebo AV1 s Opus audio, dekódován nativně každý moderní prohlížeč a nepotřebuje plugin, licence nebo hráč. Video je případ, kdy navíc kulaté výlety bolí nejvíce ~ soubory jsou velké a každý nahrávání stojí reálné minuty. Během OCR PDF na stejném potrubí jako konverze znamená, že jeden nahrát pokrývá celou práci místo jednoho nahrát na nástroj.
Převodník na této stránce pohybuje video mezi WebM, MP4, MKV, MOV a zbytek, nebo vytáhne soundtrack úplně, bez dalšího nahrávání. Sekvenování takhle záleží více na videu než kdekoli jinde: každý překódování je další generace, takže čím méně z nich stojí mezi zdrojem a souborem, který zveřejníte, tím lépe to vypadá.
Motory jsou sdíleny ~ stejný ffmpeg stavět s x264, x265 a libvpx, stejné dělníky, stejné limity. Co WebM místo dodává je pohled na kontejnery a kodek: které kombinace hrají všude, které potřebují re-kód a které mohou být jednoduše kopírovat napříč. To také začíná z jedné skutečnosti o formátu tato stránka je pojmenována po: WebM je VP9 nebo AV1 s Opus audio, který prohlížeče dekódují nativně, ale který většina desktop editorů stále překóduje při importu.
Žádný účet, a nic není uchováno: nahrané video je vymazáno z pracovníků krátce po dokončení práce, nic není sledováno a nic není indexováno. Volný účet existuje pro historii a velikost šarže, není pro přístup.

Ohodnoťte tento nástroj
5.0/5 - 0 hlasů
ns6. com ? 800+ doménové rozšíření. Najděte si své dokonalé jméno.
Nebo sem vložte soubory