1Ubacite skenirano PDF documents; čisto 300 DPI skeniranje sivine daje prepoznavaču najviše za raditi.
2Reci mu koji jezik treba očekivati — ime jezika je bolje nego da ga pustimo da nagađa široko.
3Pokrenite prolaz za prepoznavanje; riječi su napisane natrag kao nevidljivi sloj sjedeći iznad originalne stranice slike.
4Preuzmite datoteku koja se može pretraživati PDF – izgleda identično, ali možete sada pretražiti i odabrati tekst u njoj.
OCR PDF Često postavljana pitanja
Što bih trebao skenirati za najbolji rezultat?
+
300 DPI u sivim bojama je slatko mjesto. Ispod 200 DPI oblika znakova početi razbijanje; iznad 400 DPI steći gotovo ništa i platiti za to u veličini datoteke i vrijeme obrade.
Koji jezik može prepoznati?
+
Više od 100, uključujući latinski, Ćirilični, grčki, arapski, hebrejski, kineski, japanski, korejskindijski scenariji. Govoriti koji jezik očekuje materijalno poboljšava točnost nad dopuštanjem da pogodi.
Da li oblik izvora utječe na prepoznavanje?
+
Da. PDF popravlja stranicu: fontovi, vektori, raster slike i koordinate teksta zamrznuta tako da svaki čitatelj vidi identičan raspored. Kako se pohranjuje stranica odlučuje s kojim razlučivanjem i informacijama o boji treba da radi prepoznavač.
Ima li nešto specifično za PDF ovdje?
+
Da, a PDF je objekt graf, a ne stranica slika, tako da tekst ostaje odabirljiv i vektori ostaju oštri bez obzira što se dogodi sa raster sadržaj unutar njega. To utječe na ono što prepoznavač može vidjeti.
Will OCR PDF lower the quality of my PDF documents?
+
Tekst i vektor umjetnost su objekti, a ne pikseli, tako da oni ostaju savršeno oštri u bilo kojem uvećanju bez obzira na to što se dogodi. Samo ugrađeni raster slike mogu degradirati, i samo ako operacija koju ste izabrali reuzorira ih.
Mogu li odmah pokrenuti OCR PDF na nekoliko PDF documents?
+
Da — ubacite skup i oni obraduju paralelno pod jednim skupom postavki, što je točka rada dokumenta ovdje umjesto klika preko čitača radne površine.
Preživljavaju li zabilješke, linkovi i polja formiranja?
+
Okviri, interne veze i anotacije su očuvani gdje god to operacija omogućava. Digitalni potpisi su iznimka: svaka promjena datoteke nužno poništava potpis, jer to je upravo ono što potpis je za.
Košta li OCR PDF nešto?
+
Broj OCR PDF je besplatno bez računa, a ništa nije označeno na stranicama. Uloženi dokumenti brišu se od radnika ubrzo nakon što posao završi.
Zašto je WebM domaćin stranice OCR PDF?
+
WEBM.to je izgrađen oko kontejnera otvorena web zapravo odabrana — VP9 ili AV1 s Opus audio, dekodirana na materini od strane svakog modernog preglednika i ne treba priključak, licencu ili igrač. Video je slučaj kada su dodatni okrugli putovi najviše povrijeđeni – datoteke su velike i svaki upis troškovi realnih minuta. Pokreće se OCR PDF na istom cjevovodu kao i konverzije znači jedan unos pokriva cijeli posao umjesto jednog upload po alatu.
Što da radim s rezultatom nakon što OCR PDF završimo?
+
Konverter na ovoj stranici pomjera video između WebM, MP4, MKV, pokret i ostalo, ili povlači zvuka u potpunosti, bez drugog upload. Sekvenciranje da je način važniji za video nego bilo gdje drugdje: svaki re-encode je još jedna generacija, tako da što manje od njih stoji između izvora i datoteke koju objavite, bolje izgleda.
Je li OCR PDF ovdje isti alat koji se nalazi u braćom bratu?
+
Motori su dijeljeni — isti ffmpeg gradnja s x264, x265 i libvpx, isti radnici, iste granice. Što WebM stranica dodaje je pogled na kontejnere i kodeke: koje kombinacije igraju posvuda, koje treba re-enkod i koje se jednostavno može kopirati preko. Također počinje iz jedne činjenice o formatu stranica je nazvana po: WebM je VP9 ili AV1 s Opus audio, koji preglednici dekodiraju na materinju, ali većina radnih površina uređivača još uvijek transkodirati pri uvozu.
Trebam li račun, i da li se nešto čuva?
+
Nema računa, i ništa nije čuvano: uneseni video se briše od radnika ubrzo nakon završetka posla, ništa se ne promatra i ništa nije indeksirano. Besplatni računi postoje za povijest i veličinu serije, a ne za pristup.