1Ngarko PDF documents e skanuar; një skanim i pastër 300 DPI në gri-scale i jep njohësit më shumë për të punuar.
2Thuaj atij se cila gjuhë të presë - emërimi i gjuhës mund të lejojë atë të gjejë me një kufi të gjerë.
3Ekzekuto njohjen e fjalëve; fjalët shkruahen si një shtresë e padukshme mbi figurën origjinale të faqes.
4Shkarko file PDF të kërkueshëm - duket identik, por tani mund të kërkosh dhe të zgjedhësh tekstin në të.
PDF me OCR Pyetje të shpeshta
Çfarë duhet të bëj për të marrë rezultatet më të mira?
+
300 DPI në gri është pika e mirë. Nën 200 DPI, format e karaktereve fillojnë të prishen; mbi 400 DPI, nuk fiton asgjë dhe paguan për këtë në madhësinë e file dhe kohën e përpunimit.
Çfarë gjuhësh mund të njohë?
+
Mbi 100, duke përfshirë latinisht, cirilik, greqisht, arabisht, hebraisht, kinezisht, japonezisht, koreanisht dhe shkrimet indiane.
A ndikon formati i burimit në njohjen?
+
PDF e rregullon faqen: gërmat, vektori, imazhet raster dhe koordinatat e tekstit janë të ngrira kështu që çdo lexues sheh një strukturë identike. Si ruhet faqja vendos se me çfarë rezolucioni dhe ngjyrash duhet të punojë njohësi.
Diçka specifike për PDF këtu?
+
Po — PDF është një grafik objekti, jo një figurë faqeje, kështu që teksti mbetet i zgjedhshëm dhe vektori mbetet i mprehtë pavarësisht se çfarë ndodh me përmbajtjen raster brenda tij. Kjo ndikon në atë që njohësi mund të shohë.
Do të zvogëlojë OCR PDF cilësinë e PDF documents?
+
Teksti dhe vektorët janë objekte dhe jo piksela, kështu që mbeten të mprehtë në çdo zmadhim, pavarësisht se ç'ndodh. Vetëm figurat raster të përfshira mund të degradohen dhe vetëm nëse operacioni që keni zgjedhur i ri-shembullon ato.
A mund të ekzekutojë OCR PDF në disa PDF documents njëkohësisht?
+
Po — ngarko koleksionin dhe ata do të përpunohen paralelisht nën një koleksion rregullimesh, që është qëllimi i kryrjes së një dokumenti të rrjedhës së punës këtu në vend të klikimit nëpërmjet një lexuesit desktop.
A mbijetojnë libërshënuesit, lidhjet dhe fushat e formularit?
+
Konturat, lidhjet e brendshme dhe komentet ruhen kurdoherë që operacioni e lejon këtë. Firmat dixhitale janë përjashtimi: çdo ndryshim në file do të anullojë një firmë, sepse kjo është pikërisht ajo për çka është një firmë.
A kushton OCR PDF ndonjë gjë?
+
Numri OCR PDF është i lirë pa një llogari dhe asgjë nuk shtypet në faqe. Dokumentet e ngarkuar fshihen nga punëtorët menjëherë pasi të përfundojë detyra.
Pse një WebM site pret OCR PDF?
+
WEBM.to është ndërtuar rreth konteinerit të web-it të hapur që në fakt e zgjodhi — VP9 ose AV1 me Opus audio, dekodifikuar natyrisht nga çdo browser modern dhe nuk ka nevojë për plugin, licencë apo lojtar. Video është rasti ku udhëtimet e mëtejshme të kthesave dëmtojnë më shumë — file janë të mëdha dhe çdo ngarkim kushton minuta të vërteta. Duke kryer OCR PDF në të njëjtin pipeline si konvertimet do të thotë që një ngarkim mbulon të gjithë punën në vend të një ngarkimi për instrument.
Çfarë duhet të bëj me rezultatin kur OCR PDF të përfundojë?
+
Konvertimi në këtë faqe lëviz videon midis WebM, MP4, MKV, MOV dhe pjesës tjetër, ose tërheq të gjithë tingullin jashtë, pa një tjetër ngarkim. Sekvencimi i saj në këtë mënyrë ka më shumë rëndësi për video se kudo tjetër: çdo ri-kodë është një gjeneratë tjetër, kështu që sa më pak të jenë ato që qëndrojnë midis burimit dhe file që publikon, aq më mirë duket.
A është OCR PDF këtu i njëjti instrument që sitet vëllazërore e kryejnë?
+
Motorët janë të përbashkët — e njëjta ndërtim ffmpeg me x264, x265 dhe libvpx, të njëjtat punëtorë, të njëjtat kufij. Çfarë një WebM site shtohet është një pamje mbi kontejnerët dhe codecs: cilat kombinime luajnë kudo, të cilat kanë nevojë për një ri-kodëzim dhe të cilat mund të kopjohen thjesht. Gjithashtu fillon nga një fakt rreth formatit që ky site është emëruar sipas: WebM është VP9 ose AV1 me audio Opus, të cilin shfletuesit e dekodojnë natyrshëm por të cilin shumica e editorëve desktop ende e transkodojnë në import.
A më duhet një llogari dhe a mbahet ndonjë gjë?
+
Asnjë llogari, dhe asgjë nuk ruhet: video e ngarkuar fshihet nga punëtorët menjëherë pasi puna përfundon, asgjë nuk shihet dhe asgjë nuk indeksohet. Llogaritë e lira ekzistojnë për historinë dhe përmasën e lotit, jo për hyrjen.