1Muatkan naik PDF documents yang diimbas; imbasan skala kelabu 300 DPI bersih memberikan pengiktirafan yang paling banyak untuk bekerja.
2Beritahu bahasa mana yang hendak diharapkan — nama bahasa melebihi biarkan ia meneka dengan margin yang luas.
3Jalankan laluan pengenalan; perkataan ditulis semula sebagai lapisan tak kelihatan duduk di atas imej halaman asal.
4Muat turun fail bolehcari PDF — ia kelihatan sama, tetapi anda boleh cari dan pilih teks didalamnya.
PDF OCR Soalan Lazim
Apa yang patut saya imbas untuk hasil yang terbaik?
+
300 DPI dalam skala kelabu adalah titik manis. Di bawah 200 DPI bentuk aksara mula rosak; di atas 400 DPI anda tidak mendapat apa-apa dan membayar untuknya dalam saiz fail dan masa pemprosesan.
Bahasa apa yang ia boleh mengenali?
+
Lebih 100, termasuk Latin, Cyrillic, Greek, Arab, Hebrew, Cina, Jepun, Korea dan skrip India. Memaklumkan bahasa mana yang dijangkakan secara material meningkatkan ketepatan berbanding membiarkan ia meneka.
Adakah format sumber mempengaruhi pengecaman?
+
Ianya boleh. PDF memperbaiki halaman: fon, vektor, imej raster dan koordinat teks dibekukan supaya setiap pembaca melihat susunatur yang sama. Cara halaman disimpan menentukan resolusi dan maklumat warna yang perlu diguna oleh pengiktirafan.
Sesuatu yang spesifik untuk PDF di sini?
+
Ya — PDF adalah graf objek, bukan imej halaman, jadi teks tetap boleh dipilih dan vektor tetap tajam tidak kira apa yang berlaku kepada kandungan raster di dalamnya. Ia mempengaruhi apa yang pengiktirafan boleh lihat.
Adakah OCR PDF akan menurunkan kualiti PDF documents saya?
+
Teks dan karya seni vektor adalah objek bukan piksel, jadi mereka tetap tajam pada sebarang zum tanpa mengira apa yang berlaku. Hanya imej raster terbenam boleh diturunkan, dan hanya jika operasi yang anda pilih menguji semula mereka.
Bolehkah saya jalankan OCR PDF pada beberapa PDF documents sekaligus?
+
Ya — muat naik set dan mereka diproses secara serentak di bawah satu set tetapan, yang merupakan titik untuk melakukan aliran kerja dokumen di sini daripada mengklik melalui pembaca desktop.
Adakah tandabuku, pautan dan medan borang akan kekal?
+
Garis luar, pautan dalaman dan anotasi disimpan di mana- mana operasi membenarkannya. Tandatangan digital adalah pengecualian: sebarang perubahan kepada fail mesti melumpuhkan tandatangan, kerana itulah yang tandatangan adalah untuk.
Adakah OCR PDF memerlukan bayaran?
+
No. OCR PDF adalah bebas tanpa akaun, dan tiada apa yang ditempelkan pada halaman. Dokumen yang dimuat naik dipadam dari pekerja tidak lama selepas tugas selesai.
Kenapa laman WebM menghost OCR PDF?
+
WEBM.to dibina di sekeliling kontena yang web terbuka sebenarnya pilih — VP9 atau AV1 dengan audio Opus, dikod semula secara natif oleh setiap pelayar moden dan tidak memerlukan sebarang plugin, lesen atau pemain. Video adalah kes di mana perjalanan pusingan tambahan paling menyakitkan — fail adalah besar dan setiap muat naik kos minit sebenar. Melaksanakan OCR PDF pada paip yang sama seperti penukaran bermakna satu muat naik merangkumi seluruh kerja bukannya satu muat naik per alat.
Apa yang patut saya lakukan dengan hasil apabila OCR PDF selesai?
+
Penukar di laman ini memindahkan video antara WebM, MP4, MKV, MOV dan selebihnya, atau menarik trek bunyi keluar sepenuhnya, tanpa muat naik lain. Menurutkannya dengan cara itu lebih penting untuk video daripada mana-mana tempat lain: setiap pengekodan semula adalah generasi lain, jadi semakin kurang mereka berdiri antara sumber dan fail yang anda terbitkan, semakin baik ia kelihatan.
Adakah OCR PDF di sini alat yang sama yang dijalankan oleh laman saudara?
+
Enjin dikongsi — binaan ffmpeg yang sama dengan x264, x265 dan libvpx, pekerja yang sama, had yang sama. Apa yang tapak WebM tambah adalah pandangan pada kontena dan codec: kombinasi mana yang dimainkan di mana-mana, yang mana perlu dikod semula dan yang mana boleh disalin. Ia juga bermula dari satu fakta mengenai format yang nama laman ini diambil daripada: WebM adalah VP9 atau AV1 dengan audio Opus, yang pelayar nyahkod secara natif tetapi kebanyakan editor desktop masih mentranskod pada import.
Adakah saya perlu akaun, dan apa-apa yang dijaga?
+
Tiada akaun, dan tiada apa yang disimpan: video dimuat naik dipadam dari pekerja tidak lama selepas kerja selesai, tiada apa yang dilihat dan tiada apa yang diindeks. Akaun percuma wujud untuk sejarah dan saiz kumpulan, bukan untuk akses.