1Téléchargez le scan PDF documents; un scan à échelle grise de 300 DPI propre donne au reconnu le plus à travailler avec.
2Dites-lui quelle langue vous pouvez attendre — en donnant le nom de la langue, vous la laissez deviner par une large marge.
3Exécutez le passe de reconnaissance; les mots sont réécrits comme une couche invisible assise sur l'image de page originale.
4Télécharger le fichier de recherche PDF — il semble identique, mais vous pouvez maintenant rechercher et sélectionner le texte dans celui-ci.
OCR PDF FAQ
Que dois-je scanner pour obtenir le meilleur résultat?
+
300 DPI en échelle grise est le spot doux. En dessous de 200 DPI formes de caractères commencent à se décomposer; au-dessus de 400 DPI vous gagnez presque rien et payez pour elle dans la taille de fichier et le temps de traitement.
Quelles langues peut-elle reconnaître?
+
Plus de 100, y compris le latin, le cyrillique, le grec, l'arabe, l'hébreu, le chinois, le japonais, le coréen et les scripts Indic.
Le format source a-t-il une incidence sur la reconnaissance?
+
Il le fait. PDF corrige la page : polices, vecteurs, images raster et coordonnées de texte sont gelés afin que chaque lecteur voit la mise en page identique. Comment la page est stockée décide avec quelle résolution et quelle couleur l'information du reconnu doit fonctionner.
Quelque chose de spécifique à PDF ici?
+
Oui — un PDF est un graphique objet, pas une image de page, donc le texte reste sélectionnable et les vecteurs restent pointus, peu importe ce qui arrive au contenu raster à l'intérieur. Cela affecte ce que le reconnu peut voir.
Est-ce que OCR PDF va diminuer la qualité de mon PDF documents?
+
Les œuvres textuelles et vectoriels sont des objets plutôt que des pixels, donc elles restent parfaitement pointues à tout zoom, peu importe ce qui se passe. Seules les images raster intégrées peuvent se dégrader, et seulement si l'opération que vous avez choisie les résample.
Puis-je lancer OCR PDF sur plusieurs PDF documents en même temps?
+
Oui — uploadez le jeu et ils le traitent en parallèle sous un seul jeu de paramètres, ce qui est le point de faire un workflow de document ici plutôt que de cliquer sur un lecteur de bureau.
Les signets, les liens et les champs de formation survivent-ils?
+
Les lignes directrices, les liens internes et les annotations sont conservés partout où l'opération le permet. Les signatures numériques sont l'exception : toute modification du fichier invalide nécessairement une signature, car c'est précisément pour cela qu'une signature est signée.
Est-ce que OCR PDF coûte quelque chose?
+
Non. OCR PDF est gratuit sans compte, et rien n'est inscrit sur les pages. Les documents téléchargés sont supprimés des travailleurs peu après la fin du travail.
Pourquoi un site WebM héberge-t-il OCR PDF?
+
WEBM.to est construit autour du conteneur le web ouvert a réellement choisi — VP9 ou AV1 avec Opus audio, décodé nativement par chaque navigateur moderne et n'ayant pas besoin de plugin, licence ou lecteur. La vidéo est le cas où les voyages aller-retour supplémentaires sont le plus douloureux — les fichiers sont grands et chaque téléchargement coûte des minutes réelles. Exécuter OCR PDF sur le même pipeline que les conversions signifie qu'un téléchargement couvre l'ensemble du travail au lieu d'un téléchargement par outil.
Que dois-je faire avec le résultat une fois OCR PDF terminé?
+
Le convertisseur sur ce site déplace la vidéo entre WebM, MP4, MKV, MOV et le reste, ou retire la bande son entièrement, sans autre téléchargement. Séquençage de cette façon importe plus pour la vidéo que n'importe où ailleurs : chaque réencode est une autre génération, donc le moins d'entre eux se tiennent entre la source et le fichier que vous publiez, mieux il semble.
Est-ce que OCR PDF ici le même outil que les sites de frères et sœurs fonctionne?
+
Les moteurs sont partagés — la même construction de ffmpeg avec x264, x265 et libvpx, les mêmes travailleurs, les mêmes limites. Ce qu'un site WebM ajoute est une vue sur les conteneurs et les codecs: quelles combinaisons jouent partout, qui ont besoin d'un réencode et qui peuvent simplement être copiés à travers. Il commence également à partir d'un fait sur le format de ce site est nommé après: WebM est VP9 ou AV1 avec Opus audio, que les navigateurs décodent nativement mais que la plupart des éditeurs de bureau transcodent encore à l'importation.
Ai-je besoin d'un compte, et est-ce que quelque chose est gardé?
+
Pas de compte, et rien n'est gardé : la vidéo téléchargée est supprimée des travailleurs peu après la fin du travail, rien n'est regardé et rien n'est indexé.