1Ladda upp den skannade PDF documents; en ren 300 DPI gråskala scan ger igenkänningen mest att arbeta med.
2Berätta vilket språk man kan förvänta sig — att namnge språket är bättre än att låta det gissa med bred marginal.
3Kör igenkänningspasset; orden skrivs tillbaka som ett osynligt lager som sitter över den ursprungliga sidbilden.
4Ladda ner filen PDF — den ser identisk ut, men du kan nu söka och välja texten i den.
OCR PDF Vanliga frågor
Vad ska jag skanna efter bästa resultat?
+
300 DPI i gråskala är den söta fläcken. Under 200 DPI tecken former börjar bryta ner; över 400 DPI du får nästan ingenting och betala för det i filstorlek och bearbetningstid.
Vilka språk kan den känna igen?
+
Över 100, inklusive latin, kyrilliska, grekiska, arabiska, hebreiska, kinesiska, japanska, koreanska och de indiska skript. Berättar vilket språk att förvänta sig materiellt förbättrar noggrannheten över att låta det gissa.
Påverkar källformatet igenkänning?
+
Det gör det. PDF fixar sidan: teckensnitt, vektorer, rasterbilder och textkoordinater fryses så att varje läsare ser identisk layout. Hur sidan lagras avgör vilken upplösning och färginformation som kännaren måste arbeta med.
Något specifikt till PDF här?
+
Yes — en PDF är en objektgraf, inte en sidbild, så text förblir valbar och vektorer förblir skarpa oavsett vad som händer med rasterinnehållet inuti den. It affects what the recogniser can see.
Kommer OCR PDF sänka kvaliteten på min PDF documents?
+
Text- och vektorkonst är objekt snarare än bildpunkter, så de är helt skarpa vid alla zoombilder oavsett vad som händer. Endast de inbäddade rasterbilderna kan brytas ned, och endast om operationen du valde återprovger dem.
Can I run OCR PDF on several PDF documents at once?
+
Ja — ladda upp uppsättningen och de behandlar parallellt under en uppsättning inställningar, vilket är poängen med att göra ett dokument arbetsflöde här snarare än att klicka genom en skrivbordsläsare.
Överlever bokmärken, länkar och formulärfält?
+
Outlines, interna länkar och anteckningar bevaras varhelst åtgärden tillåter det. Digitala signaturer är undantag: varje ändring i filen nödvändigtvis upphäver en signatur, eftersom det är just det en signatur är till för.
Does OCR PDF cost anything?
+
Nej. OCR PDF är gratis utan konto, och ingenting stämplas på sidorna. Uppladdade dokument raderas från arbetarna kort efter att jobbet har avslutats.
Varför en WebM webbplats värd OCR PDF?
+
WEBM.to är byggd runt behållaren den öppna webben faktiskt valt — VP9 eller AV1 med Opus ljud, avkodas inbyggt av varje modern webbläsare och behöver ingen plugin, licens eller spelare. Video är fallet där extra turer gör mest ont — filerna är stora och varje uppladdning kostar riktiga minuter. Köra OCR PDF på samma rörledning som omvandlingarna innebär att en uppladdning täcker hela jobbet istället för en uppladdning per verktyg.
Vad ska jag göra med resultatet när OCR PDF är klar?
+
Omvandlaren på denna webbplats flyttar video mellan WebM, MP4, MKV, MOV och resten, eller drar soundtrack helt, utan en annan uppladdning. Att sekventera det så betyder mer för video än någon annanstans: varje ny kod är en annan generation, så ju färre av dem står mellan källan och filen du publicerar, desto bättre ser det ut.
Är OCR PDF här samma verktyg som syskonplatserna kör?
+
Motorerna delas – samma ffmpeg-bygge med x264, x265 och libvpx, samma arbetare, samma gränser. Vad en WebM webbplats lägger till är en vy på behållare och codecs: vilka kombinationer spelar överallt, som behöver en ny kod och som helt enkelt kan kopieras över. Det börjar också från ett faktum om formatet denna webbplats är uppkallad efter: WebM är VP9 eller AV1 med Opus audio, som webbläsare avkoda inbyggt men som de flesta skrivbordseditorer fortfarande transkoda vid import.
Behöver jag ett konto och får nåt behållas?
+
Inget konto, och ingenting hålls: laddade video tas bort från arbetarna kort efter jobbet avslutas, ingenting ses och ingenting indexeras. Gratis konton finns för historia och batch storlek, inte för tillgång.