1Ladda upp den skannade PDF documents; en ren 300 DPI gråskala scan ger igenkänningen mest att arbeta med.
2Berätta vilket språk man kan förvänta sig — att namnge språket är bättre än att låta det gissa med bred marginal.
3Kör igenkänningspasset; orden skrivs tillbaka som ett osynligt lager som sitter över den ursprungliga sidbilden.
4Ladda ner filen PDF — den ser identisk ut, men du kan nu söka och välja texten i den.
OCR PDF Vanliga frågor
Vilka språk kan den känna igen?
+
Över 100, inklusive latin, kyrilliska, grekiska, arabiska, hebreiska, kinesiska, japanska, koreanska och de indiska skript. Berättar vilket språk att förvänta sig materiellt förbättrar noggrannheten över att låta det gissa.
Hur exakt är den?
+
På en ren 300 DPI scan av tryckt text, tillräckligt hög att fel är sällsynta och mestadels i ovanliga riktiga substantiv. Noggrannhet faller kraftigt med låg upplösning, skev, skuggor från en telefonkamera, ovanliga typsnitt och handstil — särskilt handstil är inte vad detta är till för.
Vad ska jag skanna efter bästa resultat?
+
300 DPI i gråskala är den söta fläcken. Under 200 DPI tecken former börjar bryta ner; över 400 DPI du får nästan ingenting och betala för det i filstorlek och bearbetningstid.
Hur förvandlar OCR PDF en skanning till text?
+
Konkret, varje sida återges, körs genom ett Tesseract-pass, och de erkända orden skrivs tillbaka som ett osynligt textlager placerat över den ursprungliga bilden – så sidan ser oförändrad ut men är sökbar och valbar. Sidan ser fortfarande exakt ut som den gjorde — den erkända texten sitter osynligt bakom bilden så sök och urval fungerar utan att ändra utseendet.
Kan jag köra OCR PDF på flera PDF documents samtidigt?
+
Ja — ladda upp uppsättningen och de behandlar parallellt under en uppsättning inställningar, vilket är poängen med att göra ett dokument arbetsflöde här snarare än att klicka genom en skrivbordsläsare.
Does OCR PDF cost anything?
+
Nej. OCR PDF är gratis utan konto, och ingenting stämplas på sidorna. Uppladdade dokument raderas från arbetarna kort efter att jobbet har avslutats.
Vad kan jag ladda upp till OCR PDF?
+
Alla standard PDF, inklusive sådana som produceras av en scanner, av en ordbehandlare eller av en skrivardrivrutin. Filer med ett lösenord som bara begränsar redigering hanteras; filer som behöver ett användarlösenord för att öppna är inte, och vi försöker inte att bryta kryptering.
Kommer OCR PDF sänka kvaliteten på min PDF documents?
+
Text- och vektorkonst är objekt snarare än bildpunkter, så de är helt skarpa vid alla zoombilder oavsett vad som händer. Endast de inbäddade rasterbilderna kan brytas ned, och endast om operationen du valde återprovger dem.
Hör OCR PDF hemma på en webbplats om ett fotoformat?
+
JPEG.to är uppbyggd kring det format som bär nästan varje fotografi som finns — trettio år gammal, som öppnas av bokstavligen allt och fortfarande är den rätta standardbilden för en fotografisk bild. Jobben som folk tar hit är de som ett fotografi samlar in över sitt liv - för stora för att e-post, fel dimensioner för en form, fel väg upp ur en telefon. OCR PDF körs på samma uppladdning och samma konto som omvandlingarna eftersom det är där dessa jobb landar.
Vad är det förnuftiga nästa steget efter OCR PDF?
+
Konverteraren på denna webbplats flyttar bilder till och från JPEG, PNG, WebP och HEIC, vilket är där handeln mellan filstorlek och en ytterligare generation av förlust kommer att regleras. Att bestämma formatet sist snarare än först är hela poängen: varje extra räddning av en fotografisk bild är en annan generation, och ju färre av dem du spenderar, desto mer av bilden överlever.
Är det samma motor som de andra omformarna?
+
Ja — samma bibliotek, samma arbetare, samma mössor. Skillnaden är vilken rådgivning som finns på sidan, och här är råden uppbyggda på en fastighet i det format som webbplatsen har fått sitt namn efter: .jpeg och.jpg tillägg är samma bitström, så ingenting här beter sig annorlunda från en.jpg — bara filnamn ändringar.
Är något kvar, och måste jag skriva in mig?
+
Ingenting sparas och ingen konto behövs. Uppladdningar tas bort från arbetarna kort efter jobbets slut; ingenting ses över, listas eller indexeras. Ett konto köper historia och större omgångar, inte tillgång.