1Nahrajte naskenované PDF documents; čistý 300 DPI šedý sken poskytuje rozpoznávaču najviac práce.
2Povedzte mu, ktorý jazyk má očakávať – pomenovanie jazyka je oveľa lepšie ako nechať ho uhádnuť.
3Spustite priechod rozpoznávania; slová sa zapíšu späť ako neviditeľná vrstva, ktorá sa nachádza nad obrázkom pôvodnej stránky.
4Stiahnite si prehľadávateľný súbor PDF – vyzerá identicky, ale teraz môžete vyhľadávať a vyberať text v ňom.
OCR PDF Často kladené otázky
Aké jazyky dokáže rozpoznať?
+
Viac ako 100 znakov vrátane latinky, cyriliky, gréčtiny, arabčiny, hebrejčiny, čínštiny, japončiny, kórejčiny a indickej abecedy.Ak mu poviete, ktorý jazyk má očakávať, podstatne sa zlepší presnosť v porovnaní s tým, keď ho necháte hádať.
Ako presné je to?
+
Na čistom skenovi tlačeného textu s rozlíšením 300 DPI, ktoré je dostatočne vysoké na to, aby sa chyby vyskytli len zriedkavo a väčšinou v nezvyčajných vlastných menách, presnosť prudko klesá pri nízkom rozlíšení, sklone, tieňoch z fotoaparátu telefónu, nezvyčajných písmach a rukopise – rukopis nie je tým, na čo je tento softvér určený.
Na čo by som mal skenovať, aby som dosiahol najlepšie výsledky?
+
Pod 200 DPI sa tvary znakov začínajú rozpadávať, nad 400 DPI získate takmer nič a zaplatíte za to veľkosťou súboru a časom spracovania.Vytlačte si 3D modely v rozlíšení 1024x768.
Ako OCR PDF zmení naskenovaný obrázok na text?
+
Konkrétne Každá stránka je vykreslená, prechádza procesom rozpoznávania textu Tesseract a rozpoznané slová sú zapísané späť ako neviditeľná textová vrstva umiestnená na pôvodnom obrázku – takže stránka vyzerá nezmenená, ale je prehľadateľná a vyberateľná.Stránka stále vyzerá presne tak, ako predtým – rozpoznaný text je neviditeľný za obrázkom, takže vyhľadávanie a výber fungujú bez zmeny vzhľadu.
Môžem spustiť OCR PDF na viacerých PDF documents naraz?
+
Áno — nahrajte súbor a spracujú sa paralelne v rámci jednej množiny nastavení, čo je dôvod, prečo tu vykonávať pracovný postup dokumentu namiesto kliknutia cez počítačovú čítačku.
Stojí OCR PDF niečo?
+
Číslo OCR PDF je bezplatné bez účtu a na stránkach nie je nič pečiatky. Nahraté dokumenty sú z pracovníkov odstránené krátko po dokončení úlohy.
Čo môžem nahrať do OCR PDF?
+
Každý štandardný PDF, vrátane tých, ktoré sú vytvorené skenerom, textovým procesorom alebo ovládačom tlačiarne. Súbory s heslom vlastníka, ktoré obmedzuje iba úpravy, sú spracované. Súbory, ktoré vyžadujú heslo používateľa na otvorenie, nie sú spracované a nepokúšame sa prelomiť šifrovanie.
Zníži OCR PDF kvalitu môjho PDF documents?
+
Text a vektorovú grafiku tvoria objekty, nie pixely. Zostávajú teda dokonale ostré pri každom priblížení bez ohľadu na to, čo sa stane. Degradovať sa môžu len vložené rastrové obrázky a len v prípade, že ich vybratá operácia prevzorkuje.
Patrí OCR PDF na stránku o formáte fotografie?
+
JPEG.to je postavený okolo formátu, ktorý nesie takmer každú fotografiu v existencii - tridsať rokov starý, otvorený doslova všetkým, a stále správny štandard pre fotografický obraz. Práce, ktoré sem ľudia prinášajú, sú tie, ktoré fotografia zhromažďuje počas svojho života - príliš veľké na e-mail, nesprávne rozmery pre formulár, nesprávny spôsob, ako sa dostať z telefónu. OCR PDF beží na rovnakom nahrávaní a rovnakom účte ako konverzie, pretože tam sa tieto práce pristávajú.
Aký je ďalší rozumný krok po OCR PDF?
+
Konvertor na tejto stránke presúva obrázky do a z JPEG, PNG, WebP a HEIC, kde sa dohodne obchod medzi veľkosťou súboru a ďalšou generáciou straty. Rozhodnúť sa pre formát naposledy, nie ako prvý, je celkom správne: každé ďalšie uloženie fotografického obrazu je ďalšou generáciou, a čím menej ich strávite, tým viac obrazu prežije.
Je to rovnaký motor ako ostatné konvertory stránok?
+
Áno — rovnaké knižnice, rovnakí pracovníci, rovnaké caps.Rozdiel je v tom, ktoré rady sú na stránke, a tu je tá rada postavená na jednej vlastnosti formátu, po ktorom je stránka pomenovaná: Prípony.jpeg a.jpg sú rovnaké bitstreamy, takže nič sa tu nespráva inak ako pri.jpg — mení sa len názov súboru.
Uchováva sa niečo a musím sa prihlásiť?
+
Nič sa neuchováva a nie je potrebné žiadne konto. Nahrané súbory sú odstránené z pracovníkov krátko po dokončení úlohy, nič sa nepozerá, neuvádza ani neindexuje. Účet nakupuje históriu a väčšie dávky, nie prístup.