1Nahrajte naskenovaný PDF documents; čistý 300 DPI šedý sken dává rozpoznávači nejvíce pracovat.
2Řekni mu, který jazyk očekávat? jméno jazyk beats nechat ho hádat o široké rozpětí.
3Spusťte rozpoznávací pas; slova jsou napsána zpět jako neviditelná vrstva, která sedí nad originálním obrazem stránky.
4Stáhněte si vyhledávací soubor PDF? vypadá stejně, ale nyní můžete hledat a vyberte text v něm.
OCR PDF Často kladené otázky
Které jazyky může rozpoznat?
+
Více než 100, včetně latinsky, cyrilice, řečtina, arabsky, hebrejsky, čínština, japonština, korejština a indičtí skripty. Řekněte mu, který jazyk má očekávat, že podstatně zlepší přesnost nad tím, aby to hádal.
Jak je to přesné?
+
Na čistém 300 DPI skenování tištěného textu, dostatečně vysoké, že chyby jsou vzácné a většinou v neobvyklých řádných jmen. Přesnost padá prudce s nízkým rozlišením, zkosení, stíny z telefonní kamery, neobvyklé písma a rukopisu?
Na co bych měl skenovat nejlepší výsledek?
+
300 DPI v šedé škále je sladké místo. Pod 200 DPI znak tvary začínají rozpadat; nad 400 DPI získáte téměř nic a platit za něj ve velikosti souboru a zpracování času.
Jak se OCR PDF změní skenování na text?
+
Konkrétně každá stránka je překreslena, prochází textem rozpoznávacím perem Teseract a uznávaná slova jsou napsána zpět jako neviditelná textová vrstva umístěná nad původním obrazem?? takže stránka vypadá nezměněně, ale je vyhledávatelná a volitelná. Stránka stále vypadá přesně tak, jak to udělal? uznávaný text sedí neviditelně za obrazem, takže hledání a výběr práce bez změny vzhledu.
Můžu běžet OCR PDF na několika PDF documents najednou?
+
Ano?Nahrát soubor a oni se zpracovávají paralelně pod jedním souborem nastavení, což je bod, kdy se dokument pracovní postup zde, spíše než kliknutí přes stolní čtečku.
Stojí OCR PDF něco?
+
Ne. OCR PDF je zdarma bez účtu, a nic není orazítkován na stránky. Nahrané dokumenty jsou vymazány z pracovníků krátce po dokončení práce.
Co mohu nahrát do OCR PDF?
+
Jakýkoli standardní PDF, včetně těch, které jsou vyrobeny skenerem, textovým procesorem nebo tiskovým ovladačem. Soubory s heslem majitele, které omezují pouze editaci, jsou řešeny; soubory, které potřebují uživatelské heslo k otevření nejsou, a my se nepokoušíme rozbít šifrování.
Sníží OCR PDF kvalitu mé PDF documents?
+
Text a vektorové umění jsou spíše objekty než pixely, takže zůstávají perfektně ostré v každém zoomu bez ohledu na to, co se stane. Pouze vložené rastrové obrazy mohou degradovat, a pouze pokud operace, kterou jste si vybrali, je znovu ochutná.
Patří OCR PDF na stránku o formátu fotografie?
+
JPEG.to je postaveno kolem formátu, který nese téměř každou fotografii v existenci!30 let, otevřen doslova vším, a stále správné výchozí pro fotografický obraz. Práce, které lidé přinášejí, jsou ty, které fotografie shromažďuje po celý svůj život příliš velké na e-mail, špatné rozměry pro formulář, špatný způsob, jak se dostat z telefonu. OCR PDF běží na stejném nahrávání a stejný účet jako konverze, protože tam se tato pracovní místa přistát.
Jaký je rozumný další krok po OCR PDF?
+
Převodník na těchto stránkách přesune obrázky do a z JPEG, PNG, Wepp a HEIC, kde se obchodu mezi velikostí souboru a další generace ztráty se vypořádá. Rozhodování o formátu poslední než první je celý bod: každá další spása fotografického obrazu je další generace, a čím méně z nich utratíte, tím více obrazu přežije.
Je to stejný motor jako ostatní převodníky?
+
Ano? stejné knihovny, stejné pracovníky, stejné čepice. Rozdíl je, které rady jsou na stránce, a zde, že poradenství je postaven na jedné vlastnosti formátu, který je pojmenován po: .jpeg a.jpg rozšíření jsou stejné bitstream, takže nic zde se chová jinak než.jpg?? pouze název souboru změny.
Je něco udržované a mám se zapsat?
+
Nic není vedeno a není třeba žádný účet. Nahrávky jsou odstraněny z pracovníků krátce po dokončení práce; nic není podíval, uvedeno nebo indexován. Účet kupuje historii a větší šarže, není přístup.