1Naloži skeniran PDF documents; čist 300 dpi sive barve skenira najbolj prepoznavnega prepoznavatelja.
2Povej mu, kateri jezik naj pričakujemo – ime jezika je boljše, kot da bi lahko ugibal na široko mejo.
3Poženite prepustnico za prepoznavanje; besede so napisane nazaj kot nevidna plast, ki sedi nad prvotno sliko strani.
4Prenesi iskano datoteko PDF – zdi se identično, vendar lahko zdaj poiščete in izberete besedilo v njej.
Optično prepoznavanje znakov v PDF-ju Pogosta vprašanja
Kateri jeziki lahko prepozna?
+
Več kot 100, vključno latinski, kirilični, grški, arabski, hebrejski, kitajski, japonski, korejski in indijski scenariji. Povedati, kateri jezik, ki pričakujejo materialno izboljša točnost pred dopusti ugibati.
Kako točna je?
+
Na čistem 300 dpi skeniranje tiskanega besedila, dovolj, da so napake redke in večinoma v nenavadnih pravilnih imen. Natančnost se izloči z nizko ločljivostjo, zadrgo, sence iz telefonske kamere, nenavadne tipkovke in pisave – pisava še posebej ni za to.
Kaj naj skeniram za najboljšim rezultatom?
+
300 dpi v sivi je sladka točka. Pod 200 DPI oblike znakov začnejo razpadati; nad 400 dpi dobite skoraj nič in plačati za to v velikosti datoteke in čas obdelave.
Kako OCR PDF spremeni skeniranje v besedilo?
+
Konkretno, Vsaka stran je izlišena, teči skozi Tesseract besedilno-prepoznavni prepustnico, in priznane besede so napisane nazaj kot nevidna besedilna plast, ki je postavljena nad prvotno sliko – tako da stran izgleda nespremenjeno, vendar je mogoča za iskanje in izbiro. Stran še vedno izgleda točno tako, kot je to storila – priznano besedilo sedi nevidno za sliko, tako iskanje in izbira dela brez spreminjanja videza.
Can I run OCR PDF on several PDF documents at once?
+
Da – naložite komplet in obdelajo vzporedno pod eno vrsto nastavitev, kar je točka, da se dokument delovni tok tukaj, namesto da kliknete skozi namizni bralec.
Ali OCR PDF stane kaj?
+
Št. OCR PDF je brezplačna brez računa in nič ni označeno na straneh. Nalagane dokumente se izbrišejo od delavcev kmalu po končanem delu.
Kaj lahko naložim na OCR PDF?
+
Vsako standardno PDF, vključno z tistimi, ki jih je ustvaril skener, s strani besednega procesorja ali s strojevodjo za tiskanje. Obdelane so datoteke z lastniškim geslom, ki omejuje samo urejanje; datoteke, ki potrebujejo uporabniško geslo za odpiranje, niso, in ne poskušamo prekiniti šifriranja.
Bo OCR PDF zmanjšal kakovost mojega PDF documents?
+
Besedilo in vektorsko umetniško delo so predmeti, ne pikseli, zato ostanejo popolnoma ostri pri vsakem povečanju ne glede na to, kaj se zgodi. Samo vgrajene rasterne slike lahko razgradijo, in le, če jih operacija, ki ste jih izbrali ponovno vzorči.
Ali OCR PDF spada na spletno stran o formatu fotografije?
+
JPEG.to je zgrajeno okoli oblike, ki nosi skoraj vsako obstoječo fotografijo – trideset let, odprto z dobesedno vse, in še vedno pravi privzeti za fotografsko sliko. Dela ljudi prinašajo sem so tista, ki jih fotografija zbira v svojem življenju – prevelika za e-pošto, napačne dimenzije za obrazec, napačna pot do telefona. OCR PDF teče na istem napotku in isti račun kot konverzije, ker je to, kjer ta delovna mesta pristane.
Kaj je razumen naslednji korak po OCR PDF?
+
Pretvornik na tej strani premika slike na JPEG, PNG, WebP in HEIC, kjer se trgovina med velikostjo datoteke in še eno generacijo izgube uredi. Odločitev o obliki zadnjega, namesto prvega, je celotna točka: vsak dodatni prihranek fotografske slike je druga generacija, in manj jih porabite, več slike preživi.
Je to isti motor kot drugi pretvorniki?
+
Da – iste knjižnice, isti delavci, iste pokrovice. Razlika je, katera nasvet je na strani, in tukaj je nasvet zgrajen na eni lastnosti formata, po kateri je spletišče ime: .jpeg in.jpg razširitve so enake bitstream, zato nič tukaj ne obnaša drugače kot.jpg – samo sprememba imena datoteke.
Ali je kaj ostalo in moram vpisati?
+
Nič ni shranjeno in račun ni potreben. Nalaganja so odstranjena od delavcev kmalu po končanem delu; nič ni razvidno, našteto ali indeksirano. Račun kupuje zgodovino in večjo serije, ne dostop.