1Încărcaţi scanarea PDF documents; o scanare curăţată 300 DPI scară de gris devine cel mai bun recunoaştetor cu care să lucreze.
2Spune-i care limba de aşteptat — numirea limbii bate la un nivel larg.
3Executați pasul de recunoaștere; cuvintele sunt scrise înapoi ca un strat invizibil care stătea peste imaginea de pagina originală.
4Descarcă fișierul de căutare PDF — arată identic, dar acum puteți căuta și selecta textul din ea.
PDF OCR FAQ
Ce limbi poate recunoaşte?
+
Peste 100, inclusiv latin, cirilic, grec, arabă, ebraică, chineză, japoneză, coreeană și script-urile indice. Spune-i care limba să se așteapte îmbunătățește material precizie, lașind-o să ghicească.
Cât de corect este?
+
Pe o scanare curată 300 DPI de text tipărit, suficient de mare că erorile sunt rare și în principal în substanți neobișnuiți. Precizia cade brusc cu rezoluție scăzută, skew, umbre de la o cameră de telefon, tipefoane neobișnuite și scrisul de mână — în special scrisul de mână nu este pentru ce este acest lucru.
La ce ar trebui să scanez pentru cel mai bun rezultat?
+
300 DPI în scala de gris este spot dulce. Sub 200 DPI forme de caracter începe de rupere în jos; peste 400 DPI câștigi aproape nimic și plătește pentru el în dimensiunea fișierului și timpul de procesare.
Cum se transformă OCR PDF o scanare în text?
+
În mod concret, Fiecare pagină este dezvoltată, rulați printr-un pas de recunoaștere text-Teseract, iar cuvintele recunoscute sunt scrise înapoi ca un strat de text invizibile poziționat pe imaginea originală — astfel încât pagina arata nemodificat, dar este în căutare și selectabil. Pagina arată exact cum a făcut - textul recunoscut se află în spatele imaginei, astfel încât să lucreze în căutare și selecție fără a schimba aspectul.
Pot să conduc OCR PDF pe mai multe PDF documents de o dată?
+
Da — încărcă setul și procesează în paralel, sub un set de set de seturi, care este punctul de a face un flux de lucru document aici, în loc de a face clic pe un cititor de desktop.
OCR PDF costă ceva?
+
Nu OCR PDF este liber fără cont, și nimic nu este ștampilat pe pagini. Documentele încărcate sunt șterse de la lucrătorii la scurt timp după finalizarea postului.
Ce pot încărca pe OCR PDF?
+
Orice PDF standard, inclusiv cele produse de un scaner, de un procesor de cuvinte sau de un driver de tipărire. Fișiere cu o parolă proprietară care restricționează ediția sunt gestionate; fișiere care au nevoie de o parolă de utilizator pentru a deschide nu sunt, și noi nu încercăm să rupe criptarea.
OCR PDF va reduce calitatea PDF documents?
+
Text și artă vectorială sunt obiecte mai degrabă decât pixeli, astfel încât acestea rămân perfect ascuțite la orice zoom indiferent de ce se întâmplă. Doar imaginile încorporate pot degrada, și doar dacă operația alegeți să le reeșantioneze.
OCR PDF aparține unui site despre un format foto?
+
JPEG.to este construit în jurul formatului care poartă aproape fiecare fotografie în existã, de treizeci de ani, deschisã de literal totul, și totuși de la o imagine fotografică. Oamenii de muncă aduc aici sunt cei o fotografie colectează pe viața sa — prea mare pentru email, dimensiuni greşite pentru o formă, cale greșită de a ieși din telefon. OCR PDF funcționează pe același cont și aceeași încărcare și cont ca conversiile pentru că acolo aterizează aceste locuri de muncă.
Care este pasul viitor sens după OCR PDF?
+
Convertitorul de pe acest site mută imaginile către și de la JPEG, PNG, WebP și HEIC, care este locul în care schimbul între dimensiunea fișierului și o generație de pierderi se stabilește. Deciderea formatului în ultimul timp nu în primul rând este tot punctul: fiecare excepție suplimentară de o imagine fotografică este o altă generație, și cu cât mai puține dintre ele cheltuiți, cu atât mai multa imagine supraviețuiește.
Este acelasi motor ca si celelalte site-uri de convertitor?
+
Da — aceleaşi biblioteci, aceleaşi lucrători, aceleaşi capacuri. Diferenţa este care este sfatul pe pagina, şi aici este construit pe una din proprietăţile formatului pe care site-ul îl numeşte după: Extensionele.jpeg și.jpg sunt aceleași bitstream, deci nimic aici se comportă diferit de.jpg — numai modificările de nume de fișier.
E ceva păstrat, şi trebuie să mă înscriu?
+
Nu este nimic păstrat și nu este nevoie de cont. Încărcările sunt eliminate de la lucrătorii la scurt timp după finalizarea de muncă; nimic nu este privit la, listat sau indexat. Un cont cumpără istorie și loturi mai mari, nu acces.