1Загрузіць сканаваную PDF documents; чыстая 300 DPI сканаваная графіка з шэрымі адценнямі дае найбольш магчымасцяў для працы.
2У ёй гаворыцца, што мова, якую вывучаюць, павінна быць адной з моў, якія выкарыстоўваюцца ў свеце.
3Выканаць разлік. Слова будзе запісана ў невідавочным пластзе, які будзе размешчаны над арыгінальным малюнкам старонкі.
4Сцягнуць файл з магчымасцю пошуку PDF - ён выглядае ідэнтычным, але вы можаце шукаць і вылучаць тэкст у ім.
PDF OCR Часта задаваныя пытанні
Якія мовы ён можа распазнаваць?
+
Больш за 100, уключаючы лацінскую, кірылічную, грэчаскую, арабскую, габрэйскую, кітайскую, японскую, карэйскую і індыйскую мовы. Калі вы паведаміце праграме, якую мову чакаць, яна будзе больш дакладнай, чым калі вы дазволіце ёй самай вызначыць.
Наколькі гэта дакладна?
+
На чыстай 300 DPI сканаванне друкаванага тэксту, дастаткова высокай, каб памылкі былі рэдкімі і большасць з іх у незвычайных уласных імёнах. Дакладнасць рэзка знізіцца з нізкай раздзяляльнасцю, скажэннем, ценямі з камеры тэлефона, незвычайнымі шрыфтамі і рукапісам - рукапіс у прыватнасці не тое, што гэтая праграма для.
У якім становішчы мне трэба сканаваць, каб атрымаць найлепшы вынік?
+
300 DPI у шэрых адценняў - гэта ідэальная тэмпература. Пры менш чым 200 DPI сімвалы пачынаюць разбурацца; пры больш чым 400 DPI вы не атрымаеце нічога, а толькі павялічваеце памер файла і час апрацоўкі.
Як OCR PDF пераўтварае сканаваны файл у тэкст?
+
У прыватнасці, кожная старонка рэндруецца, праходзіць праз Tesseract для вызначэння тэксту на больш чым 100 мовах, і вызначаныя словы запісваюцца назад як небачныя тэкставыя пласты, размешчаныя над арыгінальным малюнкам - так што старонка выглядае не змененай, але дазваляе пошук і вылучэнне. Старонка выглядае так жа, як і раней - раскрыты тэкст знаходзіцца небажліва за малюнкам, таму пошук і вылучэнне працуюць без змены выгляду.
Ці магу я запусціць OCR PDF на некалькіх PDF documents адначасова?
+
Так - загрузіць набор і яны будуць апрацоўвацца паралельна пад адным набор налад, што з' яўляецца мэтай працы з дакументам тут, а не націскання праз працоўны стол чытача.
Ці каштуе OCR PDF нешта?
+
№ OCR PDF вольны без уліковага запісу, і на старонках нічога не штампуюць. Выдаленыя дакументы выдаляюцца з рабочых пасля таго, як заданне будзе завершана.
Што я магу загрузіць на OCR PDF?
+
Любы стандартны PDF, уключаючы тыя, што створаны сканерам, тэкставым працэсарам або драйверам друку. Файл з паролем уласніка, які абмяжоўвае толькі рэдагаванне, будзе апрацоўвацца; файлы, якія патрабуюць пароля карыстальніка для адкрыцця, не будуць апрацоўвацца, і мы не будзем спрабаваць разблакаваць шыфраванне.
Will OCR PDF lower the quality of my PDF documents?
+
Тэкст і векторныя малюнкі - гэта аб' екты, а не пікселя, таму яны застаюцца рэзкімі пры любым павелічэнні. Толькі ўбудаваныя растравыя малюнкі могуць пагоршыцца, і толькі калі выбраная аперацыя перавыбірае іх.
Ці OCR PDF належыць да сайта пра фармат фота?
+
JPEG.to пабудаваны вакол фармату, які носіць амаль усе існуючыя фатаграфіі — 30 гадоў, адкрыты літаральна ўсім, і ўсё яшчэ правільны па змаўчанні для фотаздымак. Заданні, якія людзі прыносяць сюды, гэта тыя, якія фота набірае за свой час - занадта вялікія, каб адпраўляць па электроннай пошце, няправільныя памеры для формы, няправільны спосаб выхаду з тэлефона. OCR PDF працуе на тым жа загрузніку і тым жа рахунку, што і пераўтварэнні, таму што гэта месца, дзе гэтыя заданні прыбываюць.
Што будзе наступны разважлівы крок пасля OCR PDF?
+
Канвэртар на гэтым сайце перамяшчае малюнкі ў і з JPEG, PNG, WebP і HEIC, дзе кампраміс паміж памерам файла і яшчэ адным пакаленнем страты вырашаецца. Выбар фармату ў апошні раз, а не ў першы раз, - гэта ўсё, што трэба: кожны дадатковы запіс фотаздымак - гэта новае пакаленне, і чым менш вы іх выкарыстоўваеце, тым больш здымка застаецца.
Ці гэта той жа рухавік, што і ў іншых сайтах канвертараў?
+
Так - тыя ж бібліятэкі, тыя ж работнікі, тыя ж капіяванні. Адрозненне ў тым, што падказка на старонцы, і тут падказка пабудавана на адным з уласцівасцяў фармату, у якім названы сайт: пашырэнні. jpeg і. jpg маюць аднолькавы бітаўток, таму нічога тут не адрозніваецца ад. jpg - толькі назва файла змяняецца.
Ці захоўваецца што- небудзь, і ці трэба мне ўвайсці?
+
Нішто не захоўваецца і не патрабуецца рахунак. Выцягнутыя файлы выдаляюцца з работнікаў неўзабаве пасля заканчэння заданняў; нічога не праглядаецца, не паказваецца ў спісе і не індэксуецца. Рэгістрацыя купляе гісторыю і большыя партыі, але не дазваляе доступ.