1Lataa skannattu PDF documents; puhtaan 300 DPI-harmaaskaalaskannauksen avulla tunnistaja voi työskennellä eniten.
2Kerro, mitä kieltä voit odottaa: kielen nimeäminen voittaa sen arvaamisen suurella erolla.
3Suorita tunnustuskortti; sanat kirjoitetaan takaisin alkuperäisen sivun kuvan päälle istuvana näkymättömänä kerroksena.
4Lataa hakukelpoinen PDF tiedosto – se näyttää samalta, mutta voit nyt etsiä ja valita sen tekstin.
OCR-PDF Usein kysytyt kysymykset
Mitä kieliä se voi tunnistaa?
+
Yli sata, mukaan lukien latina, kyrilli, kreikka, arabia, heprea, kiina, japani, korea ja indic-kirjoitukset. Kertomalla, mitä kieltä odottaa, se parantaa aineellisesti tarkkuutta sen sijaan, että antaisi arvauksen.
Kuinka tarkka se on?
+
Puhtaassa 300 DPI-kuvauksessa painetun tekstin kohdalla on tarpeeksi korkea virheiden määrä, joka on harvinainen ja useimmiten epätavallinen asiallinen substantiivi. Tarkkuus putoaa terävästi matalan resoluution, vinon, puhelimen kameran varjojen, epätavallisten tyyppien ja käsialan avulla – erityisesti käsiala ei ole sitä, mitä varten se on.
Mihin minun pitäisi skannata parhaat tulokset?
+
Harmaasävyinen 300 DPI on makea paikka. Alle 200 DPI-hahmon hahmoa alkaa hajota, yli 400 DPI:n kohdalla ei saada juuri mitään ja siitä maksetaan tiedostojen koko ja käsittelyaika.
Miten OCR PDF muuttaa skannauksen tekstiksi?
+
Käytännössä Jokainen sivu käännetään, käydään läpi Tesseract-tekstintunnistuskortti, ja tunnistetut sanat kirjoitetaan takaisin alkuperäisen kuvan päälle sijoitettuna näkymättömänä tekstikerroksena – joten sivu näyttää muuttumattomalta, mutta on hakukelpoinen ja valittavissa. Sivu näyttää edelleen aivan samalta kuin se teki – tunnustettu teksti istuu kuvan takana näkymättömänä, joten etsi ja valitse työ ilman, että ulkonäkö muuttuu.
Voinko ajaa OCR PDF usealla PDF documents kerralla?
+
Kyllä – lataa setti ja ne prosessoidaan rinnakkain yhden asetuskokonaisuuden alla, mikä on tarkoitus tehdä dokumenttityön virtaus täällä sen sijaan, että klikkaisi työpöytälukijan kautta.
Maksaako OCR PDF mitään?
+
Ei. OCR PDF on ilmainen ilman tiliä, eikä mitään leimata sivuille. Ladatut asiakirjat poistetaan työntekijöiltä pian työn päätyttyä.
Mitä voin ladata OCR PDF-palveluun?
+
Kaikki vakiomuotoiset PDF-tiedostot, mukaan lukien skannerin, sanaprosessorin tai tulostusajurin tuottamat. Tiedostot, joissa on omistajan salasana, joka vain rajoittaa muokkausta, käsitellään; tiedostot, jotka tarvitsevat käyttäjän salasanan avataksemme, eivät ole, emmekä yritä murtaa salausta.
Alentaako OCR PDF minun PDF documents laatuani?
+
Teksti- ja vektoritaide ovat kohteita pikseleiden sijaan, joten ne pysyvät täysin terävinä missä tahansa zoomissa, tapahtui mitä tahansa. Vain upotetut rasterikuvat voivat hajota, ja vain jos valitsemasi operaatio ottaa niistä uudelleen näytteen.
Kuuluuko OCR PDF kuvaformaattia koskevaan sivustoon?
+
JPEG.to on rakennettu lähes jokaisen valokuvan sisältävän formaatin ympärille – 30-vuotias, kirjaimellisesti kaiken avaama ja silti oikea oletus valokuvalle. Ihmiset tuovat tänne työpaikkoja, joita valokuva kerää koko elämänsä ajan – liian isoja sähköpostiin, vääränlaisia ulottuvuuksia lomakkeen, väärän reitin ulos puhelimesta. OCR PDF kulkee samalla latauksella ja samalla tilillä kuin muunnos, koska juuri sinne nuo työt laskeutuvat.
Mikä on järkevä seuraava askel OCR PDF jälkeen?
+
Muuntaja tällä sivustolla siirtää kuvia JPEGiin, PNG:hen, WebP:hen ja HEIC:hen, missä tiedoston koon ja yhden uuden tappion välisen kaupan tilanne rauhoittuu. Koko formaatin päättäminen viimeisenä eikä ensimmäisenä on tarkoitus: jokainen ylimääräinen tallenne valokuvakuvasta on toinen sukupolvi, ja mitä vähemmän niitä käyttää, sitä enemmän kuvasta selviää.
Onko tämä sama moottori kuin muilla muuntamoalueilla?
+
Kyllä – samat kirjastot, samat työntekijät, samat kannet. Ero on siinä, mikä neuvo on sivulla, ja tässä neuvo on rakennettu yhdelle sivuston formaatin ominaisuudelle, jonka mukaan sivusto on nimetty: .jpeg- ja.jpg-laajennukset ovat sama bittivirta, joten mikään täällä ei käyttäydy eri tavalla kuin jpg – vain tiedoston nimi muuttuu.
Onko mitään säilytetty, ja pitääkö minun kirjautua sisään?
+
Mitään ei pidetä eikä tiliä tarvita. Lataukset poistetaan työn päätyttyä, mitään ei tutkita, listata tai indeksoida. Tilillä ostetaan historiaa ja suurempia eriä, ei pääsyä.