1Téléchargez le scan PDF documents; un scan à échelle grise de 300 DPI propre donne au reconnu le plus à travailler avec.
2Dites-lui quelle langue vous pouvez attendre — en donnant le nom de la langue, vous la laissez deviner par une large marge.
3Exécutez le passe de reconnaissance; les mots sont réécrits comme une couche invisible assise sur l'image de page originale.
4Télécharger le fichier de recherche PDF — il semble identique, mais vous pouvez maintenant rechercher et sélectionner le texte dans celui-ci.
OCR PDF FAQ
Quelles langues peut-elle reconnaître?
+
Plus de 100, y compris le latin, le cyrillique, le grec, l'arabe, l'hébreu, le chinois, le japonais, le coréen et les scripts Indic.
C'est exact?
+
Sur un scan propre 300 DPI de texte imprimé, assez élevé que les erreurs sont rares et principalement dans des noms propres inhabituels. L'exactitude tombe brusquement avec une basse résolution, skew, ombres d'une caméra de téléphone, caractères inhabituels et écriture — l'écriture en particulier n'est pas ce que cela est pour.
Que dois-je scanner pour obtenir le meilleur résultat?
+
300 DPI en échelle grise est le spot doux. En dessous de 200 DPI formes de caractères commencent à se décomposer; au-dessus de 400 DPI vous gagnez presque rien et payez pour elle dans la taille de fichier et le temps de traitement.
Comment OCR PDF transforme-t-il un scan en texte?
+
Concrètement, chaque page est rendue, exécutée à travers un passe de reconnaissance texte de Tesseract, et les mots reconnus sont réécrits comme une couche de texte invisible positionnée sur l'image originale — de sorte que la page semble inchangée, mais est consultable et sélectionnable. La page ressemble toujours exactement à elle — le texte reconnu se trouve invisiblement derrière l'image ainsi la recherche et la sélection fonctionnent sans changer l'apparence.
Puis-je lancer OCR PDF sur plusieurs PDF documents en même temps?
+
Oui — uploadez le jeu et ils le traitent en parallèle sous un seul jeu de paramètres, ce qui est le point de faire un workflow de document ici plutôt que de cliquer sur un lecteur de bureau.
Est-ce que OCR PDF coûte quelque chose?
+
Non. OCR PDF est gratuit sans compte, et rien n'est inscrit sur les pages. Les documents téléchargés sont supprimés des travailleurs peu après la fin du travail.
Que puis-je télécharger sur OCR PDF?
+
Tout PDF standard, y compris ceux produits par un scanner, par un processeur de texte ou par un pilote d'impression. Les fichiers avec un mot de passe propriétaire qui limite uniquement l'édition sont traités; les fichiers qui ont besoin d'un mot de passe utilisateur pour ouvrir ne sont pas, et nous ne essayons pas de briser le chiffrement.
Est-ce que OCR PDF va diminuer la qualité de mon PDF documents?
+
Les œuvres textuelles et vectoriels sont des objets plutôt que des pixels, donc elles restent parfaitement pointues à tout zoom, peu importe ce qui se passe. Seules les images raster intégrées peuvent se dégrader, et seulement si l'opération que vous avez choisie les résample.
Est-ce que OCR PDF appartient à un site sur un format photo?
+
JPEG.to est construit autour du format qui porte presque toutes les photographies en existence — trente ans, ouvert par littéralement tout, et toujours le bon défaut pour une image photographique. Les emplois que les gens apportent ici sont ceux qu'une photographie recueille au cours de sa vie — trop grand pour envoyer un courriel, dimensions erronées pour une forme, chemin de sortie erronée d'un téléphone. OCR PDF fonctionne sur le même téléchargement et le même compte que les conversions parce que c'est là que ces emplois atterrissent.
Quelle est la prochaine étape raisonnable après OCR PDF?
+
Le convertisseur sur ce site déplace des images vers et depuis JPEG, PNG, WebP et HEIC, qui est où le commerce entre la taille du fichier et une génération de plus de perte est réglé. Décider du format est le point entier : chaque sauvegarde supplémentaire d'une image photographique est une autre génération, et le moins d'entre eux que vous dépensez, le plus de l'image survit.
Est-ce le même moteur que les autres sites de conversion?
+
Oui — les mêmes bibliothèques, les mêmes travailleurs, les mêmes capsules. La différence est de quel conseil est sur la page, et ici ce conseil est construit sur une propriété du format du site est nommé d'après: les extensions.jpeg et.jpg sont le même bitstream, donc rien ici ne se comporte différemment d'un.jpg — seulement les changements de nom de fichier.
Est-ce que quelque chose est gardé, et dois-je me connecter?
+
Les chargements sont retirés des travailleurs peu après la fin du travail; rien n'est examiné, répertorié ou indexé. Un compte achète l'historique et les lots plus importants, pas d'accès.