Bezpłatny plan: 1 konwersja na godzinę, 1 plik na raz
Idź Nieograniczony →

OCR PDF

PDF Rozpoznanie tekstu

Wybierz swoje pliki

*Pliki usunięte po 24 godzinach

Konwertuj bezpłatnie pliki o rozmiarze do 1 GB. Użytkownicy Pro mogą konwertować pliki o rozmiarze do 100 GB. Zarejestruj się teraz

Przesyłanie

0%

Jak prowadzić OCR PDF

1 Wyślij skanowany PDF documents; czysty skan od szarego kąta 300 DPI daje rozpoznawcy najwięcej do pracy.
2 Powiedz, który język można oczekiwać — nazwa języka to lepsze niż to, by zgadnąć o szerokim stopniu.
3 Uruchom przepustkę rozpoznawania; słowa są zapisane jako niewidzialna warstwa siedząca nad oryginalnym obrazem strony.
4 Pobierz plik wyszukiwalny PDF — wygląda identyczny, ale teraz możesz wyszukać i wybrać tekst w nim.

OCR PDF Często zadawane pytania

Jakie języki można rozpoznać?
+
Ponad 100, w tym latyno, cyrylika, grecki, arabski, hebrajski, chiński, japoński, koreańskindycki skrypt. Mówiąc, który język, aby oczekiwać materialnie poprawia dokładność nad dając jej zgadnąć.
Na czystym skanowaniu 300 DPI drukowanego tekstu, wystarczająco wysokim, że błędy są rzadkie i głównie w niezwykłych właściwych jęcześciach. Dokładność odpada ostrie z niską rozdzielczością, ścierpieniem, cieniami z kamery telefonicznej, niezwykłymi liczbami i pisaniem — nie jest to w szczególności to, do czego służy pisanie.
300 DPI w cenie szarości jest słodkim miejscem. Poniżej 200 DPI kształtów znaków zaczynają się rozkładać; powyżej 400 DPI nie osiągasz prawie nic i nie płacisz za to w rozmiarze pliku i czasie przetwarzania.
Konkretnie, Każda strona jest wyświetlana, przebiega przez przepustkę do rozpoznawania tekstu Tesseract, a uznane słowa są zapisywane jako niewidzialna warstwa tekstu umieszczona nad oryginalnym obrazem – więc strona wygląda niezmieniona, ale jest wyszukiwana i wybierana. Strona wciąż wygląda dokładnie tak, jak to zrobiła – rozpoznany tekst siedzi niewidzialnie za obrazem, więc wyszukiwanie i selekcja pracy bez zmiany wyglądu.
Tak — wysyłanie zestawu i przetwarzanie równoległe pod jednym zestawem ustawień, co jest punktem wykonywania dokumentu przepływu pracy tutaj zamiast kliknięcia przez czytacz pulpitu.
Nie. OCR PDF jest bezpłatny bez konta, a na stronach nic nie jest znaczone. Wysłane dokumenty są usuwane od pracowników wkrótce po zakończeniu pracy.
Każdy standardowy PDF, w tym ten produkowany przez skaner, przez procesora słownego lub sterownika drukowania. Pliki z hasłem właściciela, który ogranicza edycję są obsługiwane; pliki, które potrzebują hasła użytkownika do otwarcia nie są, i nie próbujemy złamać szyfrowania.
Tekst i wektorowe grafiki to obiekty zamiast pikseli, więc pozostają one idealnie ostre w każdym powiększeniu, bez względu na to co się stanie. Tylko wbudowane obrazy rasterowe mogą zniższyć, i tylko jeśli operacja wybrana przez ciebie jest ich ponowna próbka.
JPEG.to jest zbudowane wokół formatu, który posiada prawie każde zdjęcie, które istnieje – trzydzieścia lat, otwarte dosłownie wszystkim, a nadal odpowiednie domyślne dla obrazu fotograficznego. Prace, które ludzie przynoszą tutaj są te, które fotografia gromadzi przez całe życie – zbyt duże, aby e-mail, złe wymiary dla formularza, niewłaściwa droga do wyładunku telefonu. OCR PDF działa na tym samym konwersji i na tym samym konwersji, ponieważ tam te prace lądują.
Konwerter na tej stronie przenosi obrazy do JPEG, PNG, WebP i HEIC, gdzie rozstrzyga się handel między rozmiarem pliku a kolejnym pokoleniem strat. Decydowanie o formacie ostatnim niż pierwszym jest całym: każda dodatkowa oszczędność obrazu fotograficznego to kolejne pokolenie, a im mniej z nich wydajesz, tym więcej obrazu przetrwa.
Tak — te same biblioteki, te same pracownicy, te same kapsłany. Różnica jest, która rada znajduje się na stronie, a tutaj ta rada jest zbudowana na jednej własności formatu, po której nazwana jest strona: .jpeg i.jpg rozszerzenia są tym samym bitstream, więc nic tutaj nie zachowuje się inaczej niż.jpg – tylko nazwa pliku zmienia.
Nic nie jest przechowywane i nie jest potrzebne konto. Wysyłki są usuwane z pracowników wkrótce po zakończeniu pracy; nic nie jest oglądane, wymienione lub indeksowane. Kont kupuje historię i większe partie, a nie dostęp.

Oceń to narzędzie
5.0/5 - 0 głosów
ns6.com — Kup swoją domenę od 2 dolarów rocznie.
Albo upuść swoje pliki tutaj