Plan gratuito: 1 conversión/hora, 1 archivo a la vez
Ir ilimitado →

PDF con reconocimiento óptico de caracteres

PDF Reconocimiento de texto

Seleccione sus archivos

*Archivos eliminados después de 24 horas

Convierte archivos de hasta 1 GB gratis. Los usuarios Pro pueden convertir archivos de hasta 100 GB. Regístrate ahora.

Subiendo

0%

Cómo OCR PDF

1 Sube el PDF documents escaneado; un escaneo de escala de grises limpio de 300 DPI le da al reconocidor el máximo con el que trabajar.
2 Dile qué idioma esperar — nombrar el idioma late dejando que adivine por un amplio margen.
3 Ejecute el pase de reconocimiento; las palabras se escriben de nuevo como una capa invisible sentada sobre la imagen original de la página.
4 Descargue el archivo PDF que puede buscarse, pero ahora puede buscar y seleccionar el texto que contiene.

PDF con reconocimiento óptico de caracteres Preguntas frecuentes

¿Qué idiomas puede reconocer?
+
Más de 100, incluyendo latín, cirílico, griego, árabe, hebreo, chino, japonés, coreano y las escrituras índicas. Diciéndole qué idioma esperar mejora materialmente la precisión sobre dejar que adivine.
En un escaneo limpio de 300 DPI de texto impreso, lo suficientemente alto como para que los errores sean raros y sobre todo en sustantivos apropiados inusuales. La precisión se cae bruscamente con baja resolución, sesgo, sombras de una cámara telefónica, tipografías inusuales y escritura a mano — la escritura a mano en particular no es para lo que esto es.
300 DPI en escala de grises es el punto dulce. Por debajo de 200 DPI de caracteres de formas comienzan a descomponerse; por encima de 400 DPI usted gana casi nada y paga por él en tamaño de archivo y tiempo de procesamiento.
Concretamente, cada página se representa, se ejecuta a través de una Tesseract texto-reconocimiento pase, y las palabras reconocidas se escriben de nuevo como una capa de texto invisible situado sobre la imagen original — por lo que la página parece sin cambios pero es buscable y seleccionable. La página todavía se ve exactamente como lo hizo — el texto reconocido se encuentra invisiblemente detrás de la imagen así que la búsqueda y selección de trabajo sin cambiar la apariencia.
Sí — subir el conjunto y procesar en paralelo bajo un conjunto de ajustes, que es el punto de hacer un flujo de trabajo de documentos aquí en lugar de hacer clic a través de un lector de escritorio.
No. OCR PDF es gratis sin una cuenta, y nada se estampa en las páginas. Los documentos cargados se eliminan de los trabajadores poco después de que el trabajo completa.
Cualquier PDF estándar, incluyendo los producidos por un escáner, por un procesador de textos o por un controlador de impresión. Los archivos con una contraseña de propietario que sólo restringe la edición se manejan; los archivos que necesitan una contraseña de usuario para abrir no lo son, y no intentamos romper el cifrado.
Texto y vector de arte son objetos en lugar de píxeles, por lo que permanecen perfectamente nítidos en cualquier zoom no importa lo que suceda. Sólo las imágenes de raster incrustadas pueden degradarse, y sólo si la operación que usted eligió los vuelve a muestrear.
JPEG.to está construido alrededor del formato que lleva casi todas las fotografías en existencia — treinta años de edad, abierto por literalmente todo, y todavía el defecto correcto para una imagen fotográfica. Los trabajos que la gente trae aquí son los que una fotografía recoge durante su vida — demasiado grande para enviar un correo electrónico, dimensiones incorrectas para un formulario, manera equivocada de salir de un teléfono. OCR PDF se ejecuta en la misma carga y la misma cuenta que las conversiones porque es ahí donde esos trabajos aterrizan.
El convertidor de este sitio mueve imágenes a JPEG, PNG, WebP y HEIC, que es donde se resuelve el comercio entre el tamaño del archivo y una generación más de pérdidas. Decidir el formato último en lugar de primero es el punto completo: cada extra de una imagen fotográfica es otra generación, y cuanto menos de ellos se gasta, más sobrevive la imagen.
Sí — las mismas bibliotecas, los mismos trabajadores, los mismos topes. La diferencia es qué consejo está en la página, y aquí que el consejo se construye en una propiedad del formato que el sitio lleva el nombre de: las extensiones.jpeg y.jpg son el mismo flujo de bits, por lo que nada aquí se comporta de forma diferente a un.jpg — sólo el nombre de archivo cambia.
No se guarda nada y no se necesita ninguna cuenta. Las cargas se retiran de los trabajadores poco después de que el trabajo termina; nada se mira, enumera o indiza. Una cuenta compra historial y lotes más grandes, no acceso.

Califica esta herramienta
5.0/5 - 0 votos
ns6.com — 800+ extensiones de dominio. Encuentre su nombre perfecto.
O aterrice sus archivos aquí.