1Subir o digitalizado PDF documents; uma digitalização limpa 300 DPI escala de cinzas dá ao reconhecedor mais para trabalhar.
2Diga-lhe que linguagem esperar — nomear a língua bate deixando-a adivinhar por uma ampla margem.
3Execute o passe de reconhecimento; as palavras são escritas de volta como uma camada invisível sentado sobre a imagem da página original.
4Baixe o arquivo PDF pesquisado — parece idêntico, mas agora você pode pesquisar e selecionar o texto nele.
OCR PDF Perguntas frequentes
Que línguas pode reconhecer?
+
Mais de 100, incluindo latim, cirílico, grego, árabe, hebraico, chinês, japonês, coreano e os scripts índicos. Contar que idioma para esperar melhora materialmente a precisão ao deixar adivinhar.
Quão precisa é?
+
Em uma digitalização limpa 300 PPP de texto impresso, o suficiente de alto que erros são raros e principalmente em nomes incomum adequados. A precisão cai bruscamente com baixa resolução, esmaga, sombras de uma câmera de telefone, caras incomum e escrita — em particular, a escrita de mão não é para isso.
Em que devo examinar o melhor resultado?
+
300 PPP em escala de cinzas é o spot doce. Abaixo 200 DPI formas de caracteres começam a descompor; acima 400 DPI você ganha quase nada e paga por ele no tamanho de arquivo e tempo de processamento.
Como OCR PDF transforma uma varredura em texto?
+
Concretamente, cada página é renderizada, passa por um passe de reconhecimento de texto de Teseract, e as palavras reconhecidas são escritas de volta como uma camada de texto invisível posicionada sobre a imagem original — assim a página parece inalterada, mas é pesquisada e selecionável. A página ainda parece exatamente como fez — o texto reconhecido fica visívelmente atrás da imagem, então a pesquisa e seleção funcionam sem alterar a aparência.
Posso correr OCR PDF em vários PDF documents de uma vez?
+
Sim — upload o set e eles processam em paralelo sob um conjunto de configurações, que é o ponto de fazer aqui um fluxo de trabalho de documento em vez de clicar através de um leitor de desktop.
OCR PDF custa alguma coisa?
+
Não OCR PDF é livre sem conta, e nada é estampado nas páginas. Documentos enviados são excluídos dos trabalhadores pouco depois do trabalho completar.
O que posso fazer para OCR PDF?
+
Qualquer PDF padrão, incluindo os produzidos por um scanner, por um processador de texto ou por um driver de impressão. Arquivos com uma senha do proprietário que apenas restringe a edição são manuseados; arquivos que precisam de uma senha do usuário para abrir não são, e não tentamos quebrar a criptografia.
OCR PDF diminuirá a qualidade do meu PDF documents?
+
Texto e arte vetorial são objetos em vez de pixels, por isso eles permanecem perfeitamente afiados em qualquer zoom não importa o que acontecer. Somente as imagens de raster incorporadas podem degradar, e apenas se a operação que você escolheu reamostrá-las.
OCR PDF pertence a um site sobre um formato de foto?
+
JPEG.to é construído em torno do formato que carrega quase todas as fotografias existentes — trinta anos, abertos por literalmente tudo, e ainda o padrão certo para uma imagem fotográfica. Os empregos que as pessoas trazem aqui são os que uma fotografia recolhe sobre sua vida — demasiado grande para enviar e-mail, dimensões erradas para uma forma, caminho de saída errado para fora de um telefone. OCR PDF funciona no mesmo carregamento e a mesma conta que as conversões porque é onde esses empregos aterram.
Qual é o próximo passo sensato depois OCR PDF?
+
O conversor neste site move imagens para e para JPEG, PNG, WebP e HEIC, onde o comércio entre o tamanho do arquivo e mais uma geração de perda fica resolvido. Decidir o formato em vez de primeiro é o ponto inteiro: cada extra saida de uma imagem fotográfica é outra geração, e quanto menos você gasta, mais do quadro sobrevive.
É este o mesmo motor que os outros sítios de conversor?
+
Sim — as mesmas bibliotecas, os mesmos trabalhadores, os mesmos limites. A diferença é que conselhos está na página, e aqui que conselhos é construído em uma propriedade do formato do site é nomeado após: as extensões.jpeg e.jpg são o mesmo bitstream, então nada aqui se comporta diferentemente de.jpg — apenas as alterações de nome de ficheiro.
Há alguma coisa mantida e preciso de me fazer acessórios?
+
Nada é mantido e nenhuma conta é necessária. Os envios são removidos dos trabalhadores pouco depois do trabalho terminado; nada é olhado, listado ou indexado. Uma conta compra história e lotes maiores, não acesso.