Plano livre: 1 conversão/hora, 1 arquivo de cada vez
Ir Ilimitado →

OCR PDF

PDF Reconhecimento de texto

Selecione seus arquivos

*Arquivos excluídos após 24 horas

Converta arquivos de até 1 GB gratuitamente. Usuários Pro podem converter arquivos de até 100 GB. Cadastre-se agora!

Carregando

0%

Como OCR PDF

1 Subir o digitalizado PDF documents; uma digitalização limpa 300 DPI escala de cinzas dá ao reconhecedor mais para trabalhar.
2 Diga-lhe que linguagem esperar — nomear a língua bate deixando-a adivinhar por uma ampla margem.
3 Execute o passe de reconhecimento; as palavras são escritas de volta como uma camada invisível sentado sobre a imagem da página original.
4 Baixe o arquivo PDF pesquisado — parece idêntico, mas agora você pode pesquisar e selecionar o texto nele.

OCR PDF Perguntas frequentes

Que línguas pode reconhecer?
+
Mais de 100, incluindo latim, cirílico, grego, árabe, hebraico, chinês, japonês, coreano e os scripts índicos. Contar que idioma para esperar melhora materialmente a precisão ao deixar adivinhar.
Em uma digitalização limpa 300 PPP de texto impresso, o suficiente de alto que erros são raros e principalmente em nomes incomum adequados. A precisão cai bruscamente com baixa resolução, esmaga, sombras de uma câmera de telefone, caras incomum e escrita — em particular, a escrita de mão não é para isso.
300 PPP em escala de cinzas é o spot doce. Abaixo 200 DPI formas de caracteres começam a descompor; acima 400 DPI você ganha quase nada e paga por ele no tamanho de arquivo e tempo de processamento.
Concretamente, cada página é renderizada, passa por um passe de reconhecimento de texto de Teseract, e as palavras reconhecidas são escritas de volta como uma camada de texto invisível posicionada sobre a imagem original — assim a página parece inalterada, mas é pesquisada e selecionável. A página ainda parece exatamente como fez — o texto reconhecido fica visívelmente atrás da imagem, então a pesquisa e seleção funcionam sem alterar a aparência.
Sim — upload o set e eles processam em paralelo sob um conjunto de configurações, que é o ponto de fazer aqui um fluxo de trabalho de documento em vez de clicar através de um leitor de desktop.
Não OCR PDF é livre sem conta, e nada é estampado nas páginas. Documentos enviados são excluídos dos trabalhadores pouco depois do trabalho completar.
Qualquer PDF padrão, incluindo os produzidos por um scanner, por um processador de texto ou por um driver de impressão. Arquivos com uma senha do proprietário que apenas restringe a edição são manuseados; arquivos que precisam de uma senha do usuário para abrir não são, e não tentamos quebrar a criptografia.
Texto e arte vetorial são objetos em vez de pixels, por isso eles permanecem perfeitamente afiados em qualquer zoom não importa o que acontecer. Somente as imagens de raster incorporadas podem degradar, e apenas se a operação que você escolheu reamostrá-las.
JPEG.to é construído em torno do formato que carrega quase todas as fotografias existentes — trinta anos, abertos por literalmente tudo, e ainda o padrão certo para uma imagem fotográfica. Os empregos que as pessoas trazem aqui são os que uma fotografia recolhe sobre sua vida — demasiado grande para enviar e-mail, dimensões erradas para uma forma, caminho de saída errado para fora de um telefone. OCR PDF funciona no mesmo carregamento e a mesma conta que as conversões porque é onde esses empregos aterram.
O conversor neste site move imagens para e para JPEG, PNG, WebP e HEIC, onde o comércio entre o tamanho do arquivo e mais uma geração de perda fica resolvido. Decidir o formato em vez de primeiro é o ponto inteiro: cada extra saida de uma imagem fotográfica é outra geração, e quanto menos você gasta, mais do quadro sobrevive.
Sim — as mesmas bibliotecas, os mesmos trabalhadores, os mesmos limites. A diferença é que conselhos está na página, e aqui que conselhos é construído em uma propriedade do formato do site é nomeado após: as extensões.jpeg e.jpg são o mesmo bitstream, então nada aqui se comporta diferentemente de.jpg — apenas as alterações de nome de ficheiro.
Nada é mantido e nenhuma conta é necessária. Os envios são removidos dos trabalhadores pouco depois do trabalho terminado; nada é olhado, listado ou indexado. Uma conta compra história e lotes maiores, não acesso.

Avalie esta ferramenta
5.0/5 - 0 votos
ns6.com — 800 + extensões de domínio. Encontre o seu nome perfeito.
Ou arraste seus arquivos para cá.