OCR de PDF: criar PDF pesquisável
OCR de PDF: reconheça um PDF digitalizado e adicione texto selecionável em português, inglês, espanhol ou russo. Até 10 páginas e 10 MiB por arquivo. Seus arquivos ficam no seu navegador.
Arquivos de reconhecimento ≈ 26 MB no primeiro uso, mais os dados de idioma.
Texto reconhecido
Esta ferramenta foi útil?
Testar com um exemplo
Baixar exemploDeixe o idioma Português selecionado. Baixe o PDF e pesquise por FATURA, 148,50, João, ENTREGA e 2048. As duas páginas devem ficar iguais ao exemplo, com texto que você pode selecionar e copiar; acentos e cedilha são preservados.
O que esperar
Cada página é reconhecida como imagem, em ordem. Estão disponíveis o reconhecimento em inglês, em russo e misto. O OCR pode ler letras, números, colunas e tabelas de forma errada: revise o resultado. Isso cria um novo PDF a partir de imagens das páginas renderizadas e de uma camada de texto invisível. O tamanho visível da página e a rotação são mantidos; formulários, links, marcadores, anexos e assinaturas digitais não são mantidos. O texto existente é reconhecido de novo; a qualidade da imagem é limitada pela resolução de renderização.
As páginas são renderizadas com até 4 megapixels cada. O carregamento e cada etapa de processamento podem levar até 90 segundos; o trabalho inteiro é interrompido após 10 minutos. Páginas em branco são marcadas no texto. Nenhum download é oferecido se o processamento falhar ou se nenhum texto for reconhecido.
PDF protegido?Desbloqueie-o primeiro com a senha dele.
Na primeira execução, os arquivos do conversor podem ser baixados e isso pode levar um momento. Se falhar, verifique sua conexão ou tente um arquivo menor. “Cancelar” interrompe o processamento em andamento; você pode selecionar outro arquivo e tentar novamente.
Licenças e código-fonte dos motores
Um guia prático
Digitalização entra, PDF pesquisável sai.
- Selecione um PDF digitalizado com até 10 páginas e 10 MiB.
- Escolha português, inglês, espanhol ou russo.
- Procure no PDF resultante uma palavra conhecida para conferir a camada de texto.
Teste este exemplo
Reconheça uma fatura digitalizada de 2 páginas em português; a busca pelo número da fatura no PDF resultante deve encontrá-lo destacado.
Antes de começar: Só há suporte a português, inglês, espanhol e russo, com até 10 páginas e 10 MiB; a precisão do reconhecimento cai em digitalizações de baixa qualidade.