Seus arquivos ficam no seu dispositivo
Os arquivos são processados no seu navegador e não são enviados aos nossos servidores. O site pode baixar mecanismos de processamento e enviar eventos de uso ou de feedback sem o conteúdo dos arquivos.
Como tratamos seus dados →Converter PDF para HTML
Transforme o texto incorporado de um PDF em um arquivo HTML independente, separado por páginas, para leitura prática. Imagens e layout original não entram.
Exemplo sintético — confira as configurações da operação antes de executar.
Seus documentos ficam neste dispositivo. Os downloads das ferramentas e as estatísticas de uso não incluem o conteúdo dos arquivos.
Limites no seu dispositivo: Arquivo individual máx.: 10 MB
Os arquivos são processados no seu navegador. Eles não são enviados a este site.
Guia prático
Mantenha a visão de texto ligada à sequência das páginas.
- Selecione um PDF cujo texto possa ser selecionado.
- Exporte o HTML e abra o arquivo baixado localmente.
- Compare as seções e o texto resultantes com o PDF de origem.
Experimente este exemplo
Exporte para HTML uma proposta pesquisável de cinco páginas. Confira se o resumo da página 1 e os dados de contato da página 5 aparecem nas seções esperadas antes de compartilhar a cópia de texto.
Antes
- Páginas do PDF com texto
Depois
- Seções de página em HTML
Antes de começar: Isto não é renderização de PDF nem conversão que preserve o formato; imagens e layout original ficam de fora.
Continuar com o PDF de origemResultado
Exporte o texto incorporado para um documento HTML independente, com uma seção por página. O texto é escapado, não executado como HTML. Fontes, imagens, tabelas e layout originais não são preservados; sem OCR. Limites: 10 MiB de entrada, 200 páginas, 4 MiB de saída.
Limites e detalhes importantes
No máximo 10 MiB de entrada, 200 páginas e 4 MiB de saída de texto. Documentos digitalizados sem camada de texto geram um erro em vez de simular uma extração bem-sucedida. A ordem de leitura, as colunas e as fontes podem não corresponder ao layout visual. Isto não é OCR nem conversão de PDF para Word.
Exemplo
Exporte um relatório baseado em texto e abra o HTML baixado localmente. As seções seguem a ordem das páginas do PDF; páginas em branco ou digitalizadas são identificadas, em vez de tratadas em silêncio como texto reconhecido.