Seus arquivos ficam no seu dispositivo

Os arquivos são processados no seu navegador e não são enviados aos nossos servidores. O site pode baixar mecanismos de processamento e enviar eventos de uso ou de feedback sem o conteúdo dos arquivos.

Como tratamos seus dados →
← Todas as ferramentas de PDF

Converter PDF para HTML

Transforme o texto incorporado de um PDF em um arquivo HTML independente, separado por páginas, para leitura prática. Imagens e layout original não entram.

Exemplo sintético — confira as configurações da operação antes de executar.

Seus documentos ficam neste dispositivo. Os downloads das ferramentas e as estatísticas de uso não incluem o conteúdo dos arquivos.

Limites no seu dispositivo: Arquivo individual máx.: 10 MB

Os arquivos são processados no seu navegador. Eles não são enviados a este site.

Guia prático

Mantenha a visão de texto ligada à sequência das páginas.

  1. Selecione um PDF cujo texto possa ser selecionado.
  2. Exporte o HTML e abra o arquivo baixado localmente.
  3. Compare as seções e o texto resultantes com o PDF de origem.

Experimente este exemplo

Exporte para HTML uma proposta pesquisável de cinco páginas. Confira se o resumo da página 1 e os dados de contato da página 5 aparecem nas seções esperadas antes de compartilhar a cópia de texto.

Antes

  • Páginas do PDF com texto

Depois

  • Seções de página em HTML
Entrada e resultado esperado desta tarefa. Exemplo ilustrativo.

Antes de começar: Isto não é renderização de PDF nem conversão que preserve o formato; imagens e layout original ficam de fora.

Continuar com o PDF de origem
Resultado

Exporte o texto incorporado para um documento HTML independente, com uma seção por página. O texto é escapado, não executado como HTML. Fontes, imagens, tabelas e layout originais não são preservados; sem OCR. Limites: 10 MiB de entrada, 200 páginas, 4 MiB de saída.

Limites e detalhes importantes

No máximo 10 MiB de entrada, 200 páginas e 4 MiB de saída de texto. Documentos digitalizados sem camada de texto geram um erro em vez de simular uma extração bem-sucedida. A ordem de leitura, as colunas e as fontes podem não corresponder ao layout visual. Isto não é OCR nem conversão de PDF para Word.

Exemplo

Exporte um relatório baseado em texto e abra o HTML baixado localmente. As seções seguem a ordem das páginas do PDF; páginas em branco ou digitalizadas são identificadas, em vez de tratadas em silêncio como texto reconhecido.