I tuoi file restano sul tuo dispositivo

I file vengono elaborati nel tuo browser e non vengono caricati sui nostri server. Il sito può scaricare motori di elaborazione e inviare eventi di utilizzo o di feedback senza il contenuto dei file.

Come trattiamo i tuoi dati →
← Tutti gli strumenti PDF

Converti PDF in HTML

Converti PDF in HTML: trasforma il testo incorporato di un PDF in un file HTML autonomo, diviso per pagina. Immagini e layout originale non sono inclusi.

Esempio sintetico — controlla le impostazioni dell’operazione prima di avviarla.

I tuoi documenti restano su questo dispositivo. I download degli strumenti e le statistiche d’uso non includono il contenuto dei file.

Limiti sul tuo dispositivo: Max. per singolo file: 10 MB

I file vengono elaborati nel tuo browser. Non vengono caricati su questo sito.

Guida pratica

Mantieni la vista di testo collegata alla sequenza delle pagine.

  1. Seleziona un PDF con testo selezionabile.
  2. Esporta l’HTML e apri il download in locale.
  3. Confronta sezioni e testo risultanti con il PDF di origine.

Prova questo esempio

Esporta in HTML una proposta ricercabile di cinque pagine. Verifica che il riepilogo della pagina 1 e i contatti della pagina 5 compaiano nelle sezioni previste prima di condividere la copia di testo.

Prima

  • Pagine PDF con testo

Dopo

  • Sezioni di pagina HTML
Input e risultato atteso di questa operazione. Esempio illustrativo.

Prima di iniziare: Non è un rendering del PDF né una conversione che conserva il formato; immagini e layout originale sono omessi.

Continua con il PDF di origine
Risultato

Esporta il testo incorporato in un documento HTML autonomo con una sezione per pagina. Il testo viene sottoposto a escape, non eseguito come HTML. Font, immagini, tabelle e layout originali non vengono conservati; niente OCR. Limiti: 10 MiB in ingresso, 200 pagine, 4 MiB in uscita.

Limiti e dettagli importanti

Al massimo 10 MiB in ingresso, 200 pagine e 4 MiB di testo in uscita. I documenti scansionati senza livello di testo generano un errore invece di simulare un’estrazione riuscita. Ordine di lettura, colonne e font possono non corrispondere al layout visivo. Non è OCR né una conversione da PDF a Word.

Esempio

Esporta un rapporto basato su testo e apri in locale l’HTML scaricato. Le sezioni seguono l’ordine delle pagine del PDF; le pagine vuote o scansionate vengono etichettate invece di essere trattate in silenzio come testo riconosciuto.