Dine filer bliver på din enhed

Filer behandles i din browser og uploades ikke til vores servere. Webstedet kan hente behandlingsmotorer og sende brugs- eller feedbackhændelser uden filindhold.

Sådan behandler vi dine data →
← Alle PDF-værktøjer

PDF til HTML

Gør indlejret PDF-tekst til en selvstændig HTML-fil delt op efter side, så den er let at læse. Billeder og det oprindelige layout er ikke med i resultatet.

Syntetisk eksempel – gennemgå handlingens indstillinger, før du kører den.

Dine dokumenter bliver på denne enhed. Download af værktøjerne og brugsstatistik indeholder ikke filindhold.

Grænser på din enhed: Maks. størrelse pr. fil: 10 MB

Dine filer behandles i din browser. De uploades ikke til dette websted.

Praktisk vejledning

Hold tekstvisningen knyttet til siderækkefølgen.

  1. Vælg en PDF, hvor teksten kan markeres.
  2. Eksportér HTML, og åbn den downloadede fil lokalt.
  3. Sammenlign afsnit og ordlyd i resultatet med kilde-PDF'en.

Prøv dette eksempel

Eksportér et søgbart tilbud på fem sider til HTML. Kontrollér, at resuméet på side 1 og kontaktoplysningerne på side 5 står i de forventede afsnit, før du deler tekstkopien.

Før

  • PDF-sider med tekst

Efter

  • HTML-sideafsnit
Kildefil og forventet resultat for denne opgave. Illustrerende eksempel.

Før du starter: Det er hverken PDF-gengivelse eller en konvertering, der bevarer formatet; billeder og det oprindelige layout er udeladt.

Fortsæt med kilde-PDF'en
Resultat

Eksporter indlejret tekst til et selvstændigt HTML-dokument med ét afsnit pr. side. Teksten escapes og køres ikke som HTML. Originale skrifttyper, billeder, tabeller og layout bevares ikke; ingen OCR. Grænser: 10 MiB input, 200 sider, 4 MiB output.

Grænser og vigtige detaljer

Højst 10 MiB input, 200 sider og 4 MiB tekstoutput. Scannede dokumenter uden tekstlag giver en fejl i stedet for et falsk vellykket udtræk. Læserækkefølge, spalter og skrifttyper svarer måske ikke til det visuelle layout. Det er hverken OCR eller PDF til Word.

Eksempel

Eksporter en tekstbaseret rapport, og åbn den downloadede HTML lokalt. Afsnittene følger PDF-filens siderækkefølge; tomme/scannede sider mærkes i stedet for stiltiende at blive behandlet som genkendt tekst.