Je bestanden blijven op je apparaat

Bestanden worden in je browser verwerkt en niet naar onze servers geüpload. De site kan verwerkingsengines downloaden en gebruiks- of feedbackgebeurtenissen verzenden zonder bestandsinhoud.

Zo gaan we met je gegevens om →
← Alle PDF-tools

PDF naar HTML

Maak van ingesloten PDF-tekst een zelfstandig HTML-bestand, per pagina gescheiden, om makkelijk te lezen. Afbeeldingen en opmaak zitten er niet in.

Synthetisch voorbeeld – controleer de instellingen van de bewerking voordat je die uitvoert.

Je documenten blijven op dit apparaat. Downloads van de tools en gebruiksstatistieken bevatten geen bestandsinhoud.

Limieten op je apparaat: Max. grootte van één bestand: 10 MB

Je bestanden worden in je browser verwerkt. Ze worden niet naar deze site geüpload.

Praktische gids

Houd de tekstweergave verbonden met de paginavolgorde.

  1. Selecteer een PDF waarvan de tekst te selecteren is.
  2. Exporteer HTML en open de download lokaal.
  3. Vergelijk de onderdelen en de formulering met de bron-PDF.

Probeer dit voorbeeld

Exporteer een doorzoekbaar voorstel van vijf pagina's naar HTML. Controleer of de samenvatting van pagina 1 en de contactgegevens van pagina 5 in de verwachte onderdelen staan voordat je de tekstkopie deelt.

Voor

  • PDF-pagina's met tekst

Na

  • HTML-paginasecties
Invoer en verwacht resultaat voor deze taak. Illustratief voorbeeld.

Voordat je begint: Dit is geen PDF-weergave of opmaakbehoudende conversie; afbeeldingen en de oorspronkelijke opmaak ontbreken.

Verdergaan met de bron-PDF
Resultaat

Exporteer ingebedde tekst naar een zelfstandig HTML-document met één sectie per pagina. Tekst wordt geëscaped en niet als HTML uitgevoerd. Oorspronkelijke lettertypen, afbeeldingen, tabellen en opmaak blijven niet behouden; geen OCR. Limieten: 10 MiB invoer, 200 pagina's, 4 MiB uitvoer.

Limieten en belangrijke details

Maximaal 10 MiB invoer, 200 pagina's en 4 MiB tekstuitvoer. Gescande documenten zonder tekstlaag geven een foutmelding in plaats van een schijnbaar geslaagde extractie. Leesvolgorde, kolommen en lettertypen komen mogelijk niet overeen met de zichtbare opmaak. Dit is geen OCR en geen PDF naar Word.

Voorbeeld

Exporteer een rapport op tekstbasis en open de gedownloade HTML lokaal. De secties volgen de paginavolgorde van de PDF; lege of gescande pagina's krijgen een label en worden niet stilzwijgend als herkende tekst behandeld.