Je bestanden blijven op je apparaat
Bestanden worden in je browser verwerkt en niet naar onze servers geüpload. De site kan verwerkingsengines downloaden en gebruiks- of feedbackgebeurtenissen verzenden zonder bestandsinhoud.
Zo gaan we met je gegevens om →PDF naar HTML
Maak van ingesloten PDF-tekst een zelfstandig HTML-bestand, per pagina gescheiden, om makkelijk te lezen. Afbeeldingen en opmaak zitten er niet in.
Synthetisch voorbeeld – controleer de instellingen van de bewerking voordat je die uitvoert.
Je documenten blijven op dit apparaat. Downloads van de tools en gebruiksstatistieken bevatten geen bestandsinhoud.
Limieten op je apparaat: Max. grootte van één bestand: 10 MB
Je bestanden worden in je browser verwerkt. Ze worden niet naar deze site geüpload.
Praktische gids
Houd de tekstweergave verbonden met de paginavolgorde.
- Selecteer een PDF waarvan de tekst te selecteren is.
- Exporteer HTML en open de download lokaal.
- Vergelijk de onderdelen en de formulering met de bron-PDF.
Probeer dit voorbeeld
Exporteer een doorzoekbaar voorstel van vijf pagina's naar HTML. Controleer of de samenvatting van pagina 1 en de contactgegevens van pagina 5 in de verwachte onderdelen staan voordat je de tekstkopie deelt.
Voor
- PDF-pagina's met tekst
Na
- HTML-paginasecties
Voordat je begint: Dit is geen PDF-weergave of opmaakbehoudende conversie; afbeeldingen en de oorspronkelijke opmaak ontbreken.
Verdergaan met de bron-PDFResultaat
Exporteer ingebedde tekst naar een zelfstandig HTML-document met één sectie per pagina. Tekst wordt geëscaped en niet als HTML uitgevoerd. Oorspronkelijke lettertypen, afbeeldingen, tabellen en opmaak blijven niet behouden; geen OCR. Limieten: 10 MiB invoer, 200 pagina's, 4 MiB uitvoer.
Limieten en belangrijke details
Maximaal 10 MiB invoer, 200 pagina's en 4 MiB tekstuitvoer. Gescande documenten zonder tekstlaag geven een foutmelding in plaats van een schijnbaar geslaagde extractie. Leesvolgorde, kolommen en lettertypen komen mogelijk niet overeen met de zichtbare opmaak. Dit is geen OCR en geen PDF naar Word.
Voorbeeld
Exporteer een rapport op tekstbasis en open de gedownloade HTML lokaal. De secties volgen de paginavolgorde van de PDF; lege of gescande pagina's krijgen een label en worden niet stilzwijgend als herkende tekst behandeld.