Vaše soubory zůstávají ve vašem zařízení

Soubory se zpracovávají ve vašem prohlížeči a nenahrávají se na naše servery. Web může stahovat zpracovatelské moduly a odesílat události o používání nebo zpětné vazbě bez obsahu souborů.

Jak nakládáme s vašimi údaji →
← Všechny nástroje PDF

PDF na HTML

Změňte vložený text PDF na samostatný soubor HTML rozdělený po stránkách pro pohodlné čtení. Obrázky a původní rozvržení nejsou součástí výsledku.

Umělý příklad – před spuštěním zkontrolujte nastavení operace.

Vaše dokumenty zůstávají v tomto zařízení. Stahování nástrojů a statistiky používání neobsahují obsah souborů.

Omezení ve vašem zařízení: Max. velikost jednoho souboru: 10 MB

Vaše soubory se zpracovávají ve vašem prohlížeči. Nenahrávají se na tento web.

Praktický návod

Udržte textový náhled propojený s pořadím stránek.

  1. Vyberte PDF, jehož text lze vybírat.
  2. Exportujte HTML a stažený soubor otevřete lokálně.
  3. Porovnejte výsledné oddíly a znění se zdrojovým PDF.

Vyzkoušet tento příklad

Exportujte prohledávatelnou pětistránkovou nabídku do HTML. Ověřte, že souhrn ze stránky 1 a kontaktní údaje ze stránky 5 jsou v očekávaných oddílech, než textovou kopii sdílíte.

Před

  • Stránky PDF s textem

Po

  • Sekce stránek HTML
Vstup a očekávaný výstup této úlohy. Ilustrativní příklad.

Než začnete: Nejde o vykreslení PDF ani o převod se zachováním formátu; obrázky a původní rozvržení se vynechávají.

Pokračovat se zdrojovým PDF
Co získáte

Exportujte vložený text do samostatného dokumentu HTML s jednou sekcí na stránku. Text se zakóduje, nespouští se jako HTML. Původní písma, obrázky, tabulky a rozvržení se nezachovávají; bez OCR. Limity: vstup 10 MiB, 200 stránek, výstup 4 MiB.

Omezení a důležité podrobnosti

Nejvýše 10 MiB vstupu, 200 stránek a 4 MiB textového výstupu. Skenované dokumenty bez textové vrstvy ohlásí chybu místo zdánlivě úspěšné extrakce. Pořadí čtení, sloupce a písma se nemusí shodovat s vizuálním rozvržením. Nejde o OCR ani o převod PDF na Word.

Příklad

Exportujte zprávu založenou na textu a stažený soubor HTML otevřete místně. Sekce sledují pořadí stránek PDF; prázdné či skenované stránky jsou označeny, nikoli tiše považovány za rozpoznaný text.