Fájljai az eszközén maradnak

A fájlokat a böngészőjében dolgozzuk fel, és nem töltjük fel a szervereinkre. Az oldal letölthet feldolgozómotorokat, és a fájlok tartalma nélkül küldhet használati vagy visszajelzési eseményeket.

Hogyan kezeljük az adatait →
← Az összes PDF-eszköz

PDF-ből HTML

A PDF beágyazott szövegéből önálló, oldalakra tagolt HTML-fájl a kényelmes olvasáshoz. A képek és az eredeti elrendezés nem része az eredménynek.

Szintetikus példa – futtatás előtt ellenőrizze a művelet beállításait.

A dokumentumai ezen az eszközön maradnak. Az eszközök letöltése és a használati statisztikák nem tartalmazzák a fájlok tartalmát.

Korlátok az eszközén: Legnagyobb fájlméret: 10 MB

A fájlokat a böngésző dolgozza fel. Nem kerülnek feltöltésre erre a webhelyre.

Gyakorlati útmutató

A szöveges nézet maradjon kapcsolatban az oldalsorrenddel.

  1. Válasszon ki egy PDF-et, amelynek szövege kijelölhető.
  2. Exportáljon HTML-be, és nyissa meg a letöltést helyben.
  3. Vesse össze az eredményül kapott szakaszokat és szövegezést a forrás-PDF-fel.

Próbálja ki ezt a példát

Exportáljon egy kereshető, ötoldalas ajánlatot HTML-be. A szöveges másolat megosztása előtt ellenőrizze, hogy az 1. oldal összefoglalója és az 5. oldal elérhetőségei a várt szakaszokban szerepelnek.

Előtte

  • PDF-oldalak szöveggel

Utána

  • HTML oldalszakaszok
Bemenet és várt eredmény ehhez a feladathoz. Szemléltető példa.

Mielőtt elkezdi: Ez nem PDF-megjelenítés és nem formátumőrző átalakítás; a képek és az eredeti elrendezés kimaradnak.

Folytatás a forrás-PDF-fel
Mit kap

A beágyazott szöveget önálló HTML-dokumentumba exportálja, oldalanként egy szakasszal. A szöveg escape-elt, nem HTML-ként fut le. Az eredeti betűtípusok, képek, táblázatok és az elrendezés nem maradnak meg; nincs OCR. Korlátok: 10 MiB bemenet, 200 oldal, 4 MiB kimenet.

Korlátok és fontos részletek

Legfeljebb 10 MiB bemenet, 200 oldal és 4 MiB szövegkimenet. A szövegréteg nélküli beolvasott dokumentumoknál hibaüzenet jelenik meg látszatsikeres kinyerés helyett. Az olvasási sorrend, az oszlopok és a betűtípusok eltérhetnek a vizuális elrendezéstől. Ez nem OCR, és nem PDF-ből Word átalakítás.

Példa

Exportáljon egy szövegalapú jelentést, és nyissa meg a letöltött HTML-t helyben. A szakaszok a PDF oldalsorrendjét követik; az üres és a beolvasott oldalak jelölést kapnak, nem kezeli őket csendben felismert szövegként.