Vaše soubory zůstávají ve vašem zařízení

Soubory se zpracovávají ve vašem prohlížeči a nenahrávají se na naše servery. Web může stahovat zpracovatelské moduly a odesílat události o používání nebo zpětné vazbě bez obsahu souborů.

Jak nakládáme s vašimi údaji →

PDF na CSV

PDF na CSV: extrahujte tabulky z PDF s vybíratelným textem do souborů CSV, jeden soubor na tabulku. Skenované stránky potřebují nejprve OCR. Soubory zůstávají ve vašem prohlížeči.

Malé stažení převodníku při prvním použití.

PDF · až 10 MiB a 200 stran. PDF s textem; OCR není součástí.

Zjištěné tabulky

Vyzkoušet příklad

Stáhnout ukázku

Soubor CSV by měl obsahovat čtyři řádky a tři sloupce oddělené středníkem, s hodnotami Položka, Množství, Částka a celkem 148,50. Více tabulek se stáhne jako samostatné soubory CSV v archivu ZIP.

Co očekávat

Určeno pro PDF s vloženým textem a pravidelnými řádky tabulek. Skeny nejprve vyžadují OCR. Zjišťování může tabulky přehlédnout nebo umístit text do špatné buňky; porovnejte stažený soubor se svým PDF. Sloučené buňky a původní formátování se nerekonstruují.

Každá tabulka se stane samostatným souborem CSV nebo listem Excelu. Hodnoty zůstávají textem. Hodnoty CSV, které lze vyložit jako vzorce, mají na začátku apostrof; buňky Excelu se ukládají výslovně jako text. Při importu CSV do tabulkového procesoru zvolte textové sloupce, aby se zachovaly počáteční nuly a formát čísel.

Až 10 MiB vstupu, 200 stran, 100 tabulek, 100 000 buněk, 256 sloupců a 8 MiB výstupu. Zpracování se zastaví po 30 sekundách. Nepravidelné řádky se odmítnou, místo aby se tiše posunuly.

Při prvním spuštění se mohou stáhnout soubory převodníku, což chvíli potrvá. Pokud se to nezdaří, zkontrolujte připojení nebo zkuste menší soubor. Tlačítko „Zrušit“ zastaví probíhající zpracování; můžete vybrat jiný soubor a zkusit to znovu.

Licence enginů a zdrojový kód

Praktický návod

Tabulka nalezena, CSV vytvořeno.

  1. Vyberte PDF s vybíratelným textem.
  2. Spusťte „PDF na CSV“.
  3. Zkontrolujte řádky a sloupce každého CSV proti zdrojové tabulce.

Vyzkoušet tento příklad

Extrahujte z PDF tabulku se třemi sloupci a osmi řádky; CSV by mělo obsahovat stejných osm řádků a tři sloupce.

Než začnete: Detekce může přehlédnout složité tabulky nebo tabulky bez ohraničení a ze skenovaných stránek výsledek nevznikne, dokud neprojdou nejprve OCR.