PDF na CSV
PDF na CSV: extrahujte tabulky z PDF s vybíratelným textem do souborů CSV, jeden soubor na tabulku. Skenované stránky potřebují nejprve OCR. Soubory zůstávají ve vašem prohlížeči.
Malé stažení převodníku při prvním použití.
Zjištěné tabulky
Byl tento nástroj užitečný?
Vyzkoušet příklad
Stáhnout ukázkuSoubor CSV by měl obsahovat čtyři řádky a tři sloupce oddělené středníkem, s hodnotami Položka, Množství, Částka a celkem 148,50. Více tabulek se stáhne jako samostatné soubory CSV v archivu ZIP.
Co očekávat
Určeno pro PDF s vloženým textem a pravidelnými řádky tabulek. Skeny nejprve vyžadují OCR. Zjišťování může tabulky přehlédnout nebo umístit text do špatné buňky; porovnejte stažený soubor se svým PDF. Sloučené buňky a původní formátování se nerekonstruují.
Každá tabulka se stane samostatným souborem CSV nebo listem Excelu. Hodnoty zůstávají textem. Hodnoty CSV, které lze vyložit jako vzorce, mají na začátku apostrof; buňky Excelu se ukládají výslovně jako text. Při importu CSV do tabulkového procesoru zvolte textové sloupce, aby se zachovaly počáteční nuly a formát čísel.
Až 10 MiB vstupu, 200 stran, 100 tabulek, 100 000 buněk, 256 sloupců a 8 MiB výstupu. Zpracování se zastaví po 30 sekundách. Nepravidelné řádky se odmítnou, místo aby se tiše posunuly.
Při prvním spuštění se mohou stáhnout soubory převodníku, což chvíli potrvá. Pokud se to nezdaří, zkontrolujte připojení nebo zkuste menší soubor. Tlačítko „Zrušit“ zastaví probíhající zpracování; můžete vybrat jiný soubor a zkusit to znovu.
Praktický návod
Tabulka nalezena, CSV vytvořeno.
- Vyberte PDF s vybíratelným textem.
- Spusťte „PDF na CSV“.
- Zkontrolujte řádky a sloupce každého CSV proti zdrojové tabulce.
Vyzkoušet tento příklad
Extrahujte z PDF tabulku se třemi sloupci a osmi řádky; CSV by mělo obsahovat stejných osm řádků a tři sloupce.
Než začnete: Detekce může přehlédnout složité tabulky nebo tabulky bez ohraničení a ze skenovaných stránek výsledek nevznikne, dokud neprojdou nejprve OCR.