Converti PDF in CSV
PDF in CSV: estrai le tabelle da un PDF con testo selezionabile in file CSV, un file per tabella. Le scansioni richiedono prima l’OCR. I tuoi file restano nel tuo browser.
Piccolo download del convertitore al primo utilizzo.
Tabelle rilevate
Questo strumento ti è stato utile?
Prova un esempio
Scarica l’esempioIl CSV dovrebbe contenere quattro righe e tre colonne separate da punto e virgola, con Articolo, Q.tà, Importo e il totale 148,50. Più tabelle vengono scaricate come CSV separati in uno ZIP.
Cosa aspettarti
Per PDF con testo incorporato e righe di tabella regolari. Le scansioni richiedono prima l’OCR. Il rilevamento può non trovare alcune tabelle o collocare il testo nella cella sbagliata; confronta il file scaricato con il tuo PDF. Le celle unite e la formattazione originale non vengono ricostruite.
Ogni tabella diventa un file CSV o un foglio Excel a sé. I valori restano testo. I valori CSV che potrebbero essere interpretati come formule vengono preceduti da un apostrofo; le celle Excel vengono salvate esplicitamente come testo. Quando importi un CSV in un foglio di calcolo, scegli colonne di testo per conservare gli zeri iniziali e la formattazione dei numeri.
Fino a 10 MiB in ingresso, 200 pagine, 100 tabelle, 100.000 celle, 256 colonne e 8 MiB in uscita. L’elaborazione si interrompe dopo 30 secondi. Le righe irregolari vengono rifiutate invece di essere spostate in silenzio.
Alla prima esecuzione potrebbero essere scaricati i file del convertitore e ci vorrà un momento. Se non riesce, controlla la connessione o prova con un file più piccolo. «Annulla» interrompe l’elaborazione in corso; puoi scegliere un altro file e riprovare.
Licenze e codice sorgente dei motori
Una guida pratica
Tabella rilevata, CSV creato.
- Scegli un PDF con testo selezionabile.
- Avvia «PDF in CSV».
- Confronta righe e colonne di ogni CSV con la tabella di origine.
Prova questo esempio
Estrai da un PDF una tabella di tre colonne e otto righe: il CSV deve contenere esattamente quelle otto righe e tre colonne.
Prima di iniziare: Il rilevamento può non riconoscere tabelle complesse o senza bordi, e le pagine scansionate non producono alcun risultato finché non passano prima dall’OCR.