Таблицы PDF в Excel
Извлеките таблицы из PDF с выделяемым текстом в книгу Excel, по одной таблице на лист. Сканированным страницам сначала нужен OCR. Файлы остаются в браузере.
Небольшая загрузка конвертера при первом использовании.
Найденные таблицы
Инструмент был полезен?
Проверить на примере
Скачать примерВ книге должен быть один лист из четырёх строк и трёх столбцов: Товар, Кол-во и Сумма. В ячейке C4 должно быть 148,50. Значения сохраняются как текст, чтобы сохранить исходное написание.
Какой будет результат
Для PDF с текстовым слоем и регулярными строками таблиц. Сканы сначала нужно распознать. Таблицы могут быть пропущены, а текст — попасть не в ту ячейку: сверьте результат с PDF. Объединённые ячейки и исходное оформление не восстанавливаются.
Каждая таблица становится отдельным CSV или листом Excel. Значения сохраняются текстом. Перед потенциальными формулами в CSV добавляется апостроф; ячейки Excel записываются как текст. При импорте CSV выбирайте текстовый тип столбцов, чтобы сохранить начальные нули и запись чисел.
До 10 МиБ на входе, 200 страниц, 100 таблиц, 100 000 ячеек, 256 столбцов и 8 МиБ на выходе. Обработка ограничена 30 секундами. Строки с несовпадающей структурой вызывают ошибку.
При первом запуске могут загрузиться файлы конвертера. Если произошёл сбой, проверьте соединение или выберите меньший файл. Отмена останавливает обработку; затем можно выбрать другой файл и повторить.
Лицензии и исходный код движков
Практическое руководство
Таблица найдена — лист создан.
- Выберите PDF с выделяемым текстом.
- Запустите «Таблицы PDF в Excel».
- Сверьте строки и столбцы каждого листа с исходной таблицей.
Проверить на этом примере
Извлеките из PDF таблицу из трёх столбцов и восьми строк: в книге должен быть один лист с теми же восемью строками и тремя столбцами.
Прежде чем начать: Распознавание может пропустить сложные таблицы и таблицы без границ, а сканированные страницы не дают результата, пока не пройдут OCR.