ファイルはお使いの端末に残ります

ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。

データの取り扱いについて

PDFからExcel

選択可能なテキストを持つPDFの表を、Excelブックに抽出します。1つの表が1シートになります。スキャンしたページは先にOCRが必要です。 ファイルはブラウザー内にとどまります。

初回に小さな変換用ファイルをダウンロードします。

PDF・10MiBまで、200ページまで。テキストベースのPDFが対象で、OCRは含まれません。

検出された表

例を試す

サンプルをダウンロード

ブックには、4行3列の1枚のシートが含まれます。セルC4には148.50が入ります。元の表記を保つため、値はテキストとして保存されます。

結果の見方

埋め込みテキストと規則的な表の行を持つPDF向けです。スキャンしたPDFは、先にOCRが必要です。検出では表を見落としたり、テキストが別のセルに入ったりすることがあるため、ダウンロードしたファイルをPDFと見比べてください。結合セルと元の書式は再現されません。

表ごとに、それぞれ別のCSVファイルまたはExcelシートになります。値はテキストのままです。数式として解釈されうるCSVの値には、先頭にアポストロフィが付きます。Excelのセルは明示的にテキストとして保存されます。CSVをスプレッドシートに取り込むときは、先頭のゼロや数値の書式を保つために、列をテキストとして選択してください。

入力は10MiBまで、200ページまで、表は100個まで、セルは100,000個まで、列は256列まで、出力は8MiBまでです。処理は30秒で停止します。行が不揃いな表は、黙ってずらされることなく拒否されます。

初回は、変換用のファイルをダウンロードするため、時間がかかることがあります。失敗した場合は、接続を確認するか、より小さなファイルを試してください。「キャンセル」で実行中の処理を止められます。別のファイルを選んで、もう一度実行することもできます。

エンジンのライセンスとソースコード

実用ガイド

表を検出し、シートを作成

  1. 選択可能なテキストを持つPDFを選択してください。
  2. 「PDFからExcel」を実行してください。
  3. 各シートの行と列を、元の表と見比べて確認してください。

この例を試す

PDFから3列8行の表を抽出します。ブックには、同じ8行3列の1シートが含まれるはずです。

始める前に: 複雑な表や罫線のない表は検出されないことがあります。スキャンしたページは、先にOCRを通すまで結果が出力されません。