ファイルはお使いの端末に残ります
ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。
データの取り扱いについてPDFからテキスト
検索できるPDFのテキストを、再利用できるプレーンテキストのコピーに抽出します。既存のテキストだけで、スキャンしたページは含みません。
サンプルは合成データです。実行する前に操作の設定を確認してください。
ドキュメントはこの端末に残ります。ツールのダウンロードと利用統計には、ファイルの内容は含まれません。
端末での制限: 1ファイルの最大サイズ: 10 MB
ファイルはお使いのブラウザー内で処理されます。このサイトにはアップロードされません。
実践ガイド
ページデザインを変換せず、テキストだけを取得
- テキストを選択できるPDFを選択してください。
- テキストを抽出し、ページごとに区切られた結果を確認してください。
- TXTをコピーまたはダウンロードし、重要な箇所はPDFで確認してください。
この例を試す
検索できる6ページの会議資料からテキストを抽出し、TXTファイルを共有する前に、議題の見出しとアクション項目を元の資料と照らして確認してください。
変更前
- 選択可能なPDFのテキスト
変更後
- プレーンテキスト .txt
始める前に: 出力にはテキストだけが含まれ、元のフォント、画像、レイアウトは含まれません。スキャンしたページは認識されません。
元のPDFで作業を続ける得られる結果
埋め込まれたテキストをTXTファイルに抽出します。スキャンされたページにはOCRが必要です。元の読み順は、見た目のレイアウトと異なる場合があります。
制限事項と重要な注意点
入力は10MiB、200ページ、出力テキストは4MiBまでです。テキストレイヤーのないスキャン文書では、抽出に成功したように見せかけず、エラーが表示されます。読み順、段組み、フォントは見た目のレイアウトと一致しない場合があります。OCRでもPDFからWordへの変換でもありません。
例
検索可能なレポートからテキストを抽出し、結果欄で確認して、コピーまたはダウンロードしてください。テキストの結果の後も、元のPDFは引き続き使えます。