ファイルはお使いの端末に残ります

ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。

データの取り扱いについて
すべてのPDFツール

PDFからMarkdown

検索できるPDFのMarkdownコピーを、元のページごとのまとまりを保って作成します。既存のテキストをそのまま書き出し、レイアウトは再構築しません。

サンプルは合成データです。実行する前に操作の設定を確認してください。

ドキュメントはこの端末に残ります。ツールのダウンロードと利用統計には、ファイルの内容は含まれません。

端末での制限: 1ファイルの最大サイズ: 10 MB

ファイルはお使いのブラウザー内で処理されます。このサイトにはアップロードされません。

実践ガイド

抽出した文言に、ページの文脈を残す

  1. テキスト層のあるPDFを選択してください。
  2. Markdownに書き出し、ページごとのセクションをすべて確認してください。
  3. 元のPDFと照らして確認した文言だけを再利用してください。

この例を試す

検索できる3ページの顧客向け概要書をMarkdownに変換します。依頼された日付と2つのアクション項目が、PDFと同じ元ページの見出しの下にあることを確認してください。

変更前

  • PDF:こんにちは

変更後

  • ページの見出し+そのままのテキストブロック
このタスクの入力と、期待される出力です。 説明用の例です。

サンプルの.mdファイル

## Page 1

    PDFからこんにちは、山田太郎さん!

選択できるソーステキスト:PDFからこんにちは、山田太郎さん!

始める前に: 既存のテキストをそのままコードブロックとして書き出すもので、PDFを編集できるレイアウトに変換するものではありません。

元のPDFで作業を続ける
得られる結果

埋め込まれたテキストを、ページごとにまとめたMarkdownのコードブロックとして、そのまま書き出します。見出し、表、画像、元のレイアウトは再構築されません。テキストのないページにはその旨が表示されます。OCRはありません。上限:入力10MiB、200ページ、出力4MiB。

制限事項と重要な注意点

入力は10MiB、200ページ、出力テキストは4MiBまでです。テキストレイヤーのないスキャン文書では、抽出に成功したように見せかけず、エラーが表示されます。読み順、段組み、フォントは見た目のレイアウトと一致しない場合があります。OCRでもPDFからWordへの変換でもありません。

例

選択可能なレポートのテキストを.mdに書き出してください。ページの見出しは自動で生成されます。PDFのテキストはコードブロック内にそのまま残り、実行可能なHTMLや推測された表にはなりません。再利用する前に読み順を確認してください。