ファイルはお使いの端末に残ります

ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。

データの取り扱いについて

OCR PDF:検索可能なPDFの作成

スキャンしたPDFを認識し、日本語・英語・スペイン語・ロシア語の選択可能なテキストを追加します。制限は、1ファイルあたり10ページ・10MiBまでです。 ファイルはブラウザー内にとどまります。

認識用ファイルは初回に約26MBで、これに言語データが加わります。

PDF・10MiBまで、10ページまで。テキストは1MiBまで、検索可能なPDFは30MiBまで。

認識されたテキスト

例を試す

サンプルをダウンロード

言語は「日本語」を選択します。PDFをダウンロードして、請求書、148.50、納品、2048を検索してください。2ページともサンプルと同じ見た目で、テキストを選択してコピーできます。

結果の見方

各ページは画像として順番に認識されます。英語、ロシア語、混在の認識に対応しています。OCRは文字、数字、列、表を誤って読み取ることがあるため、結果を確認してください。 レンダリングしたページ画像と、見えないテキスト層から、新しいPDFを作成します。表示上のページサイズと回転は保持されます。フォーム、リンク、しおり、添付ファイル、デジタル署名は保持されません。既存のテキストは再度認識され、画像の品質はレンダリング解像度に制限されます。

ページは1枚あたり最大4メガピクセルでレンダリングされます。読み込みと各処理ステップは90秒まで、ジョブ全体は10分で停止します。空白のページはテキスト内に記されます。処理に失敗した場合や、テキストが認識されなかった場合は、ダウンロードは提供されません。

保護されたPDFですか?先にパスワードでロックを解除してください。

初回は、変換用のファイルをダウンロードするため、時間がかかることがあります。失敗した場合は、接続を確認するか、より小さなファイルを試してください。「キャンセル」で実行中の処理を止められます。別のファイルを選んで、もう一度実行することもできます。

エンジンのライセンスとソースコード

実用ガイド

スキャンを入れて、検索できるPDFを出す

  1. 10ページ・10MiB以内のスキャンPDFを選択してください。
  2. 日本語、英語、スペイン語、ロシア語から選択してください。
  3. できあがったPDFで知っている単語を検索し、テキストレイヤーを確認してください。

この例を試す

2ページのスキャンした請求書を日本語で認識します。請求書番号を検索すると、できあがったPDFで強調表示されて見つかるはずです。

始める前に: 対応するのは日本語・英語・スペイン語・ロシア語のみで、10ページ・10MiBまでです。低品質のスキャンでは、認識の精度が下がります。