你的檔案會留在你的裝置上

檔案在你的瀏覽器中處理,不會上傳到我們的伺服器。網站可能會下載處理引擎,並傳送不含檔案內容的使用或回饋事件。

我們如何處理你的資料
所有 PDF 工具

PDF 轉 HTML

將 PDF 內嵌的文字轉成獨立、依頁面分隔的 HTML 檔案,方便閱讀。結果不含圖片與原始版面,適合快速檢視文字。

合成範例,執行前請檢查操作設定。

你的文件會留在此裝置上。工具下載和使用統計不包含檔案內容。

本機限制: 單一檔案大小上限: 10 MB

檔案在瀏覽器中處理,不會上傳到本網站。

實用指南

讓文字檢視與頁面順序保持對應

  1. 選擇文字可選取的 PDF。
  2. 匯出 HTML,並在本機開啟下載的檔案。
  3. 將產生的區段與文字和來源 PDF 比對。

試試這個範例

將可搜尋的 5 頁提案匯出為 HTML。分享文字副本之前,確認第 1 頁的摘要與第 5 頁的聯絡資訊出現在預期的區段中。

之前

  • 含文字的 PDF 頁面

之後

  • HTML 頁面區段
此任務的輸入與預期輸出。 示意範例。

開始之前: 這不是 PDF 的轉譯,也不是保留格式的轉換;圖片與原始版面都不包含。

繼續處理來源 PDF
你會得到

將內嵌文字匯出為獨立的 HTML 文件,每頁一個區段。文字會經過跳脫,不會當作 HTML 執行。不保留原始字型、圖片、表格與版面;不含 OCR。限制:輸入 10 MiB、200 頁、輸出 4 MiB。

限制與重要說明

輸入最大 10 MiB、200 頁,文字輸出最大 4 MiB。沒有文字圖層的掃描文件會顯示錯誤,而不是假裝成功擷取。閱讀順序、欄位與字型可能與畫面上的版面不一致。這不是 OCR,也不是 PDF 轉 Word。

範例

匯出以文字為主的報告,並在本機開啟下載的 HTML。各區段依 PDF 頁面順序排列;空白或掃描頁面會加上標示,而不是被默默當成已辨識的文字。