你的檔案會留在你的裝置上
檔案在你的瀏覽器中處理,不會上傳到我們的伺服器。網站可能會下載處理引擎,並傳送不含檔案內容的使用或回饋事件。
我們如何處理你的資料PDF 轉 Markdown
為可搜尋的 PDF 建立 Markdown 文字副本,並保留來源頁面的分組。既有文字會逐字匯出,不會重建版面。
合成範例,執行前請檢查操作設定。
你的文件會留在此裝置上。工具下載和使用統計不包含檔案內容。
本機限制: 單一檔案大小上限: 10 MB
檔案在瀏覽器中處理,不會上傳到本網站。
實用指南
讓擷取的文字保有頁面脈絡
- 選擇含有既有文字層的 PDF。
- 匯出為 Markdown,並檢查每個頁面區段。
- 只重複使用已對照原始 PDF 檢查過的文字。
試試這個範例
將可搜尋的 3 頁客戶簡報轉成 Markdown。確認所要求的日期與兩個待辦事項,和在 PDF 中一樣位於同一個來源頁面的標題之下。
之前
- PDF:你好
之後
- 頁面標題 + 原文文字區塊
範例 .md 檔案
## Page 1
來自 PDF 的問候,陳怡君!可選取的原始文字:來自 PDF 的問候,陳怡君!
開始之前: 這會將既有文字以逐字的程式碼區塊匯出,不會將 PDF 轉成可編輯的版面。
繼續處理來源 PDF你會得到
將內嵌文字匯出為依頁面分組的原文 Markdown 程式碼區塊。不會重建標題、表格、圖片或原始版面。沒有文字的頁面會加上標示;不含 OCR。限制:輸入 10 MiB、200 頁、輸出 4 MiB。
限制與重要說明
輸入最大 10 MiB、200 頁,文字輸出最大 4 MiB。沒有文字圖層的掃描文件會顯示錯誤,而不是假裝成功擷取。閱讀順序、欄位與字型可能與畫面上的版面不一致。這不是 OCR,也不是 PDF 轉 Word。
範例
將可選取的報告文字匯出為 .md。頁面標題由系統產生;PDF 文字會原樣保留在程式碼區塊中,而不會變成可執行的 HTML 或推測出的表格。重複使用前應先檢查閱讀順序。