免費 — 含 OCR

免費 PDF 轉 Markdown — 掃描檔也讀得出來

碰上掃描的 PDF,多數轉換工具直接投降。這個會先認出來再跑 OCR,掃描的報告、合約、表單照樣能變成真正的 Markdown,表格、標題、公式都在。

把 PDF 拖到這裡,或點擊選擇

最大 10 MB、30 頁 · 登入可提高上限

PDF 轉 Markdown 到底在做什麼

PDF 轉 Markdown,就是把鎖在 PDF 裡的文字與結構取出來,重新寫成純文字:標題變成井字號開頭的行,表格變成直線表格,圖片跟著一起走。真正麻煩的地方在於,相當一部分 PDF 其實是完全沒有文字層的掃描檔——直接擷取什麼都拿不到,只有 OCR 有辦法。本工具會自己判斷你手上是哪一種。拿到 Markdown 之後,還能繼續轉成 Word(.docx)PDFHTML

從 PDF 到 Markdown 的三條路

1

線上工具——上傳 PDF,幾秒鐘就拿到 Markdown。想保住結構又不想安裝東西時最合適,而對需要 OCR 的掃描檔來說,這幾乎是唯一可行的路。

2

命令列——pymupdf4llmmarker 這類函式庫在本機執行,能寫腳本批次處理。適合要處理大量檔案的開發者,代價是得裝環境、調參數,而且預設沒有 OCR。

3

複製貼上——在 PDF 閱讀器裡選取文字再貼到編輯器。只有一段的話夠用,但標題、表格和多欄排版會散掉,掃描頁更是一個字都拿不到。

Example Output

轉出來到底長什麼樣

複製貼上永遠做不到的四件事,這個工具做對了。

標題與結構都留得住

標題層級、巢狀清單、段落分隔會被重建成真正的 Markdown,文件拿到手就能改、能發,而不是黏成一整片文字。

PDF 專案概覽轉換成結構化 Markdown,標題層級與巢狀清單完整保留

表格變成 Markdown 表格

有框線的表格會重建成直線表格,欄位對得整整齊齊。報告、規格表、比較表還能接著用,不會散成零碎文字。

PDF 裡的銷售表格轉換成欄位對齊的 Markdown 直線表格

掃描頁交給 OCR 讀

PDF 沒有文字層時,改由 OCR 直接讀頁面影像:掃描檔、拍照的文件、表單都能涵蓋,支援 170 多種語言,中日韓都在內。

掃描的紙本報告經 OCR 辨識後轉換成可編輯的 Markdown

公式以 LaTeX 形式回來

把公式頁交給 OCR,數學會以真正的 LaTeX 回到 $$ 區塊裡——分式、根號、積分、上標都保著結構,可以直接貼進 Obsidian、Notion 或論文。(數位版 PDF 把公式存成一個個散落的字形,所以真正能還原它們的是 OCR 這條路。)

PDF 公式頁經 OCR 轉換成 Markdown,公式包在錢字號區塊裡以 LaTeX 呈現

完整指南:如何把 PDF 轉成 Markdown

為什麼有的 PDF 順順利利,有的非要 OCR 不可——以及兩種情況下怎麼拿到最乾淨的結果。

數位版 PDF 與掃描版 PDF

數位版 PDF —— 有文字層

由軟體產生(Word、LaTeX、瀏覽器的列印對話框)。字元確確實實在檔案裡,所以擷取又快又幾乎不掉東西。日常文件裡大約 97% 屬於這一類,幾秒就結束。

掃描版 PDF —— 只是一頁頁照片

從影印機、手機相機或傳真機出來的。沒有文字可擷取,選取複製什麼也拿不到。只有 OCR 讀得動——這正是多數免費工具默默還你一個空檔案的原因。

數位版 PDF 與掃描版 PDF 並排比較,標出哪一種需要 OCR

哪些轉得好

單欄文件

報告、技術文件、論文、合約都轉得乾淨:標題保住層級,清單保住巢狀。

有框線的表格

框線看得見的表格會重建成 Markdown 表格,在哪裡打開都顯示正常。

內嵌圖片

PDF 裡的圖會被抽出來並在內文中引用,文件不會缺東西。

掃描檔與表單

沒有文字層的頁面由 OCR 辨識,多語言排版和填好的表單同樣能處理。

怎樣才能轉得最乾淨

  1. 1.

    先讓自動判定拿主意

    原樣上傳就行。工具會先看有沒有文字層,只有檔案確實需要時才提示 OCR,不會讓你為用不上的 OCR 付費。

  2. 2.

    出亂碼時手動強制走 OCR

    舊掃描檔有時帶著多年前留下的劣質 OCR 文字層。這種情況騙得過任何自動判定,所以結果頁一直留著「改用 OCR 重試」按鈕——文字出來是亂的,就按它。

  3. 3.

    多欄頁面記得複查

    側邊欄、註腳、雙欄論文是按 PDF 內部儲存順序讀的,而那個順序不一定等於人的閱讀順序。這些地方在採信之前先掃一眼。

  4. 4.

    太長的文件拆開轉

    頁數上限之所以存在,是因為耗時隨篇幅增加。書籍或卷宗建議按章節轉——順帶也更好逐段複查。

Key Capabilities

這個 PDF 轉 Markdown 工具能搞定什麼

為你還要繼續動手改的文件而做,不只是拿來讀。

掃描版 PDF 的 OCR 辨識

沒有文字層的頁面從影像裡辨識:掃描檔、照片、表單都能涵蓋,支援 170 多種語言,中日韓都在內。

結構原樣保留

標題層級、巢狀清單、引用區塊都以真正的 Markdown 回來,不會壓成一團攤平的段落。

表格轉成直線表格

有框線的表格會按欄位對齊重建,在任何 Markdown 編輯器、wiki 或程式碼儲存庫裡都顯示正常。

公式與圖片

內嵌圖片跟著文件一起走,掃描的技術頁面裡的數學符號由 OCR 找回來。

回到 Word

一鍵把 Markdown 交給 Word 轉換器,下載 .docx——PDF 不肯給你的那份可編輯文件,在這裡拿到。

轉換完即刪除

檔案透過加密連線傳輸,只用於本次轉換,之後隨即刪除。不留存、不分析。

Use Cases

都是誰在用 PDF 轉 Markdown

這個工具每天在做的五件事,總有一件跟你的情境對得上。

開發者

把 API 文件、規格表、廠商手冊從 PDF 裡挖出來,搬進文件站、README 或 wiki——直接能進版本庫的 Markdown。

研究人員

把論文變成 Obsidian、Notion、Zotero 裡的 Markdown 筆記。掃描版的過期刊號走 OCR,公式回來的是 LaTeX 而不是一堆亂碼。

寫作與編輯

從客戶報告、簡報、新聞資料袋裡取出乾淨可編輯的內文,一頁都不用重打,然後回到你慣用的 Markdown 編輯器接著寫。

學生

把課堂投影片、講義、拍照的筆記轉成 Markdown,考前就能搜尋、精簡、重新編排。拍照的頁面交給 OCR。

AI 與 RAG 流程

大型語言模型最吃 Markdown。餵進知識庫、微調資料集或提示詞之前先把來源 PDF 轉一道:結構留住,PDF 那些雜訊不帶進來。

Simple Process

PDF 轉 Markdown 怎麼做

三步搞定,開始不用註冊。

01

上傳 PDF

把檔案拖進來或點選。容量和頁數在動手處理之前就先核過,不會讓你白等一個註定被拒的檔案。

02

數位版還是掃描版,自動認

有文字層的文件立刻開始轉。要是發現是掃描檔,會先問過你再跑 OCR——絕不會默默扣款。

03

複製或下載你的 Markdown

看一遍結果,然後複製到剪貼簿或下載 .md 檔。掃描檔要是出了亂碼,一個按鈕就能改走 OCR 重跑。

FAQ

PDF 轉 Markdown 常見問題

限制、OCR、品質與隱私,直接說清楚。

1

這個 PDF 轉 Markdown 工具免費嗎?

免費。每位訪客每天都有免費轉換次數,註冊帳號還能提高容量與頁數上限。掃描檔的 OCR 每次轉換消耗 1 點,因為背後跑的是收費的辨識引擎。

2

掃描版 PDF 也能用嗎?

能,而這正是它和多數免費工具拉開距離的地方。工具會先看你的 PDF 有沒有真正的文字層;沒有就提示走 OCR,直接從頁面影像裡把字認出來。

3

容量和頁數的限制是多少?

未登入可以轉 10 MB、30 頁以內的 PDF。登入後提高到 30 MB、150 頁,並解鎖掃描檔的 OCR;訂閱用戶可達 50 MB、300 頁。

4

OCR 支援哪些語言?

170 多種,包含中文、日文、韓文、阿拉伯文和主要歐洲語言。多語言混排的頁面一次處理完,不需要事先選語言。

5

表格能保留嗎?

有框線的表格能穩定轉成 Markdown 表格。無框線表格和大量合併儲存格是所有 PDF 解析器的弱點,這些地方在採信之前先核一下。

6

PDF 裡的圖片會怎麼處理?

內嵌圖片會被抽出並在 Markdown 中引用,跟著文件一起走。圖片特別多的大檔案可能會捨棄圖片以確保檔案還能用,發生時會有提示。

7

支援數學公式嗎?

掃描文件裡,OCR 能把公式還原成 LaTeX 記法。數位版 PDF 把公式結構存成一個個定位好的字形而非標記語言,所以複雜公式過來就只剩普通字元——這類頁面改走 OCR 往往效果更好。

8

為什麼我轉出來的內容是亂的?

多欄排版、側邊欄和註腳是按 PDF 內部儲存順序讀的,而那個順序不一定符合人的閱讀習慣。單欄文件的結果要乾淨得多。如果是文字本身糊成一團,那多半是檔案帶著劣質 OCR 文字層——在結果頁按「改用 OCR 重試」。

9

我的 PDF 安全嗎?

安全。檔案透過加密連線傳輸,只用於你要求的這次轉換,處理完成後隨即從儲存空間移除。我們不會讀取你的文件,絕不會拿去訓練模型,也不會出售或公開。上傳檔案的具體處理方式,隱私權政策裡寫得很清楚。

10

轉換 PDF 會消耗積分嗎?

登入後每次轉換都消耗積分:按每 30 頁 1 積分計,不足 30 頁也算 1 積分,掃描檔的 OCR 同樣按此規則。訂閱用戶不限量。

把那份 PDF 變成能動手改的東西

掃描檔也好數位版也好,先轉 Markdown,再去 Word、PDF 或 HTML。

即開即用 · 每日免費轉換次數 · 掃描檔由 OCR 支援