功能
Markdown 轉換功能,端到端。
解析、檢查、批次轉換並匯出 Markdown —— 在網頁端和透過 API 都能完成。
本功能頁說明 markitdown.ai 的 Markdown 轉換功能,如何把 PDF、Office 檔案、圖片和 HTML 轉換成可供 RAG 與智慧體使用的結構化 Markdown。 匿名試用接受最大 10 MB、25 頁的檔案,每個 IP 每小時 3 次、每天 10 次轉換。Lite 每月 $20 起,單檔案最大 100 MB。Pro 每月 $50,Max 每月 $100。

01 · 解析
每一頁都能得到準確的 Markdown
每個檔案按頁面上實際包含的內容來路由:文字層直接讀取,掃描頁或圖片走 OCR,兩者都按每頁 1 credit 計費。標題、列表、表格和閱讀順序都會輸出為 Markdown。
- 掃描件、照片和截圖的 OCR
- 付費套餐中針對圖表和圖示的 AI 圖表增強(每個圖表 3 credit)
- 快取結果可選:關閉後檔案會重新解析,而不復用快取結果
02 · 檢視器
並排預覽 Markdown
在檢視器中開啟任意一次轉換:一側是原始檔,另一側是渲染後的 Markdown 或原始原始碼。讓損壞的表格在進入你的流水線之前就被發現。
- 原始檔與 Markdown 並排
- 渲染預覽與原始 Markdown 原始碼,一鍵切換
- 複製,或下載 .md 檔案
03 · 批次
批次把檔案轉換為 Markdown
把一批檔案打包成 ZIP 或一個 URL 列表排隊。追蹤每個檔案,重試失敗的那些,並保留每次執行的歷史。
- 帶逐檔案狀態的即時進度
- 重試失敗檔案而無需重跑其餘檔案
- 批次歷史,含每個檔案消耗的 credit
04 · 庫與帳號
你的 Markdown 庫,全程有記錄
每次轉換都會按你套餐的歷史視窗儲存到庫中——Lite 30 天、Pro 60 天、Max 90 天。用量、帳單和 API 活動都在設定裡。
- 原始檔與其 Markdown 配對儲存的庫
- 按路由和日期統計的用量,外加帳單
- 限定範圍的 API 金鑰、webhook 和活動日誌
05 · 能力
Markdown 轉換功能,細到每個細節

真正的 Markdown 表格
行、列和表頭都會輸出為 GitHub 風格的豎線表格——而不是被壓平的一串數字——適用於 PDF、Office 檔案、試算表和 HTML。
快取控制
對重複的檔案複用匹配的結果,或按每次執行關閉快取。
圖表描述
在付費套餐中,圖表和圖示可以用文字描述出來,供模型推理。
文件、表格、幻燈片與網頁
PDF、Word、PowerPoint、Excel、CSV、EPUB、OpenDocument、圖片、HTML 和 URL。
可稽核的用量
按路由和日期統計的 credit,外加帳單和活動日誌。
指南
用真實樣本測試
用一個能反映你實際要處理的工作的樣本來測試。要包含一張難處理的表格、一個章節邊界和來源引用,而不是隻測一段短文字。把同一份文件在預覽、Markdown 原始碼和你目標落點裡分別對照。這能把解析差異和顯示差異區分開,並給你一個實用的依據,判斷某套自動化工作流能否承接更大的文件集。
按來源類型選擇功能
按你實際拿到的來源來選擇 Markdown 轉換功能。一份可編輯的 Word 文件、一份純圖片 PDF 和一個公開網頁,暴露出的結構各不相同。一次成功的轉換應當給你該來源的可讀呈現,但之後要做的檢查會不同。對 Word 文件,對照標題大綱並複核批註。對掃描件,檢查不確定的字元和表格儲存格。對網頁,留意本不該進入下游文件的導航或頁尾文字。試一個有代表性的難輸入,比只轉換一段簡單文字能告訴你更多。在評估轉換是否對你的任務有用時,把原始檔和輸出放在一起看。
檢查準確性
用能直接與原始檔對照的段落來評估 Markdown 轉換的準確性。檢查一個標題、一段位於分欄邊界附近的文字、一張帶單位的表格,以及文件的最後一節。一個乾淨的預覽很有用,但它可能掩蓋一個被漏掉的限定條件,或一個落在錯誤表頭下的數值。當你需要檢視提示詞或攝取指令碼會收到的那段確切文字時,切到 Markdown 原始碼。本服務產出一份輸出產物;它並不獨立判定原始材料的真偽。複用抽取出的內容時保留來源引用,尤其是當另一個人需要核對某段引文,或把檢索到的答案回溯到文件時。
檢索工作流
Markdown 轉換屬於分塊、索引和檢索這些應用專屬工作之前的一步。標題和表格能給切分器比一整條扁平文字流更好的邊界,但它們不會替你選嵌入模型,也不保證搜尋一定返回正確段落。要把文件標題和章節上下文與你應用建立的分塊放在一起。用你在原始檔裡核對過答案的代表性問題做測試。如果一張表格跨越多個分塊,檢查每一段被檢索到的內容是否仍帶有它的表頭和單位。像 LangChain 和 LlamaIndex 這類工具可以參與你自己的攝取工作流;Markdown 輸出是那套工作流可複用的輸入,而不是一個完整的搜尋系統。
瀏覽器、批次與 API
用瀏覽器檢查單個結果,用批次轉換整理重複的檔案,用 API 把轉換接入你自己的應用。這些入口共用帳號的轉換服務和 credit 餘額,但它們解決的是不同的互動需求。瀏覽器複核讓你在自動化之前先看清一份輸出。批次給出可以回看的逐檔案結果。API 整合則要處理驗證、請求限額和非同步完成。只有在你審查過預期會收到的來源類型之後,才開始自動化,並保留一條追查單個失敗的途徑。從單個檔案走向大批次,改變的是你追蹤結果的方式,而不是丟掉讓第一個結果有用的那些品質檢查。
現已可用
文件、網頁和圖片解析現已能產出 Markdown。瀏覽器還提供 Markdown 轉 HTML、純文字和可列印 PDF。瀏覽器列印是目前可用的 PDF 輸出路徑;它不是伺服器生成的 PDF 下載。結構化 JSON 抽取、音訊和影片轉錄,以及伺服器端 PDF 或 DOCX 輸出都是規劃中的能力。不要圍繞規劃中的路由搭建目前整合,也不要以為 OCR 就給出了照片或圖表的完整描述。針對你需要的輸入和輸出,去讀對應的轉換器頁面,然後驗證一個有代表性的結果。產品專注於可複用的內容,所以精確的版式還原和協作文件編輯不屬於這套工作流。
FAQ
常見問題
是什麼讓 Markdown 轉換功能的輸出適合 AI?
轉換會在可能的情況下保留標題、列表、表格和閱讀順序,因此這份 Markdown 轉換功能的輸出足夠可預測,可以直接分塊、嵌入和檢索,無需手動清理。
可以轉換哪些檔案類型?
常見文件格式包括 PDF、Word、PowerPoint、Excel、圖片和網頁內容。匿名試用接受最大 10 MB、25 頁的檔案,每個 IP 每小時 3 次、每天 10 次。
可以用在 RAG 或智慧體工作流裡嗎?
可以。乾淨的 Markdown 本就是在分塊和嵌入之前的輸入層,而 API 讓你能在資料攝取任務和智慧體流水線裡執行轉換。
網頁端和 API 有什麼區別?
網頁端用於手動上傳、預覽、儲存和批次處理文件。API 用於在你自己的產品或工具裡自動執行同樣的轉換。
可以批次轉換文件嗎?
可以。批次轉換在付費套餐中提供,讓你無需逐個上傳和下載就能處理重複的檔案。
支援掃描版文件嗎?
基於圖片的檔案和掃描版文件現已用 OCR 處理。辨識品質取決於來源圖片。
會支援 schema JSON 抽取嗎?
它是規劃中的下一層能力,不是目前功能。Markdown 是我們首先建構的基礎產物。
會支援 Markdown 翻譯嗎?
保留結構的翻譯作為規劃中的下一層能力,位於路線圖上。
這是文件編輯器或 PDF 版式工具嗎?
都不是。markitdown.ai 把文件轉換成適合 AI 和文字工作流的乾淨 Markdown;它不是視覺化 PDF 或版式編輯器。