轉換器

URL 轉 Markdown 轉換器

URL 轉 Markdown 轉換器把公開可存取的網頁變成乾淨、結構化的 Markdown,可直接用於 LLM、RAG 流程和筆記。試用無需註冊;試用允許每個 IP 每小時 3 次轉換、每天 10 次。

還沒有轉換任何頁面
在上方貼上 URL 並點擊轉換。Markdown 會顯示在這裡。

如何操作

如何把網頁轉成 Markdown

可以貼上什麼

  • 任意公開的 http(s) 頁面 —— 文章、文件、部落格文章
  • 需要登入或位於付費牆後的頁面無法抓取
  • 頁面在我們的伺服器上抓取,不會執行其 JavaScript
  • 無需帳號即可試用:單檔案最大 10 MB、25 頁,每小時 3 次、每天 10 次轉換
URL 轉 Markdown 轉換器:把網頁 URL 轉成 Markdown 視窗

為什麼使用

為什麼使用這款 URL 轉 Markdown 轉換器

網頁是寫給瀏覽器看的。Markdown 是寫給人看、給模型讀的。這款轉換器保留承載含義的部分,丟掉它們周圍的標記。

能留存下來的結構

標題、列表、連結、表格和程式碼塊都以 Markdown 形式呈現,頁面仍然像一個大綱一樣可讀。

抓取公開頁面

文章、文件、部落格和產品頁。頁面在服務端抓取——無需安裝擴充功能或本機工具。

免費試用,無需登入

無需帳號即可預覽並複製 Markdown,每小時最多 3 次轉換、每天 10 次。登入後可下載 .md 檔案。

預覽或原始原始碼

在把內容複製進提示詞、筆記庫或程式碼倉庫前,在渲染後的 Markdown 和它的原始文字之間切換。

有禮、表明身分的抓取器

每次請求都會用有文件記錄的 user agent 表明身分,網站擁有者可以阻擋它——見文件裡的抓取器頁面。

與 API 同一套引擎

本頁的轉換器和 POST /v1/convert/url 執行同一份程式碼,所以指令碼每次呼叫最多可轉換 20 個 URL。

問題所在

為什麼線上頁面對模型來說很嘈雜

頁面很嘈雜

線上網頁把內容埋在導航、廣告、橫幅和指令碼之下。

標記很亂

手寫和生成的 HTML 很少能幹淨地對應為可讀結構。

AI 需要的是文章

RAG 和 agent 想要的是文章本身,而不是它周圍的頁面外殼——而且它們想要一個 URL,而不是手動儲存。

網頁轉 Markdown:複製貼上後的錯亂文字與乾淨的 Markdown 結構對比

保留什麼

這款 URL 轉換器抓取什麼

服務端抓取
頁面在服務端被抓取,然後像 HTML 檔案一樣被轉換;無需瀏覽器外掛或本機工具。Source: RFC 9110: HTTP Semantics
僅限公開頁面
位於身分驗證、付費牆或登入牆之後的頁面無法抓取。只支援公開可存取的 URL。Source: RFC 9110: HTTP Semantics
依賴 JavaScript 的頁面
嚴重依賴客戶端 JavaScript 渲染內容的頁面可能無法完整轉換,因為抓取器接收的是初始的服務端渲染 HTML。Source: HTML Living Standard
大小與身分
抓取的頁面受回應大小限制限制,過大時會被拒絕。抓取器的 user agent 記錄在 /docs/fetcher。Source: product pipeline

示例:透過 URL 抓取 markitdown.ai 部落格文章· https://markitdown.ai/blog/why-pdfs-break-llms

# Why PDFs break LLMs — and what clean Markdown fixes Jun 12, 2026 · The markitdown.ai team · 3 min read A PDF renders perfectly for a human and falls apart the moment a model reads it. The page you see — columns, tables, headers, footnotes — is a *visual* arrangement, not a logical one. When you pull raw text out of it, that visual order rarely survives, and whatever you feed a language model is only as good as the text it actually receives. ## What actually goes wrong When teams pipe documents straight into an LLM or a retrieval index, a few failure modes show up again and again: - **Reading order breaks.** Multi-column layouts interleave. A two-column page becomes "line 1 left, line 1 right, line 2 left, line 2 right…", so a sentence a human reads top-to-bottom arrives at the model scrambled.- **Tables collapse.** Copy-paste turns a table into a loose run of numbers. The relationship between a header and its cell — the entire point of a table — is gone.- **Headings disappear.** The visual hierarchy (this is a section, this is a subsection) is encoded as font size and weight, not structure. Strip the styling and you get one undifferentiated wall of text.- **Noise creeps in.** Page numbers, running headers, hyphenated line breaks, and stray ligatures end up inline, polluting prompts and embeddings alike. 

使用場景

網頁轉 Markdown 的使用場景

從 AI agent 到內容遷移,把網頁變成 Markdown 是許多工作流都依賴的一小步。

AI 與 LLM 流程

把文章和文件作為帶完整標題的乾淨文字餵給 RAG 索引、agent 工具和提示詞,而不是原始 HTML。

研究與筆記

把來源儲存為 Markdown,用於引用、批註或留在 Obsidian 或筆記倉庫裡——原始連結依然在位。

內容團隊

把文章和幫助中心頁面從一個 CMS 遷到另一個,或把參考資料拉進基於 Markdown 的文件站。

開發者

在你已有的攝取任務和爬蟲裡呼叫 API,拿到與瀏覽器轉換器顯示的同一份 Markdown。

網站轉 Markdown:把一個 Markdown 檔案接入 RAG 索引、提示詞與筆記

API

專為開發者的 URL 轉 Markdown API

要從程式碼轉換頁面?把一個 URL——或 urls 陣列裡最多 20 個——發到帶 API 金鑰的 POST /v1/convert/url。頁面在等待視窗內完成時,Markdown 會在同一個回應裡返回;否則你會拿到一個可輪詢的轉換,或它完成時的一個 webhook。API 存取在付費套餐上提供。

閱讀 API 指南
curl -X POST https://api.markitdown.ai/v1/convert/url \  -H "x-api-key: mdai_…" \  -H "content-type: application/json" \  -d '{"url":"https://markitdown.ai/blog/why-pdfs-break-llms"}'

檢查輸出結果

把 URL 轉 Markdown 的輸出與你提交的公開頁面對照。確認文章或文件文字存在,然後檢查開頭和結尾有沒有導航、Cookie 提示和重複的頁尾連結。轉換器從伺服器接收 HTML;它不執行頁面應用去載入僅在 JavaScript 執行後才出現的內容。如果輸出裡除了一個導航外殼幾乎什麼都沒有,就核實該頁面是如何交付它的文章的。可讀的匯出仍可能包含正文之外的材料,所以在使用前先決定哪些內容屬於你的筆記或檢索索引。把來源 URL 與 Markdown 一起保留,讓讀者能回到原始頁面。

保留來源上下文

在你自己的工作流裡,把提交的 URL 和你的檢索日期與 URL 轉 Markdown 的結果一起保留。公開頁面在你轉換之後可能改動,後來的訪客可能看到修改過的段落。API 的 metadata 欄位可以攜帶你提供的上下文,但它不會自動從頁面提取經過核實的作者身分或釋出日期。如果你的研究需要這些事實,請在來源處核對。在引用一張表或一段話之前,先與頁面對照,並保留足夠的周邊上下文以免改變含義。Markdown 讓網頁內容更易複用;它並不確立該頁面是否準確,也不確立你是否有權轉載它。

儲存的 HTML 與 URL

當你已經擁有需要處理的確切頁面快照時,選擇 HTML 轉換器。當公開可存取的地址就是本次轉換的輸入時,選擇 URL 轉 Markdown。這是兩種相關但來源控制不同的工作流:儲存的檔案固定了你提交的輸入,而 URL 則取決於網站在請求時返回什麼。兩條路徑都不會繞過存取限制,也不保證移除廣告。如果某個網站拒絕抓取器或要求登入,請使用你有授權透過合適工作流獲取的材料。不要反覆重試一個無法存取的 URL,彷彿再轉換一次就能獲得存取權限。

LLM 研究

研究者貼上的是一個來源,而不是一個檔案。這個轉換器抓取你提交的 URL,轉換服務端渲染的 HTML,並返回你可以引用、切分或放進筆記庫的 Markdown。它不登入付費牆,也不執行頁面的客戶端 JavaScript。

  • 只支援公開可存取的 URL。
  • 抓取器會表明自身身分;運營方可以拒絕該 user agent——見 /docs/fetcher。
  • 儲存的 HTML 檔案屬於 /html-to-markdown,不屬於這裡。

FAQ

URL 轉 Markdown 轉換器常見問題

URL 轉 Markdown 轉換器是怎麼工作的?

貼上一個公開網頁 URL。頁面在服務端被抓取並解析成 Markdown——無需上傳檔案。

它會從線上頁面裡去掉廣告和導航嗎?

目前不能可靠地做到。目前轉換器可能把導航、廣告和頁尾文字與正文一起保留。

抓取的頁面有大小限制嗎?

公開轉換器對公開網頁生效。抓取的頁面受回應大小限制限制,過大時會被拒絕。

對登入後的頁面有效嗎?

無效。只支援公開可存取的 URL。位於身分驗證、付費牆或登入牆之後的頁面無法抓取。

依賴 JavaScript 渲染的頁面呢?

轉換器抓取初始的服務端渲染 HTML。依賴客戶端 JavaScript 載入內容的頁面可能無法完整轉換。

可以一次轉換多個 URL 嗎?

把最多 20 個公開 URL 的 urls 陣列發到 POST /v1/convert/url。逐個追蹤檔案結果並處理非同步回應。見 /developers。

URL 轉 Markdown 免費嗎?

免費。無需帳號即可預覽並複製 Markdown,每小時最多 3 次轉換、每天 10 次;下載 .md 檔案需要登入。僅限公開網頁(不支援內部網路或私有 URL)。

轉換器保留哪些內容?

標題、段落、列表、連結、表格和程式碼塊都會變成 Markdown。指令碼和樣式會被丟棄。導航、頁尾和廣告仍可能出現在正文旁邊。

有 URL 轉換 API 嗎?

有。可以透過 REST API 以程式設計方式透過 URL 轉換網頁。見 /developers。儲存的 HTML 檔案請改用 /html-to-markdown。

大規模將 URL 轉換為 Markdown。

免費試用——無需註冊。