ตัวแปลง

แปลง URL เป็น Markdown

แปลง URL เป็น Markdown คือตัวแปลงฟรีที่เปลี่ยนหน้าเว็บที่เข้าถึงได้แบบสาธารณะให้เป็น Markdown ที่สะอาดและมีโครงสร้าง พร้อมสำหรับ LLM ไปป์ไลน์ RAG และบันทึก ไม่ต้องสมัครเพื่อลอง; การทดลองอนุญาต 3 ครั้งต่อ IP ต่อชั่วโมง และ 10 ครั้งต่อวัน

ยังไม่ได้แปลงหน้า
วาง URL ด้านบนแล้วกดแปลง Markdown จะปรากฏที่นี่

วิธีใช้

วิธีแปลงหน้าเว็บเป็น Markdown

สิ่งที่คุณวางได้

  • หน้า http(s) สาธารณะใดก็ได้ — บทความ เอกสาร โพสต์บล็อก
  • หน้าที่อยู่หลังการเข้าสู่ระบบหรือเพย์วอลล์ดึงไม่ได้
  • หน้าเว็บถูกดึงบนเซิร์ฟเวอร์ของเรา โดยไม่รัน JavaScript ของมัน
  • ลองได้โดยไม่ต้องมีบัญชี: สูงสุด 10 MB และ 25 หน้าต่อไฟล์, 3 ครั้งต่อชั่วโมง และ 10 ครั้งต่อวัน
แปลง URL เป็น Markdown: เบราว์เซอร์ที่มีแถบที่อยู่ทางซ้ายกลายเป็นหน้าต่าง Markdown ทางขวา

ทำไมต้องใช้

ทำไมต้องใช้ตัวแปลง URL เป็น Markdown นี้

หน้าเว็บเขียนขึ้นเพื่อเบราว์เซอร์ Markdown เขียนขึ้นเพื่อคนและโมเดล ตัวแปลงนี้เก็บส่วนที่สื่อความหมายและตัดมาร์กอัปที่ล้อมรอบออก

โครงสร้างที่รอด

หัวข้อ รายการ ลิงก์ ตาราง และบล็อกโค้ดออกมาเป็น Markdown หน้าจึงยังอ่านเป็นโครงร่าง

ดึงหน้าเว็บสาธารณะ

บทความ เอกสาร โพสต์บล็อก และหน้าผลิตภัณฑ์ หน้าเว็บถูกดึงฝั่งเซิร์ฟเวอร์ — ไม่ต้องติดตั้งส่วนขยายหรือเครื่องมือในเครื่อง

ลองฟรี ไม่ต้องเข้าสู่ระบบ

ดูตัวอย่างและคัดลอก Markdown ได้โดยไม่ต้องมีบัญชี สูงสุด 3 ครั้งต่อชั่วโมง และ 10 ครั้งต่อวัน เข้าสู่ระบบเพื่อดาวน์โหลดไฟล์ .md

ตัวอย่างหรือซอร์สดิบ

สลับระหว่าง Markdown ที่เรนเดอร์แล้วกับข้อความดิบก่อนคัดลอกลงพรอมป์ คลังบันทึก หรือที่เก็บโค้ด

ตัวดึงที่สุภาพและระบุตัวตน

ทุกคำขอระบุตัวเองด้วย user agent ที่มีเอกสารกำกับ และเจ้าของไซต์บล็อกได้ — ดูหน้า fetcher ในเอกสาร

เอนจินเดียวกับ API

ตัวแปลงบนหน้านี้กับ POST /v1/convert/url ใช้โค้ดเดียวกัน สคริปต์จึงแปลงได้สูงสุด 20 URL ต่อการเรียก

ปัญหา

ทำไมหน้าเว็บสดจึงมีสัญญาณรบกวนสำหรับโมเดล

หน้าเว็บมีสัญญาณรบกวน

หน้าเว็บสดฝังเนื้อหาไว้ใต้การนำทาง โฆษณา แบนเนอร์ และสคริปต์

มาร์กอัปยุ่งเหยิง

HTML ที่เขียนด้วยมือและที่สร้างขึ้นไม่ค่อยแมปกับโครงสร้างที่อ่านได้อย่างสะอาด

AI ต้องการบทความ

RAG และเอเจนต์ต้องการบทความ ไม่ใช่เปลือกหน้าล้อมรอบ — และพวกมันต้องการ URL ไม่ใช่การบันทึกด้วยมือ

แปลงหน้าเว็บเป็น Markdown: ข้อความที่คัดลอกมาแล้วผิดเพี้ยนเทียบกับโครงสร้าง Markdown ที่เรียบร้อย

สิ่งที่เก็บไว้

ตัวแปลง URL นี้ดึงอะไร

ดึงฝั่งเซิร์ฟเวอร์
หน้าเว็บถูกดึงฝั่งเซิร์ฟเวอร์แล้วแปลงเหมือนไฟล์ HTML; ไม่ต้องใช้ปลั๊กอินเบราว์เซอร์หรือเครื่องมือในเครื่องSource: RFC 9110: HTTP Semantics
เฉพาะหน้าสาธารณะ
หน้าที่อยู่หลังการยืนยันตัวตน เพย์วอลล์ หรือกำแพงเข้าสู่ระบบดึงไม่ได้ รองรับเฉพาะ URL ที่เข้าถึงได้แบบสาธารณะSource: RFC 9110: HTTP Semantics
หน้าที่พึ่ง JavaScript หนัก
หน้าที่พึ่ง JavaScript ฝั่งไคลเอนต์มากในการเรนเดอร์เนื้อหาอาจแปลงได้ไม่ครบ เพราะตัวดึงรับ HTML ที่เซิร์ฟเวอร์เรนเดอร์ครั้งแรกSource: HTML Living Standard
ขนาดและตัวตน
หน้าเว็บที่ดึงอยู่ภายใต้ขีดจำกัดขนาดคำตอบและอาจถูกปฏิเสธถ้าใหญ่เกินไป user agent ของตัวดึงมีเอกสารที่ /docs/fetcherSource: product pipeline

ตัวอย่าง: โพสต์บล็อก markitdown.ai ผ่านการดึง URL· https://markitdown.ai/blog/why-pdfs-break-llms

# Why PDFs break LLMs — and what clean Markdown fixes Jun 12, 2026 · The markitdown.ai team · 3 min read A PDF renders perfectly for a human and falls apart the moment a model reads it. The page you see — columns, tables, headers, footnotes — is a *visual* arrangement, not a logical one. When you pull raw text out of it, that visual order rarely survives, and whatever you feed a language model is only as good as the text it actually receives. ## What actually goes wrong When teams pipe documents straight into an LLM or a retrieval index, a few failure modes show up again and again: - **Reading order breaks.** Multi-column layouts interleave. A two-column page becomes "line 1 left, line 1 right, line 2 left, line 2 right…", so a sentence a human reads top-to-bottom arrives at the model scrambled.- **Tables collapse.** Copy-paste turns a table into a loose run of numbers. The relationship between a header and its cell — the entire point of a table — is gone.- **Headings disappear.** The visual hierarchy (this is a section, this is a subsection) is encoded as font size and weight, not structure. Strip the styling and you get one undifferentiated wall of text.- **Noise creeps in.** Page numbers, running headers, hyphenated line breaks, and stray ligatures end up inline, polluting prompts and embeddings alike. 

กรณีใช้งาน

กรณีใช้งานของการแปลงเว็บไซต์เป็น Markdown

ตั้งแต่เอเจนต์ AI ไปจนถึงการย้ายเนื้อหา การเปลี่ยนหน้าเว็บเป็น Markdown เป็นก้าวเล็ก ๆ ที่หลายเวิร์กโฟลว์ต้องพึ่งพา

ไปป์ไลน์ AI และ LLM

ป้อนบทความและเอกสารเข้าดัชนี RAG เครื่องมือเอเจนต์ และพรอมป์เป็นข้อความสะอาดที่หัวข้อยังอยู่ครบ แทน HTML ดิบ

งานวิจัยและบันทึก

บันทึกต้นทางเป็น Markdown เพื่ออ้างอิง จดบันทึก หรือเก็บใน Obsidian หรือที่เก็บบันทึก — โดยลิงก์ต้นฉบับยังอยู่

ทีมเนื้อหา

ย้ายโพสต์และหน้าศูนย์ช่วยเหลือจาก CMS หนึ่งไปอีก CMS หนึ่ง หรือดึงวัสดุอ้างอิงเข้าสู่ไซต์เอกสารที่ใช้ Markdown

นักพัฒนา

เรียก API จากงานนำข้อมูลเข้าและตัวรวบรวมข้อมูลที่คุณใช้อยู่ และได้ Markdown ชุดเดียวกับที่ตัวแปลงในเบราว์เซอร์แสดง

แปลงเว็บไซต์เป็น Markdown: ไฟล์ Markdown หนึ่งไฟล์ป้อนเข้าดัชนี RAG พร้อมพรอมป์และโน้ต

API

URL เป็น Markdown API สำหรับนักพัฒนา

แปลงหน้าเว็บจากโค้ด? ส่ง URL หนึ่งรายการ — หรือสูงสุด 20 รายการในอาร์เรย์ urls — ไปที่ POST /v1/convert/url พร้อม API key ของคุณ Markdown จะกลับมาในคำตอบเดียวกันเมื่อหน้าเว็บเสร็จภายในหน้าต่างรอ; ไม่เช่นนั้นคุณจะได้การแปลงให้โพล หรือ webhook เมื่อมันเสร็จ การเข้าถึง API อยู่ในแพ็กเกจแบบชำระเงิน

อ่านคู่มือ API
curl -X POST https://api.markitdown.ai/v1/convert/url \  -H "x-api-key: mdai_…" \  -H "content-type: application/json" \  -d '{"url":"https://markitdown.ai/blog/why-pdfs-break-llms"}'

ทบทวนผลลัพธ์

ทบทวนผลลัพธ์ URL เป็น Markdown ข้างหน้าเว็บสาธารณะที่คุณส่งไป ยืนยันว่าข้อความบทความหรือเอกสารอยู่ครบ แล้วตรวจต้นและท้ายหาการนำทาง ประกาศคุกกี้ และลิงก์ส่วนท้ายที่ซ้ำ ตัวแปลงรับ HTML จากเซิร์ฟเวอร์; มันไม่รันแอปพลิเคชันของหน้าเพื่อโหลดเนื้อหาที่ปรากฏหลัง JavaScript ทำงาน ถ้าผลลัพธ์มีมากกว่าเปลือกการนำทางเล็กน้อย ให้ตรวจว่าหน้านั้นส่งบทความมาอย่างไร การส่งออกที่อ่านได้ยังอาจมีเนื้อหานอกบทความหลัก ให้ตัดสินว่าอะไรควรอยู่ในบันทึกหรือดัชนีค้นคืนของคุณก่อนใช้ เก็บ URL ต้นทางไว้กับ Markdown ผู้อ่านจะได้กลับไปยังหน้าเดิมได้

เก็บบริบทของต้นทาง

เก็บ URL ที่ส่งและวันที่ดึงของคุณไว้กับผลลัพธ์ URL เป็น Markdown ในเวิร์กโฟลว์ของคุณ หน้าเว็บสาธารณะเปลี่ยนได้หลังคุณแปลง ดังนั้นผู้เข้าชมภายหลังอาจเห็นย่อหน้าที่แก้แล้ว ฟิลด์ metadata ของ API บรรจุบริบทที่คุณจัดหาได้ แต่ไม่ได้สกัดชื่อผู้เขียนหรือวันที่เผยแพร่ที่ยืนยันแล้วจากหน้าโดยอัตโนมัติ ตรวจข้อเท็จจริงเหล่านั้นที่ต้นทางถ้างานวิจัยของคุณต้องการ ก่อนอ้างอิงตารางหรือย่อหน้า ให้เทียบกับหน้าและเก็บบริบทแวดล้อมพอที่จะไม่เปลี่ยนความหมายของมัน Markdown ทำให้เนื้อหาเว็บนำไปใช้ซ้ำง่ายขึ้น; ไม่ได้ยืนยันว่าหน้าถูกต้องหรือคุณมีสิทธิ์เผยแพร่ซ้ำหรือไม่

HTML ที่บันทึกกับ URL

เลือกตัวแปลง HTML เมื่อคุณมีสแนปช็อตของหน้าที่ต้องการประมวลผลอยู่แล้ว เลือก URL เป็น Markdown เมื่อที่อยู่ที่เข้าถึงได้แบบสาธารณะเป็นข้อมูลเข้าของการแปลงปัจจุบัน สองอย่างนี้เป็นเวิร์กโฟลว์ที่เกี่ยวข้องกันแต่ควบคุมต้นทางต่างกัน: ไฟล์ที่บันทึกตรึงข้อมูลเข้าที่คุณส่ง ส่วน URL ขึ้นกับสิ่งที่เว็บไซต์คืนมาตอนที่ร้องขอ ไม่มีเส้นทางใดเลี่ยงข้อจำกัดการเข้าถึงหรือรับประกันการลบโฆษณา ถ้าไซต์ปฏิเสธตัวดึงหรือต้องเข้าสู่ระบบ ให้ใช้วัสดุที่คุณได้รับอนุญาตให้เข้าถึงผ่านเวิร์กโฟลว์ที่เหมาะสม อย่าลอง URL ที่เข้าถึงไม่ได้ซ้ำ ๆ ราวกับว่าการแปลงอีกครั้งจะให้สิทธิ์เข้าถึง

งานวิจัยด้วย LLM

นักวิจัยวางต้นทาง ไม่ใช่ไฟล์ ตัวแปลงนี้ดึง URL ที่คุณส่ง แปลง HTML ที่เซิร์ฟเวอร์เรนเดอร์ และคืนค่า Markdown ที่คุณอ้างอิง แบ่งชิ้น หรือหย่อนลงคลังบันทึกได้ มันไม่เข้าสู่ระบบหลังเพย์วอลล์และไม่รัน JavaScript ฝั่งไคลเอนต์ของหน้า

  • รองรับเฉพาะ URL ที่เข้าถึงได้แบบสาธารณะ
  • ตัวดึงระบุตัวตน; ผู้ดูแลสามารถปฏิเสธ user agent ได้ — ดู /docs/fetcher
  • ไฟล์ HTML ที่บันทึกควรใช้ /html-to-markdown ไม่ใช่ที่นี่

คำถามที่พบบ่อย

คำถามที่พบบ่อยเกี่ยวกับ URL เป็น Markdown

แปลง URL เป็น Markdown ทำงานอย่างไร?

วาง URL ของหน้าเว็บสาธารณะ หน้าเว็บถูกดึงฝั่งเซิร์ฟเวอร์และแยกวิเคราะห์เป็น Markdown — ไม่มีไฟล์ให้อัปโหลด

มันลบโฆษณาและการนำทางจากหน้าเว็บสดไหม?

ยังไม่น่าเชื่อถือ ตัวแปลงปัจจุบันอาจเก็บการนำทาง โฆษณา และข้อความส่วนท้ายไว้ข้างเนื้อหาหลัก

มีขีดจำกัดขนาดสำหรับหน้าที่ดึงไหม?

ตัวแปลงสาธารณะทำงานกับหน้าเว็บสาธารณะ หน้าที่ดึงอยู่ภายใต้ขีดจำกัดขนาดคำตอบและอาจถูกปฏิเสธถ้าใหญ่เกินไป

ใช้กับหน้าที่อยู่หลังการเข้าสู่ระบบได้ไหม?

ไม่ได้ รองรับเฉพาะ URL ที่เข้าถึงได้แบบสาธารณะ หน้าที่อยู่หลังการยืนยันตัวตน เพย์วอลล์ หรือกำแพงเข้าสู่ระบบดึงไม่ได้

หน้าที่เรนเดอร์ด้วย JavaScript เป็นอย่างไร?

ตัวแปลงดึง HTML ที่เซิร์ฟเวอร์เรนเดอร์ครั้งแรก หน้าที่พึ่ง JavaScript ฝั่งไคลเอนต์ในการโหลดเนื้อหาอาจแปลงได้ไม่ครบ

แปลงหลาย URL พร้อมกันได้ไหม?

ส่งอาร์เรย์ urls ที่มี URL สาธารณะสูงสุด 20 รายการไปที่ POST /v1/convert/url ติดตามผลแต่ละไฟล์และจัดการคำตอบแบบอะซิงโครนัส ดู /developers

แปลง URL เป็น Markdown ฟรีไหม?

ฟรี การดูตัวอย่างและคัดลอก Markdown ฟรีโดยไม่ต้องมีบัญชี สูงสุด 3 ครั้งต่อชั่วโมง และ 10 ครั้งต่อวัน; การดาวน์โหลดไฟล์ .md ต้องเข้าสู่ระบบ เฉพาะหน้าเว็บสาธารณะ (ห้าม URL ภายในหรือส่วนตัว)

ตัวแปลงเก็บเนื้อหาอะไร?

หัวข้อ ย่อหน้า รายการ ลิงก์ ตาราง และบล็อกโค้ดกลายเป็น Markdown สคริปต์และสไตล์ถูกตัดออก การนำทาง ส่วนท้าย และโฆษณาอาจยังปรากฏข้างเนื้อหาหลัก

มี API แปลง URL ไหม?

มี แปลงหน้าเว็บผ่าน URL ด้วยโปรแกรมผ่าน REST API ดู /developers ไฟล์ HTML ที่บันทึกใช้ /html-to-markdown แทน

แปลง URL เป็น Markdown จำนวนมาก

ลองฟรี — ไม่ต้องสมัคร