Konverter
Konverter URL ke Markdown
URL ke Markdown adalah konverter gratis yang mengubah halaman web yang bisa diakses publik menjadi Markdown bersih dan terstruktur, siap untuk LLM, alur RAG, dan catatan. Tidak perlu mendaftar untuk mencobanya; uji ini mengizinkan 3 konversi per IP per jam dan 10 per hari.
Cara kerja
Cara mengonversi halaman web ke Markdown
Apa yang bisa Anda tempel
- Halaman http(s) publik apa pun — artikel, dokumentasi, entri blog
- Halaman di balik login atau dinding berbayar tidak bisa diambil
- Halamannya diunduh di server kami, tanpa menjalankan JavaScript-nya
- Coba tanpa akun: hingga 10 MB dan 25 halaman per file, 3 konversi per jam dan 10 per hari
Apa yang perlu diperiksa
- Unduhan di server — Halamannya diunduh di server lalu dikonversi seperti file HTML; tidak perlu plugin browser atau alat lokal apa pun.
- Hanya halaman publik — Halaman di balik autentikasi, dinding berbayar, atau layar masuk tidak bisa diunduh.
- Halaman dengan banyak JavaScript — Halaman yang sangat bergantung pada JavaScript sisi klien untuk merender kontennya mungkin tidak terkonversi sepenuhnya, karena pengunduhnya menerima HTML awal yang dirender di server.
- Ukuran dan identitas — Halaman yang diunduh tunduk pada batas ukuran respons dan bisa ditolak jika terlalu besar.
Ke mana Markdown pergi
- Salin Markdown langsung dari pratinjau
- Unduh file .md dan simpan di pustaka Anda setelah masuk
- Konversi banyak halaman sekaligus dengan array urls di POST /v1/convert/url
- Otomatiskan dengan POST /v1/convert/url dan kunci API Anda

Mengapa memakainya
Mengapa memakai konverter URL ke Markdown ini
Halaman web ditulis untuk browser. Markdown ditulis untuk manusia dan model. Konverter ini mempertahankan bagian yang memberi makna dan membuang markup yang mengelilinginya.
Struktur yang bertahan
Judul, daftar, tautan, tabel, dan blok kode datang sebagai Markdown, sehingga halaman web ke Markdown tetap terbaca sebagai kerangka.
Mengunduh halaman publik
Artikel, dokumentasi, entri blog, dan halaman produk. Halamannya diunduh di server: tidak ada ekstensi atau alat lokal yang perlu dipasang.
Gratis untuk dicoba, tanpa masuk
Pratinjau dan salin Markdown tanpa akun, hingga 3 konversi per jam dan 10 per hari. Masuk untuk mengunduh file .md-nya.
Pratinjau atau kode mentah
Beralihlah antara Markdown yang dirender dan teks mentahnya sebelum menyalinnya ke prompt, pengelola catatan, atau repositori.
Pengunduh yang sopan dan teridentifikasi
Setiap permintaan mengidentifikasi dirinya dengan user agent yang terdokumentasi, dan pemilik situs bisa memblokirnya: lihat halaman pengunduh di dokumentasi.
Mesin yang sama dengan API
Konverter di halaman ini dan POST /v1/convert/url menjalankan kode yang sama, sehingga skrip bisa mengonversi hingga 20 URL per panggilan.
Masalahnya
Mengapa halaman aktif berisik bagi model
Halaman itu berisik
Halaman web aktif mengubur kontennya di bawah navigasi, iklan, spanduk, dan skrip.
Markup-nya berantakan
HTML yang ditulis tangan dan yang dihasilkan jarang sesuai rapi dengan struktur yang terbaca.
AI butuh artikelnya
RAG dan agen menginginkan artikelnya, bukan elemen antarmuka di sekelilingnya, dan menginginkan URL, bukan penyimpanan manual.

Apa yang dipertahankan
Apa yang diunduh konverter URL ini
- Unduhan di server
- Halamannya diunduh di server lalu dikonversi seperti file HTML; tidak perlu plugin browser atau alat lokal apa pun.Source: RFC 9110: HTTP Semantics
- Hanya halaman publik
- Halaman di balik autentikasi, dinding berbayar, atau layar masuk tidak bisa diunduh. Hanya URL yang bisa diakses publik yang didukung.Source: RFC 9110: HTTP Semantics
- Halaman dengan banyak JavaScript
- Halaman yang sangat bergantung pada JavaScript sisi klien untuk merender kontennya mungkin tidak terkonversi sepenuhnya, karena pengunduhnya menerima HTML awal yang dirender di server.Source: HTML Living Standard
- Ukuran dan identitas
- Halaman yang diunduh tunduk pada batas ukuran respons dan bisa ditolak jika terlalu besar. User agent pengunduhnya didokumentasikan di /docs/fetcher.Source: product pipeline
Contoh: artikel blog markitdown.ai lewat unduhan URL· https://markitdown.ai/blog/why-pdfs-break-llms
# Why PDFs break LLMs — and what clean Markdown fixes Jun 12, 2026 · The markitdown.ai team · 3 min read A PDF renders perfectly for a human and falls apart the moment a model reads it. The page you see — columns, tables, headers, footnotes — is a *visual* arrangement, not a logical one. When you pull raw text out of it, that visual order rarely survives, and whatever you feed a language model is only as good as the text it actually receives. ## What actually goes wrong When teams pipe documents straight into an LLM or a retrieval index, a few failure modes show up again and again: - **Reading order breaks.** Multi-column layouts interleave. A two-column page becomes "line 1 left, line 1 right, line 2 left, line 2 right…", so a sentence a human reads top-to-bottom arrives at the model scrambled.- **Tables collapse.** Copy-paste turns a table into a loose run of numbers. The relationship between a header and its cell — the entire point of a table — is gone.- **Headings disappear.** The visual hierarchy (this is a section, this is a subsection) is encoded as font size and weight, not structure. Strip the styling and you get one undifferentiated wall of text.- **Noise creeps in.** Page numbers, running headers, hyphenated line breaks, and stray ligatures end up inline, polluting prompts and embeddings alike. Kasus penggunaan
Kasus penggunaan konversi halaman web dan situs web ke Markdown
Dari agen AI hingga migrasi konten, mengubah halaman web dan situs web ke Markdown adalah langkah kecil yang menjadi andalan banyak alur kerja.
Alur AI dan LLM
Isi indeks RAG, alat agen, dan prompt dengan artikel serta dokumentasi sebagai teks bersih yang judulnya tetap utuh, alih-alih HTML mentah.
Riset dan catatan
Simpan sumber sebagai Markdown untuk dikutip, dianotasi, atau disimpan di Obsidian atau repositori catatan, dengan tautan aslinya masih di tempatnya.
Tim konten
Pindahkan entri dan halaman bantuan dari satu CMS ke CMS lain, atau bawa materi referensi ke situs dokumentasi berbasis Markdown.
Pengembang
Panggil API dari pekerjaan pengambilan data dan crawler yang sudah Anda jalankan dan dapatkan Markdown yang sama seperti yang ditampilkan konverter browser.

API
API URL ke Markdown untuk pengembang
Mengonversi halaman dari kode? Kirim satu URL —atau hingga 20 dalam array urls— ke POST /v1/convert/url dengan kunci API Anda. Markdown-nya kembali di respons yang sama saat halamannya selesai dalam jendela tunggu; jika tidak, Anda mendapat konversi untuk di-polling atau webhook saat selesai. Akses API tersedia di paket berbayar.
Baca panduan APIcurl -X POST https://api.markitdown.ai/v1/convert/url \ -H "x-api-key: mdai_…" \ -H "content-type: application/json" \ -d '{"url":"https://markitdown.ai/blog/why-pdfs-break-llms"}'Panduan
Meninjau hasilnya
Tinjau hasil URL ke Markdown bersama halaman publik yang Anda kirim. Pastikan teks artikel atau dokumentasinya ada, lalu periksa awal dan akhirnya untuk mencari navigasi, pemberitahuan cookie, dan tautan footer yang berulang. Konverter menerima HTML dari server; ia tidak menjalankan aplikasi halamannya untuk memuat konten yang hanya muncul setelah JavaScript dijalankan. Jika hasilnya tidak memuat lebih dari sekadar struktur navigasi, periksa bagaimana halaman itu mengirimkan artikelnya. Ekspor yang terbaca tetap bisa memuat materi di luar artikel utamanya, jadi putuskan apa yang termasuk catatan atau indeks pengambilan Anda sebelum memakainya. Simpan URL sumbernya bersama Markdown agar pembaca bisa kembali ke halaman aslinya.
Mempertahankan konteks sumber
Simpan URL yang dikirim dan tanggal pengambilan Anda bersama hasil URL ke Markdown di alur kerja Anda sendiri. Halaman publik bisa berubah setelah Anda mengonversinya, sehingga pengunjung berikutnya mungkin melihat bagian yang sudah direvisi. Bidang metadata API bisa membawa konteks yang Anda sediakan, tetapi ia tidak mengekstrak penulisan atau tanggal terbit yang terverifikasi dari halamannya secara otomatis. Periksa data itu di sumbernya jika riset Anda memerlukannya. Sebelum mengutip tabel atau paragraf, bandingkan dengan halamannya dan simpan konteks yang cukup di sekelilingnya agar maknanya tidak berubah. Markdown membuat konten web lebih mudah dipakai ulang; ia tidak menentukan apakah halamannya akurat atau apakah Anda berhak menerbitkannya kembali.
HTML tersimpan vs URL
Pilih konverter HTML saat Anda sudah punya cuplikan persis halaman yang perlu diproses. Pilih URL ke Markdown saat alamat yang bisa diakses publik adalah masukan konversi saat ini. Keduanya alur kerja yang berhubungan dengan kendali sumber yang berbeda: file tersimpan mengunci masukan yang Anda kirim, sedangkan URL bergantung pada apa yang dikembalikan situs webnya saat permintaan. Tidak ada dari kedua jalur itu yang menghindari pembatasan akses atau menjamin penghapusan iklan. Jika sebuah situs menolak pengunduh atau mewajibkan masuk, pakai materi yang berhak Anda peroleh lewat alur kerja yang sesuai. Jangan mengulang URL yang tidak bisa diakses berulang-ulang seolah percobaan konversi lain akan memberi akses.
Riset dengan LLM
Peneliti menempel sebuah sumber, bukan berkas. Konverter ini mengunduh URL yang Anda kirim, mengubah HTML yang dirender di server menjadi Markdown yang bisa Anda kutip, potong, atau masukkan ke pengelola catatan. Ia tidak masuk ke balik dinding berbayar atau menjalankan JavaScript sisi klien halamannya.
- Hanya URL yang bisa diakses publik yang didukung.
- Pengunduhnya mengidentifikasi diri; operator bisa menolak user agent-nya: lihat /docs/fetcher.
- File HTML tersimpan ditangani di /html-to-markdown, bukan di sini.
Konverter Markdown lainnya
- PDF → MarkdownTeks, tabel, dan hasil pindai
- Word → MarkdownDOCX dengan judul dan daftar
- PPT → MarkdownTeks slide, catatan, dan tabel
- Excel → MarkdownSetiap sheet sebagai tabel
- Image → MarkdownOCR untuk hasil pindai dan screenshot
- HTML → MarkdownTempel atau unggah HTML
- Markdown → HTMLHTML bersih dan semantik
- Markdown → TextTeks biasa tanpa markup
- Markdown → PDFCetak ke PDF secara lokal
Need it in your code? Use the developer API. Converting at scale? See plans and pricing.
FAQ
Pertanyaan tentang URL ke Markdown
Bagaimana cara mengubah halaman web ke Markdown dengan URL ke Markdown?
Tempel URL halaman web publik. Halamannya diunduh di server dan diubah menjadi Markdown: tidak ada file yang perlu diunggah.
Apakah iklan dan navigasi halaman aktif dihapus?
Belum secara andal. Konverter saat ini bisa mempertahankan navigasi, iklan, dan teks footer bersama konten utamanya.
Apakah ada batas ukuran untuk halaman yang diunduh?
Konverter publik bekerja dengan halaman web publik. Halaman yang diunduh tunduk pada batas ukuran respons dan bisa ditolak jika terlalu besar.
Apakah ini berfungsi pada halaman di balik login?
Tidak. Hanya URL yang bisa diakses publik yang didukung. Halaman di balik autentikasi, dinding berbayar, atau layar masuk tidak bisa diunduh.
Bagaimana dengan halaman yang dirender dengan JavaScript?
Konverter mengunduh HTML awal yang dirender di server. Halaman yang bergantung pada JavaScript sisi klien untuk memuat kontennya mungkin tidak terkonversi sepenuhnya.
Bisakah saya mengonversi beberapa URL sekaligus?
Kirim array urls berisi hingga 20 URL publik ke POST /v1/convert/url. Lacak hasil setiap file dan tangani respons asinkronnya. Lihat /developers.
Apakah URL ke Markdown gratis?
Ya. Mempratinjau dan menyalin Markdown gratis tanpa akun, hingga 3 konversi per jam dan 10 per hari; mengunduh file .md-nya memerlukan sesi masuk. Hanya halaman web publik (tanpa URL internal atau privat).
Konten apa yang dipertahankan konverter?
Judul, paragraf, daftar, tautan, tabel, dan blok kode berubah menjadi Markdown. Skrip dan gaya dibuang. Navigasi, footer, dan iklan bisa tetap muncul bersama konten utamanya.
Apakah ada API konversi lewat URL?
Ya. Konversi halaman web lewat URL secara programatik melalui API REST. Lihat /developers. File HTML tersimpan memakai /html-to-markdown.
Konversi URL ke Markdown dalam skala besar.
Gratis untuk dicoba — tanpa perlu mendaftar.