Convertidor
Convertidor de URL a Markdown
URL a Markdown es un conversor gratuito que convierte una página web de acceso público en Markdown limpio y estructurado, listo para LLM, procesos de RAG y apuntes. No hace falta registrarse para probarlo; la prueba permite 3 conversiones por IP y hora y 10 al día.
Cómo se hace
Cómo convertir una página web a Markdown
Qué puedes pegar
- Cualquier página pública http(s): artículos, documentos, entradas de blog
- Las páginas tras un inicio de sesión o un muro de pago no se pueden obtener
- La página se descarga en nuestro servidor, sin ejecutar su JavaScript
- Pruébalo sin cuenta: hasta 10 MB y 25 páginas por archivo, 3 conversiones por hora y 10 al día
Qué revisar
- Descarga en el servidor — La página se descarga en el servidor y luego se convierte como un archivo HTML; no hace falta ningún plugin del navegador ni herramienta local.
- Solo páginas públicas — Las páginas detrás de autenticación, muros de pago o pantallas de inicio de sesión no se pueden descargar.
- Páginas con mucho JavaScript — Las páginas que dependen en gran medida del JavaScript del lado del cliente para renderizar su contenido pueden no convertirse por completo, ya que el descargador recibe el HTML inicial renderizado en el servidor.
- Tamaño e identidad — Las páginas descargadas están sujetas a límites de tamaño de respuesta y pueden rechazarse si son demasiado grandes.
A dónde va el Markdown
- Copia el Markdown directamente desde la vista previa
- Descarga el archivo .md y guárdalo en tu biblioteca al iniciar sesión
- Convierte muchas páginas a la vez con un array urls en POST /v1/convert/url
- Automatízalo con POST /v1/convert/url y tu clave de API

Por qué usarlo
Por qué usar este conversor de URL a Markdown
Una página web está escrita para un navegador. Markdown está escrito para personas y modelos. Este conversor conserva las partes que aportan significado y descarta el marcado que las rodea.
Estructura que perdura
Los encabezados, las listas, los enlaces, las tablas y los bloques de código llegan como Markdown, así que la página sigue leyéndose como un esquema.
Descarga una página pública
Artículos, documentación, entradas de blog y páginas de producto. La página se descarga en el servidor: no hay extensión ni herramienta local que instalar.
Gratis para probar, sin iniciar sesión
Previsualiza y copia el Markdown sin cuenta, hasta 3 conversiones por hora y 10 al día. Inicia sesión para descargar el archivo .md.
Vista previa o código sin procesar
Alterna entre el Markdown renderizado y su texto sin procesar antes de copiarlo a un prompt, un gestor de notas o un repositorio.
Un descargador educado e identificado
Cada solicitud se identifica con un user agent documentado, y los propietarios de los sitios pueden bloquearlo: consulta la página del descargador en la documentación.
El mismo motor que la API
El conversor de esta página y POST /v1/convert/url ejecutan el mismo código, así que un script puede convertir hasta 20 URL por llamada.
El problema
Por qué una página activa es ruidosa para los modelos
Las páginas son ruidosas
Las páginas web activas entierran el contenido bajo navegación, anuncios, banners y scripts.
El marcado es desordenado
El HTML escrito a mano y el generado rara vez se corresponden limpiamente con una estructura legible.
La IA necesita el artículo
RAG y los agentes quieren el artículo, no los elementos de interfaz que lo rodean, y quieren una URL, no un guardado manual.

Qué se conserva
Qué descarga este conversor de URL
- Descarga en el servidor
- La página se descarga en el servidor y luego se convierte como un archivo HTML; no hace falta ningún plugin del navegador ni herramienta local.Source: RFC 9110: HTTP Semantics
- Solo páginas públicas
- Las páginas detrás de autenticación, muros de pago o pantallas de inicio de sesión no se pueden descargar. Solo se admiten URL de acceso público.Source: RFC 9110: HTTP Semantics
- Páginas con mucho JavaScript
- Las páginas que dependen en gran medida del JavaScript del lado del cliente para renderizar su contenido pueden no convertirse por completo, ya que el descargador recibe el HTML inicial renderizado en el servidor.Source: HTML Living Standard
- Tamaño e identidad
- Las páginas descargadas están sujetas a límites de tamaño de respuesta y pueden rechazarse si son demasiado grandes. El user agent del descargador está documentado en /docs/fetcher.Source: product pipeline
Ejemplo: entrada del blog de markitdown.ai mediante descarga por URL· https://markitdown.ai/blog/why-pdfs-break-llms
# Why PDFs break LLMs — and what clean Markdown fixes Jun 12, 2026 · The markitdown.ai team · 3 min read A PDF renders perfectly for a human and falls apart the moment a model reads it. The page you see — columns, tables, headers, footnotes — is a *visual* arrangement, not a logical one. When you pull raw text out of it, that visual order rarely survives, and whatever you feed a language model is only as good as the text it actually receives. ## What actually goes wrong When teams pipe documents straight into an LLM or a retrieval index, a few failure modes show up again and again: - **Reading order breaks.** Multi-column layouts interleave. A two-column page becomes "line 1 left, line 1 right, line 2 left, line 2 right…", so a sentence a human reads top-to-bottom arrives at the model scrambled.- **Tables collapse.** Copy-paste turns a table into a loose run of numbers. The relationship between a header and its cell — the entire point of a table — is gone.- **Headings disappear.** The visual hierarchy (this is a section, this is a subsection) is encoded as font size and weight, not structure. Strip the styling and you get one undifferentiated wall of text.- **Noise creeps in.** Page numbers, running headers, hyphenated line breaks, and stray ligatures end up inline, polluting prompts and embeddings alike. Casos de uso
Casos de uso de la conversión de sitios web a Markdown
Desde agentes de IA hasta migraciones de contenido, convertir páginas web en Markdown es un paso pequeño del que dependen muchos flujos de trabajo.
Procesos de IA y LLM
Alimenta índices de RAG, herramientas de agentes y prompts con artículos y documentación como texto limpio y con sus encabezados intactos, en lugar de HTML sin procesar.
Investigación y apuntes
Guarda una fuente como Markdown para citarla, anotarla o conservarla en Obsidian o un repositorio de notas, con los enlaces originales aún en su sitio.
Equipos de contenido
Traslada entradas y páginas de ayuda de un CMS a otro, o lleva material de referencia a un sitio de documentación basado en Markdown.
Desarrolladores
Llama a la API desde trabajos de ingesta y rastreadores que ya ejecutes y obtén el mismo Markdown que muestra el conversor del navegador.

API
API de URL a Markdown para desarrolladores
¿Conviertes páginas desde código? Envía una URL —o hasta 20 en un array urls— a POST /v1/convert/url con tu clave de API. El Markdown vuelve en la misma respuesta cuando la página termina dentro de la ventana de espera; si no, obtienes una conversión que sondear o un webhook cuando se resuelva. El acceso a la API está en los planes de pago.
Leer la guía de la APIcurl -X POST https://api.markitdown.ai/v1/convert/url \ -H "x-api-key: mdai_…" \ -H "content-type: application/json" \ -d '{"url":"https://markitdown.ai/blog/why-pdfs-break-llms"}'Guía
Revisar el resultado
Revisa el resultado de URL a Markdown junto a la página pública que enviaste. Confirma que el texto del artículo o de la documentación está presente y luego inspecciona el principio y el final en busca de navegación, avisos de cookies y enlaces de pie de página repetidos. El conversor recibe HTML del servidor; no ejecuta la aplicación de la página para cargar contenido que solo aparece tras ejecutarse JavaScript. Si el resultado no contiene mucho más que una estructura de navegación, verifica cómo entrega esa página su artículo. Una exportación legible puede contener igualmente material fuera del artículo principal, así que decide qué pertenece a tus apuntes o índice de recuperación antes de usarla. Conserva la URL de origen junto al Markdown para que un lector pueda volver a la página original.
Conservar el contexto de origen
Conserva la URL enviada y tu fecha de recuperación junto a un resultado de URL a Markdown en tu propio flujo de trabajo. Una página pública puede cambiar después de que la conviertas, así que un visitante posterior puede ver un pasaje revisado. El campo de metadatos de la API puede llevar contexto que tú aportes, pero no extrae automáticamente autoría ni fechas de publicación verificadas de la página. Comprueba esos datos en la fuente si tu investigación los necesita. Antes de citar una tabla o un párrafo, compáralo con la página y conserva suficiente contexto alrededor para no cambiar su significado. Markdown hace que el contenido web sea más fácil de reutilizar; no determina si la página es exacta ni si tienes permiso para republicarla.
HTML guardado frente a URL
Elige el conversor de HTML cuando ya tengas la instantánea exacta de la página que necesitas procesar. Elige URL a Markdown cuando una dirección de acceso público sea la entrada de la conversión actual. Son flujos de trabajo relacionados con controles de origen distintos: un archivo guardado fija la entrada que envías, mientras que una URL depende de lo que el sitio web devuelva en el momento de la solicitud. Ninguna de las dos rutas elude las restricciones de acceso ni garantiza la eliminación de los anuncios. Si un sitio deniega el descargador o exige iniciar sesión, usa material que estés autorizado a obtener mediante un flujo de trabajo adecuado. No reintentes repetidamente una URL inaccesible como si otro intento de conversión concediera acceso.
Investigación con LLM
Los investigadores pegan una fuente, no un archivo. Este conversor descarga la URL que envías, convierte el HTML renderizado en el servidor y devuelve Markdown que puedes citar, fragmentar o dejar caer en un gestor de notas. No inicia sesión tras muros de pago ni ejecuta el JavaScript del lado del cliente de la página.
- Solo se admiten URL de acceso público.
- El descargador se identifica; los operadores pueden denegar el user agent: consulta /docs/fetcher.
- Los archivos HTML guardados van en /html-to-markdown, no aquí.
Más convertidores de Markdown
- PDF → MarkdownTexto, tablas y escaneos
- Word → MarkdownDOCX con títulos y listas
- PPT → MarkdownTexto, notas y tablas de diapositivas
- Excel → MarkdownCada hoja como tabla
- Image → MarkdownOCR para escaneos y capturas
- HTML → MarkdownPega o sube HTML
- Markdown → HTMLHTML limpio y semántico
- Markdown → TextTexto plano sin marcado
- Markdown → PDFImprime a PDF en local
Need it in your code? Use the developer API. Converting at scale? See plans and pricing.
FAQ
Preguntas sobre URL a Markdown
¿Cómo funciona URL a Markdown?
Pega la URL de una página web pública. La página se descarga en el servidor y se convierte en Markdown: no hay archivo que subir.
¿Elimina los anuncios y la navegación de una página activa?
Todavía no de forma fiable. El conversor actual puede conservar navegación, anuncios y texto de pie de página junto al contenido principal.
¿Hay límites de tamaño para una página descargada?
El conversor público funciona con páginas web públicas. Las páginas descargadas están sujetas a límites de tamaño de respuesta y pueden rechazarse si son demasiado grandes.
¿Funciona en páginas detrás de un inicio de sesión?
No. Solo se admiten URL de acceso público. Las páginas detrás de autenticación, muros de pago o pantallas de inicio de sesión no se pueden descargar.
¿Y las páginas renderizadas con JavaScript?
El conversor descarga el HTML inicial renderizado en el servidor. Las páginas que dependen del JavaScript del lado del cliente para cargar contenido pueden no convertirse por completo.
¿Puedo convertir varias URL a la vez?
Envía un array urls con hasta 20 URL públicas a POST /v1/convert/url. Sigue el resultado de cada archivo y gestiona las respuestas asíncronas. Consulta /developers.
¿URL a Markdown es gratis?
Sí. Previsualizar y copiar el Markdown es gratis sin cuenta, hasta 3 conversiones por hora y 10 al día; descargar el archivo .md requiere iniciar sesión. Solo páginas web públicas (sin URL internas ni privadas).
¿Qué contenido conserva el conversor?
Los encabezados, párrafos, listas, enlaces, tablas y bloques de código se convierten en Markdown. Los scripts y estilos se descartan. La navegación, los pies de página y los anuncios pueden seguir apareciendo junto al contenido principal.
¿Hay una API de conversión por URL?
Sí. Convierte páginas web por URL mediante programación a través de la API REST. Consulta /developers. Los archivos HTML guardados usan /html-to-markdown.
Convierte URL a Markdown a escala.
Pruébalo gratis: no hace falta registrarse.