---
title: "Convertidor de URL a Markdown"
description: "URL a Markdown es un conversor gratuito que convierte una página web de acceso público en Markdown limpio y estructurado, listo para LLM, procesos de RAG y apuntes. No hace falta registrarse para probarlo; la prueba permite 3 conversiones por IP y hora y 10 al día."
url: https://markitdown.ai/url-to-markdown
updated: 2026-09-26
source: markitdown.ai
---

# Convertidor de URL a Markdown

> URL a Markdown es un conversor gratuito que convierte una página web de acceso público en Markdown limpio y estructurado, listo para LLM, procesos de RAG y apuntes. No hace falta registrarse para probarlo; la prueba permite 3 conversiones por IP y hora y 10 al día.

## Cómo convertir una página web a Markdown

- Pega la dirección de una página web de acceso público —un artículo, una página de documentación, una entrada de blog— en el cuadro de arriba.
- Pulsa convertir. El servidor descarga el HTML público y devuelve Markdown cuando termina el procesamiento.
- Lee el resultado en la vista previa o en el código, cópialo o inicia sesión para descargar el archivo .md.

## Por qué usar este conversor de URL a Markdown

Una página web está escrita para un navegador. Markdown está escrito para personas y modelos. Este conversor conserva las partes que aportan significado y descarta el marcado que las rodea.

- Estructura que perdura — Los encabezados, las listas, los enlaces, las tablas y los bloques de código llegan como Markdown, así que la página sigue leyéndose como un esquema.
- Descarga una página pública — Artículos, documentación, entradas de blog y páginas de producto. La página se descarga en el servidor: no hay extensión ni herramienta local que instalar.
- Gratis para probar, sin iniciar sesión — Previsualiza y copia el Markdown sin cuenta, hasta 3 conversiones por hora y 10 al día. Inicia sesión para descargar el archivo .md.
- Vista previa o código sin procesar — Alterna entre el Markdown renderizado y su texto sin procesar antes de copiarlo a un prompt, un gestor de notas o un repositorio.
- Un descargador educado e identificado — Cada solicitud se identifica con un user agent documentado, y los propietarios de los sitios pueden bloquearlo: consulta la página del descargador en la documentación.
- El mismo motor que la API — El conversor de esta página y POST /v1/convert/url ejecutan el mismo código, así que un script puede convertir hasta 20 URL por llamada.

## Por qué una página activa es ruidosa para los modelos

- Las páginas son ruidosas — Las páginas web activas entierran el contenido bajo navegación, anuncios, banners y scripts.
- El marcado es desordenado — El HTML escrito a mano y el generado rara vez se corresponden limpiamente con una estructura legible.
- La IA necesita el artículo — RAG y los agentes quieren el artículo, no los elementos de interfaz que lo rodean, y quieren una URL, no un guardado manual.

## Qué descarga este conversor de URL

- Descarga en el servidor — La página se descarga en el servidor y luego se convierte como un archivo HTML; no hace falta ningún plugin del navegador ni herramienta local.
- Solo páginas públicas — Las páginas detrás de autenticación, muros de pago o pantallas de inicio de sesión no se pueden descargar. Solo se admiten URL de acceso público.
- Páginas con mucho JavaScript — Las páginas que dependen en gran medida del JavaScript del lado del cliente para renderizar su contenido pueden no convertirse por completo, ya que el descargador recibe el HTML inicial renderizado en el servidor.
- Tamaño e identidad — Las páginas descargadas están sujetas a límites de tamaño de respuesta y pueden rechazarse si son demasiado grandes. El user agent del descargador está documentado en /docs/fetcher.

## Casos de uso de la conversión de sitios web a Markdown

Desde agentes de IA hasta migraciones de contenido, convertir páginas web en Markdown es un paso pequeño del que dependen muchos flujos de trabajo.

- Procesos de IA y LLM — Alimenta índices de RAG, herramientas de agentes y prompts con artículos y documentación como texto limpio y con sus encabezados intactos, en lugar de HTML sin procesar.
- Investigación y apuntes — Guarda una fuente como Markdown para citarla, anotarla o conservarla en Obsidian o un repositorio de notas, con los enlaces originales aún en su sitio.
- Equipos de contenido — Traslada entradas y páginas de ayuda de un CMS a otro, o lleva material de referencia a un sitio de documentación basado en Markdown.
- Desarrolladores — Llama a la API desde trabajos de ingesta y rastreadores que ya ejecutes y obtén el mismo Markdown que muestra el conversor del navegador.

## API de URL a Markdown para desarrolladores

¿Conviertes páginas desde código? Envía una URL —o hasta 20 en un array urls— a POST /v1/convert/url con tu clave de API. El Markdown vuelve en la misma respuesta cuando la página termina dentro de la ventana de espera; si no, obtienes una conversión que sondear o un webhook cuando se resuelva. El acceso a la API está en los planes de pago.

```bash
curl -X POST https://api.markitdown.ai/v1/convert/url \
  -H "x-api-key: mdai_…" \
  -H "content-type: application/json" \
  -d '{"url":"https://markitdown.ai/blog/why-pdfs-break-llms"}'
```

## Revisar el resultado

Revisa el resultado de URL a Markdown junto a la página pública que enviaste. Confirma que el texto del artículo o de la documentación está presente y luego inspecciona el principio y el final en busca de navegación, avisos de cookies y enlaces de pie de página repetidos. El conversor recibe HTML del servidor; no ejecuta la aplicación de la página para cargar contenido que solo aparece tras ejecutarse JavaScript. Si el resultado no contiene mucho más que una estructura de navegación, verifica cómo entrega esa página su artículo. Una exportación legible puede contener igualmente material fuera del artículo principal, así que decide qué pertenece a tus apuntes o índice de recuperación antes de usarla. Conserva la URL de origen junto al Markdown para que un lector pueda volver a la página original.

## Conservar el contexto de origen

Conserva la URL enviada y tu fecha de recuperación junto a un resultado de URL a Markdown en tu propio flujo de trabajo. Una página pública puede cambiar después de que la conviertas, así que un visitante posterior puede ver un pasaje revisado. El campo de metadatos de la API puede llevar contexto que tú aportes, pero no extrae automáticamente autoría ni fechas de publicación verificadas de la página. Comprueba esos datos en la fuente si tu investigación los necesita. Antes de citar una tabla o un párrafo, compáralo con la página y conserva suficiente contexto alrededor para no cambiar su significado. Markdown hace que el contenido web sea más fácil de reutilizar; no determina si la página es exacta ni si tienes permiso para republicarla.

## HTML guardado frente a URL

Elige el conversor de HTML cuando ya tengas la instantánea exacta de la página que necesitas procesar. Elige URL a Markdown cuando una dirección de acceso público sea la entrada de la conversión actual. Son flujos de trabajo relacionados con controles de origen distintos: un archivo guardado fija la entrada que envías, mientras que una URL depende de lo que el sitio web devuelva en el momento de la solicitud. Ninguna de las dos rutas elude las restricciones de acceso ni garantiza la eliminación de los anuncios. Si un sitio deniega el descargador o exige iniciar sesión, usa material que estés autorizado a obtener mediante un flujo de trabajo adecuado. No reintentes repetidamente una URL inaccesible como si otro intento de conversión concediera acceso.

## Investigación con LLM

Los investigadores pegan una fuente, no un archivo. Este conversor descarga la URL que envías, convierte el HTML renderizado en el servidor y devuelve Markdown que puedes citar, fragmentar o dejar caer en un gestor de notas. No inicia sesión tras muros de pago ni ejecuta el JavaScript del lado del cliente de la página.

- Solo se admiten URL de acceso público.
- El descargador se identifica; los operadores pueden denegar el user agent: consulta /docs/fetcher.
- Los archivos HTML guardados van en /html-to-markdown, no aquí.

## Ejemplo: entrada del blog de markitdown.ai mediante descarga por URL

Source: https://markitdown.ai/blog/why-pdfs-break-llms

```markdown
# Why PDFs break LLMs — and what clean Markdown fixes

Jun 12, 2026 · The markitdown.ai team · 3 min read

A PDF renders perfectly for a human and falls apart the moment a model reads it. The page you see — columns, tables, headers, footnotes — is a *visual* arrangement, not a logical one. When you pull raw text out of it, that visual order rarely survives, and whatever you feed a language model is only as good as the text it actually receives.

## What actually goes wrong

When teams pipe documents straight into an LLM or a retrieval index, a few failure modes show up again and again:

- **Reading order breaks.** Multi-column layouts interleave. A two-column page becomes "line 1 left, line 1 right, line 2 left, line 2 right…", so a sentence a human reads top-to-bottom arrives at the model scrambled.
- **Tables collapse.** Copy-paste turns a table into a loose run of numbers. The relationship between a header and its cell — the entire point of a table — is gone.
- **Headings disappear.** The visual hierarchy (this is a section, this is a subsection) is encoded as font size and weight, not structure. Strip the styling and you get one undifferentiated wall of text.
- **Noise creeps in.** Page numbers, running headers, hyphenated line breaks, and stray ligatures end up inline, polluting prompts and embeddings alike.

```

## FAQ

### ¿Cómo funciona URL a Markdown?

Pega la URL de una página web pública. La página se descarga en el servidor y se convierte en Markdown: no hay archivo que subir.

### ¿Elimina los anuncios y la navegación de una página activa?

Todavía no de forma fiable. El conversor actual puede conservar navegación, anuncios y texto de pie de página junto al contenido principal.

### ¿Hay límites de tamaño para una página descargada?

El conversor público funciona con páginas web públicas. Las páginas descargadas están sujetas a límites de tamaño de respuesta y pueden rechazarse si son demasiado grandes.

### ¿Funciona en páginas detrás de un inicio de sesión?

No. Solo se admiten URL de acceso público. Las páginas detrás de autenticación, muros de pago o pantallas de inicio de sesión no se pueden descargar.

### ¿Y las páginas renderizadas con JavaScript?

El conversor descarga el HTML inicial renderizado en el servidor. Las páginas que dependen del JavaScript del lado del cliente para cargar contenido pueden no convertirse por completo.

### ¿Puedo convertir varias URL a la vez?

Envía un array urls con hasta 20 URL públicas a POST /v1/convert/url. Sigue el resultado de cada archivo y gestiona las respuestas asíncronas. Consulta /developers.

### ¿URL a Markdown es gratis?

Sí. Previsualizar y copiar el Markdown es gratis sin cuenta, hasta 3 conversiones por hora y 10 al día; descargar el archivo .md requiere iniciar sesión. Solo páginas web públicas (sin URL internas ni privadas).

### ¿Qué contenido conserva el conversor?

Los encabezados, párrafos, listas, enlaces, tablas y bloques de código se convierten en Markdown. Los scripts y estilos se descartan. La navegación, los pies de página y los anuncios pueden seguir apareciendo junto al contenido principal.

### ¿Hay una API de conversión por URL?

Sí. Convierte páginas web por URL mediante programación a través de la API REST. Consulta /developers. Los archivos HTML guardados usan /html-to-markdown.

## Related

- [Markdown converter for documents and web pages.](https://markitdown.ai/)
