Convertisseur

Convertisseur URL en Markdown

Convertisseur URL en Markdown est un convertisseur gratuit qui transforme une page web d'accès public en Markdown propre et structuré, prêt pour les LLM, les pipelines RAG et vos notes. Aucun compte n'est nécessaire pour l'essayer ; l'essai permet 3 conversions par IP et par heure et 10 par jour.

Aucune page convertie pour le moment
Collez une URL ci-dessus et appuyez sur Convertir. Le Markdown apparaît ici.

Comment faire

Comment convertir une page web en Markdown

Ce que vous pouvez coller

  • Toute page http(s) publique — articles, documentation, articles de blog
  • Les pages derrière une connexion ou un paywall ne peuvent pas être récupérées
  • La page est récupérée sur notre serveur, sans exécuter son JavaScript
  • Essayez sans compte : jusqu'à 10 MB et 25 pages par fichier, 3 conversions par heure et 10 par jour
Convertisseur URL en Markdown : fenêtre de navigateur avec barre d'adresse devenant une fenêtre Markdown

Pourquoi l'utiliser

Pourquoi utiliser ce convertisseur URL en Markdown

Une page web est écrite pour un navigateur. Le Markdown est écrit pour les personnes et les modèles. Ce convertisseur conserve les parties porteuses de sens et écarte le balisage qui les entoure.

Une structure qui dure

Les titres, les listes, les liens, les tableaux et les blocs de code arrivent en Markdown, donc la page continue de se lire comme un plan.

Télécharge une page publique

Articles, documentation, articles de blog et pages produit. La page est téléchargée côté serveur : aucune extension ni outil local à installer.

Gratuit à l'essai, sans connexion

Prévisualisez et copiez le Markdown sans compte, jusqu'à 3 conversions par heure et 10 par jour. Connectez-vous pour télécharger le fichier .md.

Aperçu ou code brut

Basculez entre le Markdown rendu et son texte brut avant de le copier dans un prompt, un gestionnaire de notes ou un dépôt.

Un récupérateur poli et identifié

Chaque requête s'identifie par un user agent documenté, et les propriétaires de sites peuvent le bloquer : consultez la page du récupérateur dans la documentation.

Le même moteur que l'API

Le convertisseur de cette page et POST /v1/convert/url exécutent le même code, donc un script peut convertir jusqu'à 20 URL par appel.

Le problème

Pourquoi une page active est bruyante pour les modèles

Les pages sont bruyantes

Les pages web actives enterrent le contenu sous la navigation, les publicités, les bandeaux et les scripts.

Le balisage est désordonné

Le HTML écrit à la main et le HTML généré correspondent rarement de façon propre à une structure lisible.

L'IA veut l'article

Le RAG et les agents veulent l'article, pas les éléments d'interface qui l'entourent, et veulent une URL, pas un enregistrement manuel.

Page web en Markdown : texte copié-collé désordonné à côté d'une structure Markdown propre

Ce qui est conservé

Ce que ce convertisseur URL télécharge

Téléchargement côté serveur
La page est téléchargée côté serveur puis convertie comme un fichier HTML ; aucun plugin de navigateur ni outil local n'est nécessaire.Source: RFC 9110: HTTP Semantics
Pages publiques uniquement
Les pages derrière une authentification, un paywall ou un écran de connexion ne peuvent pas être téléchargées. Seules les URL d'accès public sont prises en charge.Source: RFC 9110: HTTP Semantics
Pages riches en JavaScript
Les pages qui dépendent fortement du JavaScript côté client pour afficher leur contenu peuvent ne pas être converties entièrement, car le récupérateur reçoit le HTML initial rendu côté serveur.Source: HTML Living Standard
Taille et identité
Les pages téléchargées sont soumises à des limites de taille de réponse et peuvent être refusées si elles sont trop grandes. Le user agent du récupérateur est documenté sur /docs/fetcher.Source: product pipeline

Exemple : article de blog markitdown.ai via un téléchargement par URL· https://markitdown.ai/blog/why-pdfs-break-llms

# Why PDFs break LLMs — and what clean Markdown fixes Jun 12, 2026 · The markitdown.ai team · 3 min read A PDF renders perfectly for a human and falls apart the moment a model reads it. The page you see — columns, tables, headers, footnotes — is a *visual* arrangement, not a logical one. When you pull raw text out of it, that visual order rarely survives, and whatever you feed a language model is only as good as the text it actually receives. ## What actually goes wrong When teams pipe documents straight into an LLM or a retrieval index, a few failure modes show up again and again: - **Reading order breaks.** Multi-column layouts interleave. A two-column page becomes "line 1 left, line 1 right, line 2 left, line 2 right…", so a sentence a human reads top-to-bottom arrives at the model scrambled.- **Tables collapse.** Copy-paste turns a table into a loose run of numbers. The relationship between a header and its cell — the entire point of a table — is gone.- **Headings disappear.** The visual hierarchy (this is a section, this is a subsection) is encoded as font size and weight, not structure. Strip the styling and you get one undifferentiated wall of text.- **Noise creeps in.** Page numbers, running headers, hyphenated line breaks, and stray ligatures end up inline, polluting prompts and embeddings alike. 

Cas d'usage

Cas d'usage de la conversion de sites web en Markdown

Des agents IA aux migrations de contenu, convertir des pages web en Markdown est une petite étape dont dépendent beaucoup de flux de travail.

Pipelines IA et LLM

Alimentez les index RAG, les outils d'agents et les prompts avec des articles et de la documentation en texte propre et aux titres intacts, plutôt qu'en HTML brut.

Recherche et notes

Enregistrez une source en Markdown pour la citer, l'annoter ou la conserver dans Obsidian ou un dépôt de notes, avec les liens d'origine toujours en place.

Équipes de contenu

Transférez articles et pages d'aide d'un CMS à un autre, ou portez du matériel de référence vers un site de documentation basé sur Markdown.

Développeurs

Appelez l'API depuis des tâches d'ingestion et des crawlers que vous exécutez déjà et obtenez le même Markdown que celui affiché par le convertisseur du navigateur.

Site web en Markdown : une tuile navigateur alimente un fichier Markdown dans un index RAG, prompts et notes

API

API URL en Markdown pour les développeurs

Vous convertissez des pages depuis du code ? Envoyez une URL — ou jusqu'à 20 dans un tableau urls — à POST /v1/convert/url avec votre clé d'API. Le Markdown revient dans la même réponse quand la page se termine dans la fenêtre d'attente ; sinon, vous obtenez une conversion à interroger ou un webhook à son aboutissement. L'accès à l'API fait partie des forfaits payants.

Lire le guide de l'API
curl -X POST https://api.markitdown.ai/v1/convert/url \  -H "x-api-key: mdai_…" \  -H "content-type: application/json" \  -d '{"url":"https://markitdown.ai/blog/why-pdfs-break-llms"}'

Vérifier le résultat

Examinez le résultat URL en Markdown à côté de la page publique que vous avez soumise. Confirmez que le texte de l'article ou de la documentation est présent, puis inspectez le début et la fin à la recherche de navigation, de bandeaux de cookies et de liens de pied de page répétés. Le convertisseur reçoit du HTML du serveur ; il n'exécute pas l'application de la page pour charger du contenu qui n'apparaît qu'après exécution du JavaScript. Si le résultat ne contient guère plus qu'une structure de navigation, vérifiez comment cette page livre son article. Un export lisible peut tout de même contenir du matériel hors de l'article principal, alors décidez ce qui appartient à vos notes ou à votre index de recherche avant de l'utiliser. Conservez l'URL source à côté du Markdown pour qu'un lecteur puisse revenir à la page d'origine.

Conserver le contexte de la source

Conservez l'URL soumise et votre date de récupération à côté d'un résultat URL en Markdown dans votre propre flux de travail. Une page publique peut changer après votre conversion, donc un visiteur ultérieur peut voir un passage révisé. Le champ de métadonnées de l'API peut porter un contexte que vous fournissez, mais il n'extrait pas automatiquement une attribution ou des dates de publication vérifiées de la page. Vérifiez ces données à la source si votre recherche en a besoin. Avant de citer un tableau ou un paragraphe, comparez-le à la page et conservez assez de contexte autour pour ne pas changer son sens. Le Markdown rend le contenu web plus facile à réutiliser ; il ne détermine pas si la page est exacte ni si vous avez le droit de la republier.

HTML enregistré contre URL

Choisissez le convertisseur HTML quand vous avez déjà l'instantané exact de la page à traiter. Choisissez URL en Markdown quand une adresse d'accès public est l'entrée de la conversion courante. Ce sont des flux de travail apparentés mais aux contrôles de source différents : un fichier enregistré fixe l'entrée que vous soumettez, tandis qu'une URL dépend de ce que le site renvoie au moment de la requête. Aucune des deux voies ne contourne les restrictions d'accès ni ne garantit la suppression des publicités. Si un site refuse le récupérateur ou exige une connexion, utilisez du matériel que vous êtes autorisé à obtenir par un flux de travail approprié. Ne relancez pas sans cesse une URL inaccessible comme si une nouvelle tentative de conversion accordait l'accès.

Recherche avec un LLM

Les chercheurs collent une source, pas un fichier. Ce convertisseur télécharge l'URL que vous soumettez, convertit le HTML rendu côté serveur et renvoie un Markdown que vous pouvez citer, découper ou déposer dans un gestionnaire de notes. Il ne se connecte pas derrière les paywalls et n'exécute pas le JavaScript côté client de la page.

  • Seules les URL d'accès public sont prises en charge.
  • Le récupérateur s'identifie ; les opérateurs peuvent refuser le user agent : voir /docs/fetcher.
  • Les fichiers HTML enregistrés vont sur /html-to-markdown, pas ici.

FAQ

Questions sur URL en Markdown

Comment fonctionne URL en Markdown ?

Collez l'URL d'une page web publique. La page est téléchargée côté serveur et convertie en Markdown : aucun fichier à importer.

Supprime-t-il les publicités et la navigation d'une page active ?

Pas encore de façon fiable. Le convertisseur actuel peut conserver la navigation, les publicités et le texte de pied de page à côté du contenu principal.

Y a-t-il des limites de taille pour une page téléchargée ?

Le convertisseur public fonctionne avec des pages web publiques. Les pages téléchargées sont soumises à des limites de taille de réponse et peuvent être refusées si elles sont trop grandes.

Fonctionne-t-il sur les pages derrière une connexion ?

Non. Seules les URL d'accès public sont prises en charge. Les pages derrière une authentification, un paywall ou un écran de connexion ne peuvent pas être téléchargées.

Et les pages rendues avec JavaScript ?

Le convertisseur télécharge le HTML initial rendu côté serveur. Les pages qui dépendent du JavaScript côté client pour charger leur contenu peuvent ne pas être converties entièrement.

Puis-je convertir plusieurs URL à la fois ?

Envoyez un tableau urls avec jusqu'à 20 URL publiques à POST /v1/convert/url. Suivez le résultat de chaque fichier et gérez les réponses asynchrones. Voir /developers.

URL en Markdown est-il gratuit ?

Oui. Prévisualiser et copier le Markdown est gratuit sans compte, jusqu'à 3 conversions par heure et 10 par jour ; télécharger le fichier .md nécessite une connexion. Uniquement des pages web publiques (pas d'URL internes ni privées).

Quel contenu le convertisseur conserve-t-il ?

Les titres, paragraphes, listes, liens, tableaux et blocs de code sont convertis en Markdown. Les scripts et styles sont écartés. La navigation, les pieds de page et les publicités peuvent encore apparaître à côté du contenu principal.

Existe-t-il une API de conversion par URL ?

Oui. Convertissez des pages web par URL de façon programmatique via l'API REST. Voir /developers. Les fichiers HTML enregistrés passent par /html-to-markdown.

Convertissez URL en Markdown à grande échelle.

Essai gratuit — sans inscription.