Convertitore

URL in Markdown: convertire una pagina web online

URL in Markdown è un convertitore gratuito che trasforma una pagina web accessibile pubblicamente in Markdown pulito e strutturato, pronto per LLM, pipeline RAG e note, ideale per una pagina web in Markdown. Nessuna registrazione per provarlo; la prova consente 3 conversioni per IP all'ora e 10 al giorno.

Non hai ancora convertito nessuna pagina
Incolla un URL sopra e premi Converti. Il Markdown apparirà qui.

Come si fa

Come convertire una pagina web in Markdown

Cosa puoi incollare

  • Qualsiasi pagina pubblica http(s): articoli, documentazione, post di blog
  • Le pagine dietro un accesso o un paywall non possono essere recuperate
  • La pagina viene scaricata sul nostro server, senza eseguire il suo JavaScript
  • Provalo senza account: fino a 10 MB e 25 pagine per file, 3 conversioni all'ora e 10 al giorno
URL in Markdown: una finestra del browser con barra degli indirizzi diventa a sinistra una finestra Markdown

Perché usarlo

Perché usare questo convertitore da URL a Markdown

Una pagina web è scritta per un browser. Il Markdown è scritto per le persone e i modelli. Questo convertitore conserva le parti che portano significato e scarta il markup che le circonda.

Struttura che resiste

Titoli, elenchi, link, tabelle e blocchi di codice arrivano come Markdown, così la pagina si legge ancora come uno schema.

Scarica una pagina pubblica

Articoli, documentazione, post di blog e pagine di prodotto. La pagina viene scaricata lato server: nessuna estensione o strumento locale da installare.

Gratis da provare, senza accesso

Visualizza in anteprima e copia il Markdown senza account, fino a 3 conversioni all'ora e 10 al giorno. Accedi per scaricare il file .md.

Anteprima o sorgente grezza

Passa dal Markdown renderizzato al suo testo grezzo prima di copiarlo in un prompt, in un archivio di note o in un repository.

Un fetcher educato e identificato

Ogni richiesta si identifica con uno user agent documentato e i proprietari dei siti possono bloccarla: vedi la pagina del fetcher nella documentazione.

Lo stesso motore dell'API

Il convertitore di questa pagina e POST /v1/convert/url eseguono lo stesso codice, quindi uno script può convertire fino a 20 URL per chiamata.

Il problema

Perché una pagina attiva è rumorosa per i modelli

Le pagine sono rumorose

Le pagine web attive seppelliscono il contenuto sotto navigazione, annunci, banner e script.

Il markup è disordinato

L'HTML scritto a mano e quello generato raramente corrispondono in modo pulito a una struttura leggibile.

L'IA vuole l'articolo

RAG e agenti vogliono l'articolo, non gli elementi di interfaccia che lo circondano, e vogliono un URL, non un salvataggio manuale.

Pagina web in Markdown: testo incollato male accanto a una struttura Markdown pulita

Cosa viene conservato

Cosa scarica questo convertitore di URL

Download lato server
La pagina viene scaricata lato server e poi convertita come un file HTML; non serve alcun plugin del browser né strumento locale.Source: RFC 9110: HTTP Semantics
Solo pagine pubbliche
Le pagine dietro autenticazione, paywall o schermate di accesso non possono essere scaricate. Sono supportati solo URL accessibili pubblicamente.Source: RFC 9110: HTTP Semantics
Pagine con molto JavaScript
Le pagine che dipendono molto dal JavaScript lato client per renderizzare i contenuti possono non convertirsi completamente, perché il fetcher riceve l'HTML iniziale renderizzato lato server.Source: HTML Living Standard
Dimensione e identità
Le pagine scaricate sono soggette a limiti di dimensione della risposta e possono essere rifiutate se troppo grandi. Lo user agent del fetcher è documentato su /docs/fetcher.Source: product pipeline

Esempio: articolo del blog markitdown.ai tramite download da URL· https://markitdown.ai/blog/why-pdfs-break-llms

# Why PDFs break LLMs — and what clean Markdown fixes Jun 12, 2026 · The markitdown.ai team · 3 min read A PDF renders perfectly for a human and falls apart the moment a model reads it. The page you see — columns, tables, headers, footnotes — is a *visual* arrangement, not a logical one. When you pull raw text out of it, that visual order rarely survives, and whatever you feed a language model is only as good as the text it actually receives. ## What actually goes wrong When teams pipe documents straight into an LLM or a retrieval index, a few failure modes show up again and again: - **Reading order breaks.** Multi-column layouts interleave. A two-column page becomes "line 1 left, line 1 right, line 2 left, line 2 right…", so a sentence a human reads top-to-bottom arrives at the model scrambled.- **Tables collapse.** Copy-paste turns a table into a loose run of numbers. The relationship between a header and its cell — the entire point of a table — is gone.- **Headings disappear.** The visual hierarchy (this is a section, this is a subsection) is encoded as font size and weight, not structure. Strip the styling and you get one undifferentiated wall of text.- **Noise creeps in.** Page numbers, running headers, hyphenated line breaks, and stray ligatures end up inline, polluting prompts and embeddings alike. 

Casi d'uso

Casi d'uso per la conversione di un sito web in Markdown

Dagli agenti IA alla migrazione di contenuti, trasformare le pagine web in Markdown è un piccolo passo da cui dipendono molti flussi di lavoro.

Pipeline IA e LLM

Alimenta indici RAG, strumenti per agenti e prompt con articoli e documentazione come testo pulito e con i titoli intatti, invece che con HTML grezzo.

Ricerca e note

Salva una fonte come Markdown per citarla, annotarla o conservarla in Obsidian o in un repository di note, con i link originali ancora al loro posto.

Team di contenuti

Sposta post e pagine di assistenza da un CMS a un altro, oppure porta materiale di riferimento in un sito di documentazione basato su Markdown.

Sviluppatori

Chiama l'API da job di ingestione e crawler che già esegui e ottieni lo stesso Markdown che mostra il convertitore nel browser.

Sito web in Markdown: un file Markdown alimenta indice RAG, prompt e note

API

API di URL in Markdown per sviluppatori

Converti pagine dal codice? Invia un solo URL — o fino a 20 in un array urls — a POST /v1/convert/url con la tua chiave API. Il Markdown torna nella stessa risposta quando la pagina termina entro la finestra di attesa; altrimenti ottieni una conversione da interrogare o un webhook quando si conclude. L'accesso API è disponibile nei piani a pagamento.

Leggi la guida API
curl -X POST https://api.markitdown.ai/v1/convert/url \  -H "x-api-key: mdai_…" \  -H "content-type: application/json" \  -d '{"url":"https://markitdown.ai/blog/why-pdfs-break-llms"}'

Controllare l'output

Controlla l'output di URL in Markdown accanto alla pagina pubblica che hai inviato. Conferma che il testo dell'articolo o della documentazione sia presente, poi esamina l'inizio e la fine in cerca di navigazione, avvisi sui cookie e link di piè di pagina ripetuti. Il convertitore riceve l'HTML dal server; non esegue l'applicazione della pagina per caricare contenuti che compaiono solo dopo l'esecuzione di JavaScript. Se l'output contiene poco più di una struttura di navigazione, verifica come quella pagina distribuisce il suo articolo. Un'esportazione leggibile può comunque contenere materiale fuori dall'articolo principale, quindi decidi cosa appartiene alle tue note o al tuo indice di recupero prima di usarla. Conserva l'URL di origine insieme al Markdown, così un lettore può tornare alla pagina originale.

Conservare il contesto di origine

Conserva l'URL inviato e la tua data di recupero insieme a un risultato di URL in Markdown nel tuo flusso di lavoro. Una pagina pubblica può cambiare dopo che l'hai convertita, quindi un visitatore successivo può vedere un passaggio rivisto. Il campo di metadati dell'API può portare un contesto che fornisci tu, ma non estrae automaticamente paternità o date di pubblicazione verificate dalla pagina. Verifica quei dati alla fonte se la tua ricerca ne ha bisogno. Prima di citare una tabella o un paragrafo, confrontalo con la pagina e conserva abbastanza contesto circostante da non cambiarne il significato. Il Markdown rende il contenuto web più facile da riutilizzare; non stabilisce se la pagina è accurata né se hai il permesso di ripubblicarla.

HTML salvato o URL

Scegli il convertitore HTML quando possiedi già l'istantanea esatta della pagina che devi elaborare. Scegli URL in Markdown quando un indirizzo accessibile pubblicamente è l'input della conversione corrente. Sono flussi di lavoro correlati con controlli di origine diversi: un file salvato fissa l'input che invii, mentre un URL dipende da ciò che il sito web restituisce al momento della richiesta. Nessuna delle due strade aggira le restrizioni di accesso né garantisce la rimozione degli annunci. Se un sito nega il fetcher o richiede l'accesso, usa materiale che sei autorizzato a ottenere tramite un flusso di lavoro adeguato. Non ritentare ripetutamente un URL inaccessibile come se un altro tentativo di conversione concedesse l'accesso.

Ricerca con LLM

I ricercatori incollano una fonte, non un file. Questo convertitore scarica l'URL che invii, converte l'HTML renderizzato lato server e restituisce Markdown che puoi citare, suddividere o inserire in un archivio di note. Non accede dietro i paywall e non esegue il JavaScript lato client della pagina.

  • Sono supportati solo URL accessibili pubblicamente.
  • Il fetcher si identifica; gli operatori possono negare lo user agent: vedi /docs/fetcher.
  • I file HTML salvati vanno su /html-to-markdown, non qui.

FAQ

Domande su URL in Markdown

Come funziona URL in Markdown?

Incolla l'URL di una pagina web pubblica. La pagina viene scaricata lato server e convertita in Markdown: non c'è alcun file da caricare.

Rimuove gli annunci e la navigazione da una pagina attiva?

Non ancora in modo affidabile. Il convertitore attuale può conservare navigazione, annunci e testo del piè di pagina accanto al contenuto principale.

Ci sono limiti di dimensione per una pagina scaricata?

Il convertitore pubblico funziona con pagine web pubbliche. Le pagine scaricate sono soggette a limiti di dimensione della risposta e possono essere rifiutate se troppo grandi.

Funziona sulle pagine dietro un accesso?

No. Sono supportati solo URL accessibili pubblicamente. Le pagine dietro autenticazione, paywall o schermate di accesso non possono essere scaricate.

E le pagine renderizzate con JavaScript?

Il convertitore scarica l'HTML iniziale renderizzato lato server. Le pagine che dipendono dal JavaScript lato client per caricare contenuti possono non convertirsi completamente.

Posso convertire più URL contemporaneamente?

Invia un array urls con fino a 20 URL pubblici a POST /v1/convert/url. Segui il risultato di ogni file e gestisci le risposte asincrone. Vedi /developers.

URL in Markdown è gratuito?

Sì. Visualizzare in anteprima e copiare il Markdown è gratuito senza account, fino a 3 conversioni all'ora e 10 al giorno; scaricare il file .md richiede l'accesso. Solo pagine web pubbliche (nessun URL interno o privato).

Quali contenuti conserva il convertitore?

Titoli, paragrafi, elenchi, link, tabelle e blocchi di codice diventano Markdown. Script e stili vengono scartati. Navigazione, piè di pagina e annunci possono comunque comparire accanto al contenuto principale.

Esiste un'API di conversione da URL?

Sì. Converti pagine web tramite URL a livello di codice con l'API REST. Vedi /developers. I file HTML salvati usano /html-to-markdown.

Converti URL in Markdown su larga scala.

Provalo gratis: non serve registrarsi.