NovoFerramentas de Markdown para HTML, texto e PDF

Conversor de Markdown para documentos e páginas web.

Um conversor de Markdown para documentos e páginas web públicas: PDF, Word, PowerPoint, Excel, imagens e HTML viram texto que você pode inspecionar, reutilizar e levar para um fluxo de trabalho com IA.

Teste anônimo · 10 MB · 3 conversões / hora · 10 / dia

Converter para Markdown a partir de

  • PDF
  • DOCX
  • PPTX
  • XLSX
  • PNG / JPG
  • HTML
  • URL

Como funciona

Conversor de Markdown: como funciona

markitdown.ai é um conversor de Markdown que transforma PDFs, arquivos do Office, imagens e páginas web em Markdown limpo e pronto para IA para ChatGPT, Claude, pipelines RAG e agentes, por meio de um teste anônimo ou de uma conta paga com acesso à API para desenvolvedores.

Conversor de Markdown: página DOCX à esquerda vira uma janela Markdown com títulos e tabela à direita

What happens

Envie um arquivo ou cole uma URL. A conversão roda nos nossos servidores, não como um copiar e colar do navegador, então o mesmo arquivo produz o mesmo Markdown de onde vier. Cada página é tratada pelo que contém, e títulos, listas e tabelas saem como estrutura Markdown real.

What you get

  • Páginas com camada de texto são lidas diretamente; digitalizações e imagens passam por OCR automaticamente
  • Buscas de URL rodam nos nossos servidores, com endereços privados e internos bloqueados
  • Conversor público: até 10 MB e 25 páginas, sem login
  • Planos com login aumentam os dois limites, até 200 MB e 200 páginas no Pro

Créditos

Precisão em Markdown, com preço por página.

Uma fatura com camada de texto e um balanço digitalizado custam o mesmo por página: o pipeline escolhe a extração direta ou o OCR para você. Os extras de IA para figuras e imagens são opcionais e medidos à parte.

por página, texto ou digitalização
1 crédito
por página, texto ou digitalização
Documentos

PDF com camada de texto, arquivos do Office e HTML

1 crédito / página
Digitalizações e imagens

OCR para páginas digitalizadas, fotos e capturas de tela

1 crédito / página
Melhoria de figuras com IA

Gráficos e figuras descritos em PDF · planos pagos

3 créditos / figura
Compreensão de imagens com IA

Conteúdo da imagem descrito, não só OCR · planos pagos

5 créditos / imagem

API de Markdown

Uma API de Markdown para o seu pipeline RAG.

  • O mesmo pipeline de análise do aplicativo web
  • Milhares de arquivos em lote com webhooks na conclusão
  • Chaves de API com escopo e um registro de atividade completo
  • Markdown em uma única chamada, ou uma conversão para consultar quando um arquivo precisa de mais de 60 segundos
Ler a referência da API
curl -X POST https://api.markitdown.ai/v1/convert/word \  -H "x-api-key: $MARKITDOWN_API_KEY" \  -F file=@vendor-security-review-q3-2026.docx # If HTTP 202, GET the Location URL with the same API key.# Verified local parser output for vendor-security-review-q3-2026.docx:# ## Review Findings# # Risk ratings follow the standard High / Medium / Low scale defined in the vendor risk management policy.# # | Vendor | Risk Rating | Finding | Owner |# | --- | --- | --- | --- |# | CloudScan OCR | Medium | No documented data retention limit on uploaded scans | Security |# | PayBridge | Low | SOC 2 Type II renewed; no open items | Finance |# | LingoTrans API | High | Sub-processor list not disclosed on request | Legal |# | ArchiveNow Storage | Medium | Encryption at rest confirmed; key rotation overdue | Security |

O problema

Os documentos não estão prontos para a IA

A maioria dos documentos foi feita para pessoas e impressoras, não para modelos de linguagem. Antes que um arquivo possa ser incorporado, recuperado ou usado em raciocínio, ele precisa virar texto previsível. Isso é mais difícil do que parece, e é exatamente onde a extração ingênua falha.

Documento para Markdown: texto copiado e colado bagunçado ao lado de uma estrutura Markdown limpa

A ordem de leitura se quebra

PDFs em várias colunas, cabeçalhos e notas de rodapé se entrelaçam, e o texto que um LLM lê deixa de corresponder ao documento que uma pessoa vê.

Tabelas e títulos se achatam

O copiar e colar transforma tabelas em sequências de números e elimina a hierarquia de títulos que dá estrutura ao documento.

Digitalizações precisam de OCR

Páginas baseadas em imagem e contratos digitalizados não têm camada de texto alguma até passarem por reconhecimento óptico de caracteres.

O texto bruto tem ruído

A extração improvisada deixa números de página, hifenização quebrada e caracteres soltos que contaminam prompts e resultados de recuperação.

Pipelines RAG e agentes precisam de estrutura consistente, não só caracteres extraídos. O Markdown previsível é o que faz a divisão em blocos, a incorporação e a recuperação se comportarem da mesma forma em milhares de documentos, em vez de falharem em silêncio nos mais bagunçados. O analisador que dá conta dos arquivos difíceis é o que mantém os limpos confiáveis.

Formatos de entrada

Converta qualquer documento em Markdown

Cada formato de entrada tem sua própria página de conversão com limites, notas de formato e uma amostra de saída. Todas compartilham um mesmo motor de análise, então escolha a página que corresponde ao seu arquivo:

  • PDF para Markdown — relatórios, artigos, manuais e contratos. PDFs com texto nativo são analisados diretamente e a ordem de leitura em várias colunas é reconstruída; PDFs digitalizados passam por OCR página a página.
  • Word para Markdown — arquivos .docx e .doc antigos com títulos, listas, tabelas e comentários preservados, para que uma política ou uma especificação seja lida como um roteiro em vez de um bloco único.
  • PPT para Markdown — apresentações .pptx e .ppt slide a slide, com os títulos dos slides como cabeçalhos e os marcadores e tabelas preservados, o que torna uma apresentação de 40 slides pesquisável.
  • Excel para Markdown — pastas de trabalho .xlsx e .xls em que cada planilha vira uma tabela Markdown sob o nome da planilha.
  • Imagem para Markdown — capturas de tela e digitalizações PNG e JPG via OCR. A compreensão de imagens com IA é uma opção à parte, com login.
  • HTML para Markdown — páginas salvas, exportações e fragmentos com scripts e estilos removidos e a estrutura do artigo, os links e as tabelas preservados.
  • URL para Markdown — cole um endereço web público e receba a página em Markdown, baixada no servidor com um limite de tamanho e um tempo limite para que um site lento não trave a solicitação.

Formatos de saída

De Markdown para qualquer formato

Markdown é o formato de intercâmbio, então a conversão também funciona no sentido inverso. Os editores de Markdown abaixo renderizam enquanto você digita no navegador e nunca enviam seu texto:

  • Markdown para HTML — HTML semântico e limpo com tabelas no estilo GitHub, listas de tarefas e realce de código, pronto para colar em um CMS ou em um e-mail.
  • Markdown para texto — texto simples com títulos, listas e tabelas achatados de forma legível para janelas de chat, tickets e formulários.
  • Markdown para PDF — uma pré-visualização de impressão local; use Imprimir / Salvar como PDF no navegador e revise as páginas salvas.

A extração de JSON estruturado e a transcrição de áudio e vídeo são camadas planejadas sobre o Markdown. Elas são listadas como roteiro, não como recursos já disponíveis.

Casos de uso

Feito para toda equipe

O conversor de Markdown oferece um teste anônimo para conferir um primeiro resultado. O motivo pelo qual as equipes continuam usando é tudo o que vem depois do primeiro arquivo: histórico, lotes, documentos maiores e uma API que integra a conversão aos sistemas que você já usa. O mesmo Markdown funciona tanto se quem consome for uma pessoa quanto um índice de busca ou um modelo.

RAG e pipelines de IA

Converta documentos de origem em Markdown limpo antes da divisão em blocos, da incorporação ou do processamento por agentes. Uma estrutura previsível faz seu divisor ver títulos e tabelas reais em vez de uma parede de texto extraído, o que mantém a recuperação relevante e os prompts livres de ruído de layout.

Pesquisa e relatórios

Transforme artigos, white papers e apresentações em Markdown editável e pesquisável. Pesquisadores e analistas podem citar, anotar, resumir e reutilizar descobertas sem redigitar tabelas nem perder a ordem de leitura de um PDF denso.

Documentos de operações

Processe políticas, contratos, faturas e arquivos internos sem limpeza manual de copiar e colar. Um histórico de Markdown salvo torna o trabalho documental recorrente mais fácil de revisar, comparar e reutilizar no dia a dia de uma equipe.

Automação para desenvolvedores

Use a API para converter arquivos dentro de jobs de ingestão, ferramentas internas e fluxos de documentos. Envie uma solicitação, receba Markdown e leve-o para um CMS, uma base de conhecimento, um bot de suporte ou um pipeline de agentes com uma saída confiável.

Bases de conhecimento e suporte

Traga manuais de produto, notas de versão e wikis internas para um único corpus Markdown que um bot de suporte ou um assistente interno possa pesquisar. Como títulos e tabelas sobrevivem, as respostas apontam para a seção certa em vez de um bloco do tamanho de uma página.

Agentes e ferramentas

Dê a um agente um conversor de Markdown para arquivos compatíveis e URLs públicas, e verifique a conclusão antes que ele consuma o resultado. Leia este site do mesmo modo: cada página pública responde a Accept: text/markdown com um gêmeo em Markdown, e o llms.txt lista todas.

Qualidade da saída

Estrutura, não só texto

Um conversor de Markdown útil preserva mais do que caracteres isolados de um PDF. O objetivo aqui é um Markdown que mantenha a estrutura da qual suas ferramentas posteriores dependem, produzido por um pipeline de análise no servidor em vez de um copiar e colar frágil do navegador.

  • Preserva títulos, listas, tabelas, links e ordem de leitura onde a origem os tem.
  • Lida com PDF, Word, PowerPoint, Excel, imagens, HTML e URLs por um único pipeline.
  • Processa PDFs digitalizados e imagens com OCR hoje; a qualidade do reconhecimento depende da imagem de origem.
  • Executa documentos longos de forma assíncrona, para que relatórios e apresentações grandes terminem em vez de estourar o tempo.

As páginas padrão e as páginas OCR custam 1 crédito por página; contas em planos pagos podem usar a compreensão de imagens com IA a 5 créditos por imagem. A saída segue o CommonMark com tabelas no estilo GitHub, então renderiza em qualquer visualizador de Markdown e é interpretada por qualquer biblioteca de Markdown. Cada conversão deve produzir um artefato que você possa inspecionar, salvar e reutilizar — essa é a régua.

Conversor de arquivo Markdown: três cartões de arquivo Markdown empilhados com marcas de verificação

Três formas de entrar

Navegador, API ou agente

O conversor de Markdown no aplicativo web cobre a conversão manual pontual e recorrente. O Batch cobre pilhas de arquivos. A API cobre tudo o que deve acontecer automaticamente, incluindo agentes que a chamam como ferramenta. Os três compartilham uma conta, um saldo de créditos e um motor de análise. A maioria das equipes começa no navegador e passa para a API quando a conversão vira parte de um produto ou de um fluxo de trabalho interno.

AspectNavegadorBatchAPI
Ideal paraUm arquivo por vezMuitos arquivos em uma execuçãoPipelines, ferramentas e agentes
LoginNão é preciso para o primeiro arquivoPlanos pagosPlanos pagos, chave de API
EntradaUpload ou URLUma lista de uploads ou IDs de arquivoUpload, URL, texto embutido ou ID de arquivo
SaídaPré-visualização, cópia, download .mdBiblioteca com status por arquivoJSON com Markdown, saída por página, webhooks
Limites10 MB e 25 páginas sem loginConcorrência do plano20 a 60 solicitações por minuto conforme o plano
EsperaSegundos, na páginaEm segundo planoSincronização de até 60 s, depois uma conversão para consultar

Aplicativo web

  • Envie arquivos ou cole URLs e pré-visualize o Markdown renderizado
  • Salve o histórico de conversões e baixe os resultados .md
  • Converta em lote o trabalho repetido com status por arquivo
  • Acompanhe créditos e uso por plano

API para desenvolvedores

  • POST /v1/convert/{name} devolve Markdown em uma única chamada, ou uma conversão quando um arquivo precisa de mais de 60 segundos
  • Consulte conversões ou receba webhooks quando elas terminam
  • Envie Accept: text/markdown para ler qualquer página pública como Markdown
  • Especificação legível por máquina em /v1/openapi.json

FAQ

Perguntas que as equipes fazem

O que um conversor de Markdown faz?

Um conversor de documento para Markdown é uma ferramenta que lê um PDF, Word, PowerPoint, Excel, imagem ou página web e reescreve seu conteúdo como Markdown: títulos viram linhas #, tabelas viram tabelas de barras e listas continuam listas. O objetivo é obter texto simples previsível que modelos de linguagem, pipelines RAG e agentes possam dividir em blocos, incorporar e citar sem ruído de layout.

O conversor gratuito é mesmo gratuito?

Sim. As páginas do conversor público não exigem conta nem cartão. Arquivos de até 10 MB e 25 páginas convertem no navegador, e você pode pré-visualizar e copiar o Markdown. As assinaturas Lite, Pro e Max começam em $20 por mês e adicionam biblioteca salva, lote e a API.

Como funcionam PDFs digitalizados e imagens?

Páginas só de imagem não têm camada de texto, então o pipeline roda OCR automaticamente e devolve Markdown da mesma forma que para texto digital. As páginas padrão e as páginas OCR custam 1 crédito por página. A qualidade do reconhecimento depende da imagem de origem: uma digitalização a 300 dpi é lida muito melhor do que a foto de uma página tirada com o celular.

Posso rodar isso a partir de código ou de um agente?

Sim. POST /v1/convert/{name} aceita um upload, uma URL ou texto embutido com uma chave de API e devolve Markdown em uma única chamada quando o arquivo termina em até 60 segundos, ou uma conversão que você pode consultar ou receber por webhook. Agentes podem pedir Accept: text/markdown em qualquer página pública, e a especificação legível por máquina fica em /v1/openapi.json.

O que acontece com meus arquivos depois da conversão?

Ao excluir uma conversão, ela some da sua biblioteca imediatamente e seus arquivos armazenados são apagados em até uma hora; um arquivo de origem compartilhado com outra conversão é mantido até que essa também seja excluída. Ao excluir sua conta, todos os arquivos de origem e de resultado armazenados são apagados. Os planos pagos mantêm o histórico por 30, 60 ou 90 dias, dependendo do plano.

Converta seu primeiro arquivo para Markdown.

Teste de graça: não precisa se cadastrar.