转换
转换为 Markdown
转换为 Markdown 是 markitdown.ai 的单文件转换器,把 PDF、Office 文件、图片、HTML 与 URL 变成结构化 Markdown。
匿名试用接受最大 10 MB、最多 25 页的文件,每小时每个 IP 3 次转换、每天 10 次。Lite 每月 $20 起、单文件最大 100 MB;Pro 每月 $50;Max 每月 $100。
- 为 LLM、RAG 与 agent 输出保留结构
- 复制或下载前先预览渲染后的 Markdown
- 服务端转换流水线,而不是脆弱的浏览器复制粘贴
# Vendor Security Review — Q3 2026 This review covers the third-party vendors with access to customer data as of September 2026. It summarizes findings from the annual security questionnaire, flags overdue remediation items, and sets the review cadence for Q4. ## Scope This review includes vendors that meet any of the following criteria: - Store or process customer documents, even temporarily - Have production database or object storage access - Provide OCR, translation, or other AI inference services - Handle payment or billing data on our behalf
转换后仍然保留的结构
目标不只是把文字抽取一次,而是产出下游工具——ChatGPT、Claude、RAG 切分与自动化——可以依赖的 Markdown。
标题与层级
章节结构保持完整,文档读起来像一份大纲,而不是一整块无差别的文本。
表格与列表
行、列与项目符号结构都以 Markdown 保留下来,而不是拍平成一串松散的文字。
阅读顺序
多栏页面、页眉与脚注会重排成一个人真正会按之阅读的顺序。
预览与源码模式
先看渲染后的 Markdown,需要在流水线里用干净输入时再切换到源码。
支持的格式
转换为 Markdown 接受下列文件类型,并始终返回 Markdown。每种格式都有自己的页面,例如 PDF 转 Markdown。匿名公开试用接受最大 10 MB 的文件;套餐限额见定价页。
从 Markdown 出发,你还可以继续转成 HTML、纯文本 或 可打印 PDF。
.pdf — 报告、论文、手册与合同;扫描页走 OCR。
Word
.doc .docx .odt .rtf — 标题、列表、表格与审阅批注都会保留。
PowerPoint
.ppt .pptx .odp — 逐页保留幻灯片标题、要点与演讲者备注。
Excel
.xls .xlsx .ods .csv — 每张工作表变成一个以其名称标注的 Markdown 表格。
图片
.png .jpg .jpeg .webp .gif .bmp .tif .tiff — 截图、照片与扫描件,用 OCR 读取。
HTML
.html .htm — 保存下来的网页,标题、链接与表格都会保留。
文本
.txt .md — 纯文本与现有 Markdown,统一规范化。
网页
公开 URL — 粘贴一个公开 URL,页面会被抓取并转换。
转换为 Markdown 如何工作
一份文件,三步。较长的文档会异步处理,所以大 PDF 不会卡住页面。
上传文件或粘贴 URL
把文档拖进浏览器,或让转换器指向一个公开网页。
流水线重建结构
转换在服务端运行,所以再大、再复杂的文档,每次的处理方式都一致。
预览、复制、下载或保存
先读结果,再复制它、下载 Markdown,或保存到你的资料库。

指南
可追溯的输出
在你复用的 Markdown 旁边,留好源文件名与版本引用。来源变化时,转换新版本并比对相关段落,而不是悄悄替换一份已经复核过的输出。当多人使用同一段文本,或检索到的答案需要标注出处时,这一点尤其重要。可追溯的转换让读者能核对某个拿不准的表格或句子,而不必猜测它来自哪份源文件。
选择来源
从你手上信息量最大的来源做转换为 Markdown。如果原文档是可编辑的 Word 文件,就用它,而不是先打印成 PDF。如果有电子表格,就转换工作簿,而不是给它的表格截图。如果唯一的来源是扫描件,就用 PDF 或图片路径,并准备好复核 OCR 输出。公开网页可以通过 URL 提交,保存下来的 HTML 则归 HTML 转换器。选对来源可以在转换开始前就避免丢失有用的结构,也让后续比对更容易,因为 Markdown 可以直接对照真正含有信息的文档来检查。
复核输出
先把转换后的 Markdown 当一份文档来读,再比对来源格式最复杂的那些部分。报告要顺着分栏检查阅读顺序,并核对表头;演示文稿要确认备注归属于它解释的那一页;工作簿要检查工作表名称与数值的位置。看起来整齐的结果不一定完整。复核渲染预览和原始 Markdown 时,把原文一并打开,并确认文档结尾也在。把结果复制到别的工具后,也要在那里再看一遍:目标工具渲染表格、链接或代码的方式,可能和本页预览不同。
为 AI 工具准备的 Markdown
当你想要一份 ChatGPT、Claude 或你自己的检索流水线可以消费、你也能亲自检查的文本表示时,就用转换为 Markdown。清晰的标题有助于保留上下文,受支持的表格能保住那些从一串松散数字里很难恢复的关系。输出仍然需要对照来源复核后才能依赖。转换不会验证某个说法、不会替你判断哪些段落相关,也不能阻止下游模型犯错。保留对来源的引用,并为你所问的问题提供必要的上下文。做自动检索时,先验证转换本身,再单独评估切分与搜索。
匿名试用限额
匿名浏览器试用接受最大 10 MB、最多 25 页的文件,每小时每个客户端 IP 3 次转换、每天 10 次。它的用途是在订阅前先检查一个结果。新建账号不会带来每月转换 credit 的额度。Lite、Pro 和 Max 才是用于账号内转换、保存历史、批量和 API 的订阅套餐。各套餐限额不同,提交更大一批之前先查看定价页。网页还必须是公开可访问的:URL 转换不会登录网站,也不会执行网站的客户端 JavaScript,正文里可能仍会保留导航或广告文字。
转换之后
把 Markdown 当作可编辑的来源,用于笔记、仓库文档或摄取流程。如果下一站需要另一种表示,浏览器工具可以把 Markdown 渲染成 HTML、去掉格式变成纯文本,或打开打印流程另存为 PDF。这些步骤改变的是输出的表示形式,并不会重建原文档的版式。对反复出现的输入文档,在检查过有代表性的样本之后,改用批量转换或开发者 API。把源文件名和一个有意义的引用与导出内容放在一起,方便之后复核它的人识别来源。当转换后的文本保持可追溯、易于核对时,转换才最有用。
FAQ
常见问题
转换为 Markdown 的输出为什么适合 AI?
转换会尽可能保留标题、列表、表格与阅读顺序,所以 Markdown 足够稳定,可以直接切分、嵌入和检索,无需人工清理。
可以转换哪些文件类型?
PDF、Word、PowerPoint、Excel、图片、HTML、纯文本,以及通过 URL 提交的公开网页——完整的扩展名列表见「支持的格式」。匿名公开转换器接受最大 10 MB 的文件。
支持扫描件吗?
图片类文件和扫描件目前用 OCR 处理。识别质量取决于源图片。
「转换为 Markdown」与批量转换、API 有什么区别?
「转换为 Markdown」是浏览器里的单文档体验。批量转换一次处理很多文件,API 则从你自己的代码运行同样的转换。三者共用同一个转换引擎。
这是文档编辑器或 PDF 版式工具吗?
都不是。markitdown.ai 把文档转换成供 AI 与文本流程使用的干净 Markdown;它不是可视化的 PDF 或版式编辑器。
