转换器

图片转 Markdown 转换器

图片转 Markdown 是一款目前用 OCR 读取 PNG、JPG、WEBP 和 TIFF 的转换器。公开试用接受最大 10 MB 的文件。

还没有转换任何文档
上传文件,这里会显示干净的 Markdown 输出。
AI 图片描述 高精度 OCR 登录后使用增强功能

先试用文件,再选择套餐。

  • 无需账号:单文件最大 10 MB、25 页,每小时 3 次、每天 10 次转换,可在浏览器中预览并复制。
  • 登录后:每天 20 次免费转换,结果保存到你的资料库。
  • Lite、Pro 与 Max 包含转换积分、批量处理、API 访问与历史记录。Lite 包含 30 天历史。

如何操作

如何把图片转 Markdown

可以上传什么

  • 文件类型:.png .jpg .jpeg .webp .tif .tiff
  • 无需账号即可试用:单文件最大 10 MB、25 页,每小时 3 次、每天 10 次转换
  • Lite 支持最大 100 MB 的文件,Pro 支持 200 MB
  • Max 没有单文件大小上限;转换量由 credit 限制
图片转 Markdown 转换器:用 OCR 把 PNG 图片转成 Markdown

为什么使用

为什么使用 图片转 Markdown

对书面内容做 OCR

从截图、照片或扫描件中提取可见文本,再在使用结果前检查不确定的字符。

结构化的文本结果

受支持的标题、段落和表格变成 Markdown,比一坨无结构的文本更易复核。

无需文档外壳

从你手上的图片开始,而不是仅仅为了把截图粘进去而先做一份 Word 文档。

核对识别出的数字

把单位、标点和数字单元格与源图片对照,尤其当结果会影响决策时。

保留视觉来源

当图表、箭头或版式关系无法仅靠识别出的标签解释时,把图片与 Markdown 一起使用。

图片 API 路径

在核对过来自同质量来源的代表性 OCR 输出后,通过 API 发送受支持的图片文件。

问题所在

为什么截图没有文本层

没有文本层

图片不携带可选文本;内容必须先被识别才能使用。

截图堆积

文档截图到处都是,但在变成文本之前很难搜索。

版式很重要

图片里的标题和表格应当保留,而不是拍平成一行。

OCR 转 Markdown:复制粘贴后的错乱文本与干净的 Markdown 结构对比

保留什么

这款图片转换器读什么

通过 OCR 提取文本
目前通过 OCR 从图片里提取文本;准确度随图像质量、字体清晰度和对比度而变化。Source: product pipeline
最适合截图和扫描页
干净、印刷清晰的截图和扫描文档效果最好;手写或低分辨率的图片保真度可能较低。Source: ISO/IEC 15948 PNG
版式密集的图片
多栏杂志跨页或密集表单这类复杂版式可能无法精确保留空间结构,但文本内容仍会被提取。Source: product pipeline
支持的格式
PNG、JPG/JPEG、WEBP 和 TIFF 都被接受,在公开转换器上最大 10 MB。Source: ISO/IEC 15948 PNG

示例:对 markitdown.ai 定价表做 OCR· https://markitdown.ai/pricing

# Credits per page, by content. Text-layer documents and OCR pages cost the same per page. AI extras for figures and images are opt-in and metered separately. |  Item | Best for | Rate | 150 credits buy  || --- | --- | --- | --- ||  Documents | Text-layer PDF, Office files and HTML | 1 credit / page | 150 pages  ||  Scans & images | OCR for scanned pages, photos and screenshots | 1 credit / page | 150 pages  ||  AI figure enhancement | Charts and figures described in PDFs · paid plans | 3 credits / figure | 50 figures  ||  AI image understanding | Image content described, not just OCR · paid | 5 credits / image | 30 images  | GOOD TO KNOW **Monthly reset** Monthly credits reset at the start of each billing period; unused credits don't roll over. **Annual up front** Annual plans are 20% off and grant the full year's credits at once — 1,800 on Lite. **One balance** The web app, Batch and the API all draw from the same credit balance. **When credits run out** Conversions pause until your next reset or an upgrade; upgrades top up the difference immediately. 

使用场景

图片转 Markdown 的真实工作流

截图笔记

从截图里恢复书面内容,并对照原件核对名称、链接和标点。

扫描记录

从清晰的扫描件创建可编辑文本,对任何不确定或重要的段落保留图片。

研究记录

把拍摄的表格变成草稿文本表格,并在分析前核对它的行。

OCR 评估

在把重复识别构建进应用之前,比较清晰和困难来源图片的结果。

截图转 Markdown:把一个 Markdown 文件接入 RAG 索引、提示词和笔记

API

图片转 Markdown API

用 POST /v1/convert/image,带上 x-api-key 请求头和受支持的源文件。已完成的请求可以内联返回输出;HTTP 202 表示转换仍在进行。读取 Location 响应头并在访问文件输出前轮询它。一次 multipart 请求最多接受 100 个文件;订阅额度和总请求限额同样适用。把 API 密钥放在你的服务器环境里。API 访问需要 Lite、Pro 或 Max 订阅。

阅读 API 指南
curl -i "https://api.markitdown.ai/v1/convert/image" \  -H "x-api-key: $MARKITDOWN_API_KEY" \  -F "file=@source.png"# If HTTP 202, GET the Location URL with the same API key.

OCR 能读出什么

图片转 Markdown 用 OCR 识别图片中的书面内容,并把受支持的结构表示为 Markdown。一份清晰的文档截图可以产出有用的标题、段落和表格,而一张模糊的照片可能留下歧义的字符。OCR 读取可见文本;它并不保证会解释图表的趋势、示意图的箭头或一张照片的含义。要把识别出的标签与对视觉内容本身的描述区分开。如果重要信息只以图形呈现,请把图片与结果一并保留并直接查看。不要把一份简短的文本导出当作源图片全部含义都已被捕获的证明。

准备好图片

用你手上最清晰的原始图片开始图片转 Markdown。反复保存一张压缩过的截图,可能在 OCR 开始前就模糊了标点和小字。如果裁剪无关的周边不会去掉图注、单位或表头,就裁掉它。校正明显的旋转,并确认来源在正常缩放下可读。对照片来说,眩光与透视畸变可能和分辨率同样重要。如果连你自己都无法分辨某个字符,就仔细复核对应的输出,而不是指望转换能重建缺失的证据。改善来源通常比反复提交同一张损坏的图片、再挑一个看起来最合理的结果更有用。

检查输出结果

逐行把图片转 Markdown 的表格与来源对照,尤其是当图片包含密集数字时。丢失的小数点或错位的数值会改变含义,而表格看起来仍然渲染得很干净。把列标签、单位、合计和脚注当作彼此独立的证据来核对。如果表格使用了 Markdown 无法直接表达的合并单元格或视觉分组,就在你使用该结果的文档里说明这一分组。把截图留着,供需要查看原图的人使用。OCR 省去了重新输入,但对识别出的数字的任何重要使用,仍然需要一步核验。

图片与原始文件的取舍

当图片是你手头可得的来源时——一份截图、一张拍摄的页面或一份导出的扫描件——用图片转 Markdown。如果你同时有原始的 Word 文档、电子表格或 HTML 页面,请优先选择它专用的转换器。那种来源可能含有被图片降格为像素的结构和字符。对多页扫描报告,PDF 转换器通常是让各页待在一起更自然的地方。对单张截图,图片 OCR 则省去了仅为提取文本而创建一份中间文档。无论哪种情况,都在笔记里保留来源文件名或引用,好让 Markdown 能追溯到你所复核的材料。

OCR 与图像理解

公开的图片转换器目前用 OCR 处理:它从像素里读出印刷或数字字形并输出 Markdown。这与 AI 图像理解不同——付费套餐账号可按每张图片 5 credits 使用它,并会产出一份额外的 AI 增强 Markdown 输出。本页不把图像理解当作免费截图的默认路径。

  • 目前 OCR 是这款转换器处理图片上传的已上线路径。
  • 付费套餐的 AI 图像理解按每张图片 5 credits 单独计费。
  • 手写或低对比度的照片不适合 OCR;干净的截图和扫描件效果更好。

扫描页

扫描页是主要用例,因为它们没有可选择的文本层。版式密集的杂志跨页可能无法精确保留空间结构,但识别出的文本仍会被提取。

FAQ

图片转 Markdown 常见问题

图片转 Markdown 是怎么工作的?

图片转 Markdown 把受支持的来源转换成可读的 Markdown,便于复核和复用。匿名试用接受每个文件最大 10 MB、25 页,每个 IP 每小时 3 次转换、每天 10 次。使用前请把结果与来源对照。

图片最大能有多大?

公开转换器接受最大 10 MB 的图片文件。

截图上的 OCR 有多准?

图片目前用 OCR 处理。干净、高对比度的图片比低分辨率或手写内容效果更好。

本页默认使用 AI 图像理解吗?

不。这款转换器目前用 OCR。付费套餐的 AI 图像理解按每张图片 5 credits 单独计费,不是公开默认路径。

能处理图片里的表格吗?

图片里的表格结构会在可能时被识别;保真度取决于图像清晰度和表格网格的明确程度。

对扫描文档有效吗?

有效。扫描页是主要用例。清晰、高分辨率的扫描件产出更好的 Markdown。

手写内容呢?

当前 OCR 流程无法可靠提取手写文本。该工具最适合印刷或数字文本。

可以从 API 转换图片吗?

可以。用上传 PDF 的同样方式上传图片,然后转换并轮询。见 /developers。

大规模将 图片 转换为 Markdown。

免费试用——无需注册。