---
title: "图片转 Markdown 转换器"
description: "图片转 Markdown 是一款目前用 OCR 读取 PNG、JPG、WEBP 和 TIFF 的转换器。公开试用接受最大 10 MB 的文件。"
url: https://markitdown.ai/image-to-markdown
updated: 2026-09-26
source: markitdown.ai
---

# 图片转 Markdown 转换器

> 图片转 Markdown 是一款目前用 OCR 读取 PNG、JPG、WEBP 和 TIFF 的转换器。公开试用接受最大 10 MB 的文件。

## 如何把图片转 Markdown

- 在图片转 Markdown 转换器里上传一份受支持的源文件。选一个你能与结果对照的文件，并在开始前查看匿名试用限额。
- 把图片转 Markdown 的输出与来源对照。在把任何内容复制进别的工具前，检查标题、表格单元格和最后一段。
- 复制复核过的图片转 Markdown 输出，用于你的下一项任务。若需要账号内的持续转换、保存历史、批量或 API 访问，请选择 Lite、Pro 或 Max 订阅。

## 为什么使用 图片转 Markdown

- 对书面内容做 OCR — 从截图、照片或扫描件中提取可见文本，再在使用结果前检查不确定的字符。
- 结构化的文本结果 — 受支持的标题、段落和表格变成 Markdown，比一坨无结构的文本更易复核。
- 无需文档外壳 — 从你手上的图片开始，而不是仅仅为了把截图粘进去而先做一份 Word 文档。
- 核对识别出的数字 — 把单位、标点和数字单元格与源图片对照，尤其当结果会影响决策时。
- 保留视觉来源 — 当图表、箭头或版式关系无法仅靠识别出的标签解释时，把图片与 Markdown 一起使用。
- 图片 API 路径 — 在核对过来自同质量来源的代表性 OCR 输出后，通过 API 发送受支持的图片文件。

## 为什么截图没有文本层

- 没有文本层 — 图片不携带可选文本；内容必须先被识别才能使用。
- 截图堆积 — 文档截图到处都是，但在变成文本之前很难搜索。
- 版式很重要 — 图片里的标题和表格应当保留，而不是拍平成一行。

## 这款图片转换器读什么

- 通过 OCR 提取文本 — 目前通过 OCR 从图片里提取文本；准确度随图像质量、字体清晰度和对比度而变化。
- 最适合截图和扫描页 — 干净、印刷清晰的截图和扫描文档效果最好；手写或低分辨率的图片保真度可能较低。
- 版式密集的图片 — 多栏杂志跨页或密集表单这类复杂版式可能无法精确保留空间结构，但文本内容仍会被提取。
- 支持的格式 — PNG、JPG/JPEG、WEBP 和 TIFF 都被接受，在公开转换器上最大 10 MB。

## 图片转 Markdown 的真实工作流

- 截图笔记 — 从截图里恢复书面内容，并对照原件核对名称、链接和标点。
- 扫描记录 — 从清晰的扫描件创建可编辑文本，对任何不确定或重要的段落保留图片。
- 研究记录 — 把拍摄的表格变成草稿文本表格，并在分析前核对它的行。
- OCR 评估 — 在把重复识别构建进应用之前，比较清晰和困难来源图片的结果。

## 图片转 Markdown API

用 POST /v1/convert/image，带上 x-api-key 请求头和受支持的源文件。已完成的请求可以内联返回输出；HTTP 202 表示转换仍在进行。读取 Location 响应头并在访问文件输出前轮询它。一次 multipart 请求最多接受 100 个文件；订阅额度和总请求限额同样适用。把 API 密钥放在你的服务器环境里。API 访问需要 Lite、Pro 或 Max 订阅。

```bash
curl -i "https://api.markitdown.ai/v1/convert/image" \
  -H "x-api-key: $MARKITDOWN_API_KEY" \
  -F "file=@source.png"
# If HTTP 202, GET the Location URL with the same API key.
```

## OCR 能读出什么

图片转 Markdown 用 OCR 识别图片中的书面内容，并把受支持的结构表示为 Markdown。一份清晰的文档截图可以产出有用的标题、段落和表格，而一张模糊的照片可能留下歧义的字符。OCR 读取可见文本；它并不保证会解释图表的趋势、示意图的箭头或一张照片的含义。要把识别出的标签与对视觉内容本身的描述区分开。如果重要信息只以图形呈现，请把图片与结果一并保留并直接查看。不要把一份简短的文本导出当作源图片全部含义都已被捕获的证明。

## 准备好图片

用你手上最清晰的原始图片开始图片转 Markdown。反复保存一张压缩过的截图，可能在 OCR 开始前就模糊了标点和小字。如果裁剪无关的周边不会去掉图注、单位或表头，就裁掉它。校正明显的旋转，并确认来源在正常缩放下可读。对照片来说，眩光与透视畸变可能和分辨率同样重要。如果连你自己都无法分辨某个字符，就仔细复核对应的输出，而不是指望转换能重建缺失的证据。改善来源通常比反复提交同一张损坏的图片、再挑一个看起来最合理的结果更有用。

## 检查输出结果

逐行把图片转 Markdown 的表格与来源对照，尤其是当图片包含密集数字时。丢失的小数点或错位的数值会改变含义，而表格看起来仍然渲染得很干净。把列标签、单位、合计和脚注当作彼此独立的证据来核对。如果表格使用了 Markdown 无法直接表达的合并单元格或视觉分组，就在你使用该结果的文档里说明这一分组。把截图留着，供需要查看原图的人使用。OCR 省去了重新输入，但对识别出的数字的任何重要使用，仍然需要一步核验。

## 图片与原始文件的取舍

当图片是你手头可得的来源时——一份截图、一张拍摄的页面或一份导出的扫描件——用图片转 Markdown。如果你同时有原始的 Word 文档、电子表格或 HTML 页面，请优先选择它专用的转换器。那种来源可能含有被图片降格为像素的结构和字符。对多页扫描报告，PDF 转换器通常是让各页待在一起更自然的地方。对单张截图，图片 OCR 则省去了仅为提取文本而创建一份中间文档。无论哪种情况，都在笔记里保留来源文件名或引用，好让 Markdown 能追溯到你所复核的材料。

## OCR 与图像理解

公开的图片转换器目前用 OCR 处理：它从像素里读出印刷或数字字形并输出 Markdown。这与 AI 图像理解不同——付费套餐账号可按每张图片 5 credits 使用它，并会产出一份额外的 AI 增强 Markdown 输出。本页不把图像理解当作免费截图的默认路径。

- 目前 OCR 是这款转换器处理图片上传的已上线路径。
- 付费套餐的 AI 图像理解按每张图片 5 credits 单独计费。
- 手写或低对比度的照片不适合 OCR；干净的截图和扫描件效果更好。

## 扫描页

扫描页是主要用例，因为它们没有可选择的文本层。版式密集的杂志跨页可能无法精确保留空间结构，但识别出的文本仍会被提取。

## 示例：对 markitdown.ai 定价表做 OCR

Source: https://markitdown.ai/pricing

```markdown
# Credits per page, by content.

Text-layer documents and OCR pages cost the same per page. AI extras for figures and images are opt-in and metered separately.

|  Item | Best for | Rate | 150 credits buy  |
| --- | --- | --- | --- |
|  Documents | Text-layer PDF, Office files and HTML | 1 credit / page | 150 pages  |
|  Scans & images | OCR for scanned pages, photos and screenshots | 1 credit / page | 150 pages  |
|  AI figure enhancement | Charts and figures described in PDFs · paid plans | 3 credits / figure | 50 figures  |
|  AI image understanding | Image content described, not just OCR · paid | 5 credits / image | 30 images  |

GOOD TO KNOW

**Monthly reset**

Monthly credits reset at the start of each billing period; unused credits don't roll over.

**Annual up front**

Annual plans are 20% off and grant the full year's credits at once — 1,800 on Lite.

**One balance**

The web app, Batch and the API all draw from the same credit balance.

**When credits run out**

Conversions pause until your next reset or an upgrade; upgrades top up the difference immediately.

```

## FAQ

### 图片转 Markdown 是怎么工作的？

图片转 Markdown 把受支持的来源转换成可读的 Markdown，便于复核和复用。匿名试用接受每个文件最大 10 MB、25 页，每个 IP 每小时 3 次转换、每天 10 次。使用前请把结果与来源对照。

### 图片最大能有多大？

公开转换器接受最大 10 MB 的图片文件。

### 截图上的 OCR 有多准？

图片目前用 OCR 处理。干净、高对比度的图片比低分辨率或手写内容效果更好。

### 本页默认使用 AI 图像理解吗？

不。这款转换器目前用 OCR。付费套餐的 AI 图像理解按每张图片 5 credits 单独计费，不是公开默认路径。

### 能处理图片里的表格吗？

图片里的表格结构会在可能时被识别；保真度取决于图像清晰度和表格网格的明确程度。

### 对扫描文档有效吗？

有效。扫描页是主要用例。清晰、高分辨率的扫描件产出更好的 Markdown。

### 手写内容呢？

当前 OCR 流程无法可靠提取手写文本。该工具最适合印刷或数字文本。

### 可以从 API 转换图片吗？

可以。用上传 PDF 的同样方式上传图片，然后转换并轮询。见 /developers。

## Related

- [Markdown converter for documents and web pages.](https://markitdown.ai/)
