👤 804 total uses◯ Free: 5 uses/day • Resets in 7h 59m

批量 OCR

上传一个包含 PDF 或图像的 ZIP 文件(总大小不超过 25 MB),即可获得一个合并后的 markdown 文件——每个源文件成为一个标题。非常适合将纸质档案数字化、扫描一整个文件夹的发票,或一次性处理一批扫描页面。由 Mistral OCR 提供支持。

了解更多

批量 OCR 可一次性从多份文档中提取文本。上传一个包含 PDF 或图像的 ZIP 压缩包(总计不超过 25 MB),即可获得一个合并的 markdown 文件,其中每个源文件各自成为一个标题。该功能由 Mistral OCR 驱动,专为一次性数字化成堆的纸质文档、扫描档案和多文件合集而打造。

将 PDF/图像的 ZIP 拖到此处
或点击浏览 — ZIP,最大 25 MB。我们将最多 10 个文件提取为一个 Markdown。

✓ 免费使用——无需注册,无需信用卡。

小型企业

扫描发票批量处理

将扫描的发票批量转换为可搜索的文本记录。

查看输入和输出预览

输入

Content
A folder of 30 scanned supplier invoice PDFs that need their text extracted in bulk into searchable, copyable documents.

输出(节选)

Across all 30 files the tool returns extracted text per page, e.g. "Invoice #INV-2041 — Acme Supplies — Date: 2026-05-22 — Net 30 — Total Due: $1,284.00 — Item: Office chairs x4." Each scanned PDF becomes searchable, copyable text, letting you index, search, and pull totals from the whole batch at once.
学生

档案文件扫描

为研究项目批量数字化档案页面。

查看输入和输出预览

输入

Content
A set of 50 photographed pages from old library archive books that need to be converted to editable text for a research project.

输出(节选)

The tool processes all 50 photographed pages and outputs clean text per page, preserving paragraph breaks, e.g. "The expedition departed in the spring of 1887, recording detailed observations of the coastal flora..." The batch is delivered as editable text files ready to search, quote, and cite in the research project.
自由职业者

小票堆 OCR

在一次批处理中处理整个季度的小票。

查看输入和输出预览

输入

Content
A batch of 20 photos of business receipts that need their text pulled out together for a quarterly expense log.

输出(节选)

All 20 receipt images are processed at once, returning per-file text such as "Staples — 2026-04-09 — Printer Paper $12.99, Ink Cartridge $34.50 — Total $47.49." The extracted text lands in a consolidated list, making it easy to copy totals and merchants into a quarterly expense log in one pass.

你的 批量 OCR 结果将显示在这里

你将获得整洁的 Markdown,保留表格、公式和标题 —— 可直接粘贴或编辑。

如何使用 批量 OCR

  1. 将您的 PDF 和图片打包进单个 ZIP 压缩文件(总计最多 25 MB)。
  2. 将 ZIP 文件上传到 Batch OCR。
  3. 运行提取,并在每个文件处理时稍候。
  4. 下载合并后的 markdown 文件,每个源文档对应一个标题。

使用案例

1

一次性数字化一整个文件夹的扫描纸质文档

2

将一批发票或表单转换为可搜索的文本

3

从多页扫描的档案合集中提取文字

4

将一组纯图片 PDF 转化为可编辑的 markdown。

5

从一堆历史遗留文件构建一个可搜索的知识库

最佳结果的技巧

  • 以 300 DPI 或更高分辨率扫描文档,以获得最干净的文字识别效果。
  • 为 ZIP 内的文件清晰命名,因为这些名称将决定输出中的标题。
  • 通过压缩图片或拆分为多个批次,将 ZIP 总大小控制在 25 MB 以内。
  • 检查 markdown 中的表格和复杂版式,因为繁复的格式可能需要少量整理。

常见问题

Batch OCR 有什么作用?

它可一次性读取多个文档中的文字,并将结果合并为一个 Markdown 文件,每个源文件都配有一个标题,便于你区分各部分内容。

我要上传什么、限制是什么?

上传一个包含 PDF 和图像文件的 ZIP 压缩包,总大小不超过 25 MB。请压缩或拆分较大的文件集以保持在限制以内。

输出是什么格式?

你会得到一个合并后的 markdown(.md)文件。每个原始文件以各自的标题呈现,其下方按阅读顺序排列提取出的文本。

文本提取有多准确?

Mistral OCR 对清晰的印刷文字识别准确,并能很好地保留标题、列表等结构。低分辨率扫描件或大量手写内容可能降低准确度。

它会保留表格和格式吗?

它会尽可能以 Markdown 形式保留标题、列表和表格等结构,不过非常复杂的版式可能需要事后稍作整理。

我可以将提取的文本用于商业用途吗?

可以,你能在自己的归档、文档和产品中使用输出结果。免费版无需注册,每天可批量运行 5 次;Pro 版为每月 $19,适合更大处理量。

我上传的文件会被如何处理?

你的 ZIP 及其内容仅用于提取文本,随后即被丢弃。它们不会被存储,也不会用于训练模型。

🔒
您的隐私受到保护

我们不存储您的文本。处理在实时进行,您的输入在生成结果后立即被丢弃。

解锁无限访问

免费用户:每天 5 次使用 | Pro 用户:无限制

相关工具

试用此智能体

Student ResearchGo from topic to thesis to full paper outline in one run — including a formatted…试用此智能体 →

相关工作流

Podcast → Tweet ThreadUpload a podcast audio file → transcribe → ship a 7-tweet thread + hashtag pack.运行工作流 →