Bulk OCR: Image & Scanned PDF to Text from CSV or Google Sheet

io.github.Nero-Enginev0.1.0更新于 Oct 1, 2026

OCR every image and scanned PDF linked in an Apify dataset, CSV, Excel or Google Sheet, keeping...

已验证Streamable HTTP可网页运行Files & StorageData & Analytics

概览

AI 生成的概览

对 CSV、Excel、Google 表格或 Apify 数据集中列出的图片和扫描版 PDF 批量执行 OCR,返回提取的文本。

功能
这是一个远程 MCP 服务器,对 CSV、Excel 文件、Google 表格或 Apify 数据集中提供的链接所指向的图片和扫描版 PDF 执行批量光学字符识别。它一次处理整个列表,并将提取的文本与每个来源条目对应保存。该服务由 Apify 托管,通过 streamable HTTP 访问。
适用场景
当你有一批图片或扫描版 PDF 链接,希望一次性批量提取文本而不是逐个文件处理时使用。它适合对已在表格或数据集中编目的扫描文档、票据或图片档案进行数字化。
运行要求
通过 streamable HTTP 访问 mcp.apify.com 的远程 MCP 端点。需要 Apify API 令牌,以 Bearer 令牌形式放在 Authorization 请求头中。运行按事件计费,计入 Apify 账户。
安装前请注意
Authorization 请求头携带 Apify API 令牌,这是可计费的凭据,需妥善保密。运行按事件计费并计入你的 Apify 账户,批量较大时会产生费用。来源链接及其内容会发送到 Apify 进行处理。

安装

在 SourceWeft 中

  1. 打开 控制台中的 Bulk OCR: Image & Scanned PDF to Text from CSV or Google Sheet,将其添加到工作区。
  2. 为需要使用其工具的对话启用该服务。

Web executable,通过 Streamable HTTP。 远程服务在工作区中配置后即可从网页运行时运行。

其他 MCP 客户端

把它添加到你客户端的 mcpServers 配置中。

{
  "mcpServers": {
    "bulk-ocr-image-pdf-to-text": {
      "type": "http",
      "url": "https://mcp.apify.com/?tools=nerolabs/bulk-ocr-image-pdf-to-text"
    }
  }
}

工具

0
工具元数据尚未被收录。

版本历史

1
  1. v0.1.0最新Oct 1, 2026