
Bulk OCR: Image & Scanned PDF to Text from CSV or Google Sheet
io.github.Nero-Enginev0.1.0更新于 Oct 1, 2026
OCR every image and scanned PDF linked in an Apify dataset, CSV, Excel or Google Sheet, keeping...
概览
AI 生成的概览
对 CSV、Excel、Google 表格或 Apify 数据集中列出的图片和扫描版 PDF 批量执行 OCR,返回提取的文本。
- 功能
- 这是一个远程 MCP 服务器,对 CSV、Excel 文件、Google 表格或 Apify 数据集中提供的链接所指向的图片和扫描版 PDF 执行批量光学字符识别。它一次处理整个列表,并将提取的文本与每个来源条目对应保存。该服务由 Apify 托管,通过 streamable HTTP 访问。
- 适用场景
- 当你有一批图片或扫描版 PDF 链接,希望一次性批量提取文本而不是逐个文件处理时使用。它适合对已在表格或数据集中编目的扫描文档、票据或图片档案进行数字化。
- 运行要求
- 通过 streamable HTTP 访问 mcp.apify.com 的远程 MCP 端点。需要 Apify API 令牌,以 Bearer 令牌形式放在 Authorization 请求头中。运行按事件计费,计入 Apify 账户。
安装前请注意
Authorization 请求头携带 Apify API 令牌,这是可计费的凭据,需妥善保密。运行按事件计费并计入你的 Apify 账户,批量较大时会产生费用。来源链接及其内容会发送到 Apify 进行处理。
安装
在 SourceWeft 中
- 打开 控制台中的 Bulk OCR: Image & Scanned PDF to Text from CSV or Google Sheet,将其添加到工作区。
- 为需要使用其工具的对话启用该服务。
Web executable,通过 Streamable HTTP。 远程服务在工作区中配置后即可从网页运行时运行。
其他 MCP 客户端
把它添加到你客户端的 mcpServers 配置中。
{
"mcpServers": {
"bulk-ocr-image-pdf-to-text": {
"type": "http",
"url": "https://mcp.apify.com/?tools=nerolabs/bulk-ocr-image-pdf-to-text"
}
}
}工具
0工具元数据尚未被收录。
版本历史
1- v0.1.0最新Oct 1, 2026
