PDF Text, Table and OCR Extractor

io.github.bkeller-researchv0.1.0更新于 Oct 7, 2026

PDF URLs to per-page text, tables as rows, Markdown, metadata and OCR for scanned pages.

已验证Streamable HTTP可网页运行Files & Storage

概览

AI 生成的概览

通过远程 MCP 端点从 PDF 链接提取逐页文本、表格、Markdown、元数据,并对扫描页做 OCR。

功能
这个远程 MCP 服务器接收 PDF 链接,返回提取内容:逐页文本、转换为行的表格、Markdown 输出、文档元数据,以及对扫描页的 OCR。它托管在远程端点,助手直接连接使用,无需在本地运行任何程序。
适用场景
适合助手需要阅读或总结网上的 PDF、从报告中提取表格,或处理需要 OCR 的扫描文档时使用。适用于 PDF 可通过链接访问的文档处理场景。
运行要求
通过 streamable HTTP 连接位于 mcp.apify.com 的远程 MCP 端点。未声明任何软件包、环境变量或请求头,也未声明身份验证。PDF 必须可通过链接访问。
安装前请注意
服务器会抓取你提供的链接中的 PDF,这些文档会被发送到第三方服务。未声明任何凭据,但在处理敏感或私密文档前,请确认该端点如何处理抓取的文件。

安装

在 SourceWeft 中

  1. 打开 控制台中的 PDF Text, Table and OCR Extractor,将其添加到工作区。
  2. 为需要使用其工具的对话启用该服务。

Web executable,通过 Streamable HTTP。 远程服务在工作区中配置后即可从网页运行时运行。

其他 MCP 客户端

把它添加到你客户端的 mcpServers 配置中。

{
  "mcpServers": {
    "pdf-text-table-ocr-extractor": {
      "type": "http",
      "url": "https://mcp.apify.com/?tools=brenton8907/pdf-text-table-ocr-extractor"
    }
  }
}

工具

0
工具元数据尚未被收录。

版本历史

1
  1. v0.1.0最新Oct 7, 2026