
PDF Text, Table and OCR Extractor
io.github.bkeller-researchv0.1.0更新于 Oct 7, 2026
PDF URLs to per-page text, tables as rows, Markdown, metadata and OCR for scanned pages.
概览
AI 生成的概览
通过远程 MCP 端点从 PDF 链接提取逐页文本、表格、Markdown、元数据,并对扫描页做 OCR。
- 功能
- 这个远程 MCP 服务器接收 PDF 链接,返回提取内容:逐页文本、转换为行的表格、Markdown 输出、文档元数据,以及对扫描页的 OCR。它托管在远程端点,助手直接连接使用,无需在本地运行任何程序。
- 适用场景
- 适合助手需要阅读或总结网上的 PDF、从报告中提取表格,或处理需要 OCR 的扫描文档时使用。适用于 PDF 可通过链接访问的文档处理场景。
- 运行要求
- 通过 streamable HTTP 连接位于 mcp.apify.com 的远程 MCP 端点。未声明任何软件包、环境变量或请求头,也未声明身份验证。PDF 必须可通过链接访问。
安装前请注意
服务器会抓取你提供的链接中的 PDF,这些文档会被发送到第三方服务。未声明任何凭据,但在处理敏感或私密文档前,请确认该端点如何处理抓取的文件。
安装
在 SourceWeft 中
- 打开 控制台中的 PDF Text, Table and OCR Extractor,将其添加到工作区。
- 为需要使用其工具的对话启用该服务。
Web executable,通过 Streamable HTTP。 远程服务在工作区中配置后即可从网页运行时运行。
其他 MCP 客户端
把它添加到你客户端的 mcpServers 配置中。
{
"mcpServers": {
"pdf-text-table-ocr-extractor": {
"type": "http",
"url": "https://mcp.apify.com/?tools=brenton8907/pdf-text-table-ocr-extractor"
}
}
}工具
0工具元数据尚未被收录。
版本历史
1- v0.1.0最新Oct 7, 2026
