PDF Text Extractor (Apify Actor)

io.github.truhojunbot-techv1.0.0更新于 Oct 8, 2026

Extract text, tables and RAG chunks from public PDF URLs; pay-per-event via your Apify account.

已验证Streamable HTTP可网页运行Files & StorageKnowledge & Memory

概览

AI 生成的概览

通过 Apify 托管的远程 MCP 端点,从公开 PDF 链接中提取文本、表格和适合 RAG 的分块内容。

功能
这个远程 MCP 服务器封装了一个 Apify Actor,可从可通过 URL 访问的公开 PDF 文件中提取文本、表格和 RAG 分块。助手传入 PDF 链接,即可取回提取后的内容继续使用。它运行在 Apify 托管的 MCP 端点上,而不是用户本机。
适用场景
适合助手需要读取或复用公开 PDF 内容的场景,例如把文档文本送入检索或 RAG 流程,或从报告和论文中提取表格。不适用于私有或非公开文档。
运行要求
需要一个指向 Apify MCP 端点的远程 MCP 客户端。认证可选:使用 Authorization 请求头携带 Bearer APIFY_TOKEN,或在没有令牌时通过客户端 OAuth 登录。运行费用计入调用者的 Apify 账户,因此需要 Apify 账户。
安装前请注意
运行按事件计费并计入调用者的 Apify 账户,会产生费用。Authorization 请求头携带 Apify 令牌密钥,需谨慎处理。PDF 链接和提取内容会由第三方 Apify 托管服务处理。

安装

在 SourceWeft 中

  1. 打开 控制台中的 PDF Text Extractor (Apify Actor),将其添加到工作区。
  2. 为需要使用其工具的对话启用该服务。

Web executable,通过 Streamable HTTP。 远程服务在工作区中配置后即可从网页运行时运行。

其他 MCP 客户端

把它添加到你客户端的 mcpServers 配置中。

{
  "mcpServers": {
    "pdf-text-extractor": {
      "type": "http",
      "url": "https://mcp.apify.com/?tools=gochujang/pdf-text-extractor"
    }
  }
}

工具

0
工具元数据尚未被收录。

版本历史

1
  1. v1.0.0最新Oct 8, 2026