
PDF Text Extractor (Apify Actor)
io.github.truhojunbot-techv1.0.0更新于 Oct 8, 2026
Extract text, tables and RAG chunks from public PDF URLs; pay-per-event via your Apify account.
概览
AI 生成的概览
通过 Apify 托管的远程 MCP 端点,从公开 PDF 链接中提取文本、表格和适合 RAG 的分块内容。
- 功能
- 这个远程 MCP 服务器封装了一个 Apify Actor,可从可通过 URL 访问的公开 PDF 文件中提取文本、表格和 RAG 分块。助手传入 PDF 链接,即可取回提取后的内容继续使用。它运行在 Apify 托管的 MCP 端点上,而不是用户本机。
- 适用场景
- 适合助手需要读取或复用公开 PDF 内容的场景,例如把文档文本送入检索或 RAG 流程,或从报告和论文中提取表格。不适用于私有或非公开文档。
- 运行要求
- 需要一个指向 Apify MCP 端点的远程 MCP 客户端。认证可选:使用 Authorization 请求头携带 Bearer APIFY_TOKEN,或在没有令牌时通过客户端 OAuth 登录。运行费用计入调用者的 Apify 账户,因此需要 Apify 账户。
安装前请注意
运行按事件计费并计入调用者的 Apify 账户,会产生费用。Authorization 请求头携带 Apify 令牌密钥,需谨慎处理。PDF 链接和提取内容会由第三方 Apify 托管服务处理。
安装
在 SourceWeft 中
- 打开 控制台中的 PDF Text Extractor (Apify Actor),将其添加到工作区。
- 为需要使用其工具的对话启用该服务。
Web executable,通过 Streamable HTTP。 远程服务在工作区中配置后即可从网页运行时运行。
其他 MCP 客户端
把它添加到你客户端的 mcpServers 配置中。
{
"mcpServers": {
"pdf-text-extractor": {
"type": "http",
"url": "https://mcp.apify.com/?tools=gochujang/pdf-text-extractor"
}
}
}工具
0工具元数据尚未被收录。
版本历史
1- v1.0.0最新Oct 8, 2026
