PDF Text Extractor (Apify Actor)

io.github.truhojunbot-techv1.0.0更新於 Oct 8, 2026

Extract text, tables and RAG chunks from public PDF URLs; pay-per-event via your Apify account.

已驗證Streamable HTTP可網頁執行Files & StorageKnowledge & Memory

概覽

AI 產生的概覽

透過 Apify 代管的遠端 MCP 端點,從公開 PDF 網址擷取文字、表格與適合 RAG 的分塊內容。

功能
這個遠端 MCP 伺服器封裝了一個 Apify Actor,可從能以網址存取的公開 PDF 檔案中擷取文字、表格與 RAG 分塊。助理傳入 PDF 連結,就能取回擷取後的內容繼續使用。它執行在 Apify 代管的 MCP 端點上,而非使用者本機。
適用情境
適合助理需要讀取或重複使用公開 PDF 內容的情境,例如把文件文字送入檢索或 RAG 流程,或從報告與論文中擷取表格。不適用於私有或非公開文件。
執行需求
需要一個指向 Apify MCP 端點的遠端 MCP 用戶端。驗證為選用:使用 Authorization 標頭攜帶 Bearer APIFY_TOKEN,或在沒有權杖時透過用戶端 OAuth 登入。執行費用計入呼叫者的 Apify 帳戶,因此需要 Apify 帳戶。
安裝前請注意
執行按事件計費並計入呼叫者的 Apify 帳戶,會產生費用。Authorization 標頭攜帶 Apify 權杖密鑰,需謹慎處理。PDF 網址與擷取內容會由第三方 Apify 代管服務處理。

安裝

在 SourceWeft 中

  1. 開啟 儀表板中的 PDF Text Extractor (Apify Actor),將其新增到工作區。
  2. 為需要使用其工具的對話啟用該服務。

Web executable,透過 Streamable HTTP。 遠端服務在工作區中設定後即可從網頁執行環境執行。

其他 MCP 客戶端

把它新增到你客戶端的 mcpServers 設定中。

{
  "mcpServers": {
    "pdf-text-extractor": {
      "type": "http",
      "url": "https://mcp.apify.com/?tools=gochujang/pdf-text-extractor"
    }
  }
}

工具

0
工具後設資料尚未被收錄。

版本歷史

1
  1. v1.0.0最新Oct 8, 2026