
PDF Text Extractor (Apify Actor)
io.github.truhojunbot-techv1.0.0更新於 Oct 8, 2026
Extract text, tables and RAG chunks from public PDF URLs; pay-per-event via your Apify account.
概覽
AI 產生的概覽
透過 Apify 代管的遠端 MCP 端點,從公開 PDF 網址擷取文字、表格與適合 RAG 的分塊內容。
- 功能
- 這個遠端 MCP 伺服器封裝了一個 Apify Actor,可從能以網址存取的公開 PDF 檔案中擷取文字、表格與 RAG 分塊。助理傳入 PDF 連結,就能取回擷取後的內容繼續使用。它執行在 Apify 代管的 MCP 端點上,而非使用者本機。
- 適用情境
- 適合助理需要讀取或重複使用公開 PDF 內容的情境,例如把文件文字送入檢索或 RAG 流程,或從報告與論文中擷取表格。不適用於私有或非公開文件。
- 執行需求
- 需要一個指向 Apify MCP 端點的遠端 MCP 用戶端。驗證為選用:使用 Authorization 標頭攜帶 Bearer APIFY_TOKEN,或在沒有權杖時透過用戶端 OAuth 登入。執行費用計入呼叫者的 Apify 帳戶,因此需要 Apify 帳戶。
安裝前請注意
執行按事件計費並計入呼叫者的 Apify 帳戶,會產生費用。Authorization 標頭攜帶 Apify 權杖密鑰,需謹慎處理。PDF 網址與擷取內容會由第三方 Apify 代管服務處理。
安裝
在 SourceWeft 中
- 開啟 儀表板中的 PDF Text Extractor (Apify Actor),將其新增到工作區。
- 為需要使用其工具的對話啟用該服務。
Web executable,透過 Streamable HTTP。 遠端服務在工作區中設定後即可從網頁執行環境執行。
其他 MCP 客戶端
把它新增到你客戶端的 mcpServers 設定中。
{
"mcpServers": {
"pdf-text-extractor": {
"type": "http",
"url": "https://mcp.apify.com/?tools=gochujang/pdf-text-extractor"
}
}
}工具
0工具後設資料尚未被收錄。
版本歷史
1- v1.0.0最新Oct 8, 2026

