PDF Text, Table and OCR Extractor

io.github.bkeller-researchv0.1.0更新於 Oct 7, 2026

PDF URLs to per-page text, tables as rows, Markdown, metadata and OCR for scanned pages.

已驗證Streamable HTTP可網頁執行Files & Storage

概覽

AI 產生的概覽

透過遠端 MCP 端點從 PDF 連結擷取逐頁文字、表格、Markdown、中繼資料,並對掃描頁做 OCR。

功能
這個遠端 MCP 伺服器接收 PDF 連結,回傳擷取內容:逐頁文字、轉換為列的表格、Markdown 輸出、文件中繼資料,以及對掃描頁的 OCR。它託管在遠端端點,助理直接連線使用,不必在本機執行任何程式。
適用情境
適合助理需要閱讀或摘要網路上的 PDF、從報告中擷取表格,或處理需要 OCR 的掃描文件時使用。適用於 PDF 可透過連結存取的檔案處理情境。
執行需求
透過 streamable HTTP 連線位於 mcp.apify.com 的遠端 MCP 端點。未宣告任何套件、環境變數或標頭,也未宣告身分驗證。PDF 必須可透過連結存取。
安裝前請注意
伺服器會抓取你提供連結中的 PDF,這些文件會被傳送到第三方服務。未宣告任何憑證,但在處理敏感或私密文件前,請確認該端點如何處理抓取的檔案。

安裝

在 SourceWeft 中

  1. 開啟 儀表板中的 PDF Text, Table and OCR Extractor,將其新增到工作區。
  2. 為需要使用其工具的對話啟用該服務。

Web executable,透過 Streamable HTTP。 遠端服務在工作區中設定後即可從網頁執行環境執行。

其他 MCP 客戶端

把它新增到你客戶端的 mcpServers 設定中。

{
  "mcpServers": {
    "pdf-text-table-ocr-extractor": {
      "type": "http",
      "url": "https://mcp.apify.com/?tools=brenton8907/pdf-text-table-ocr-extractor"
    }
  }
}

工具

0
工具後設資料尚未被收錄。

版本歷史

1
  1. v0.1.0最新Oct 7, 2026