
PDF Text, Table and OCR Extractor
io.github.bkeller-researchv0.1.0更新於 Oct 7, 2026
PDF URLs to per-page text, tables as rows, Markdown, metadata and OCR for scanned pages.
概覽
AI 產生的概覽
透過遠端 MCP 端點從 PDF 連結擷取逐頁文字、表格、Markdown、中繼資料,並對掃描頁做 OCR。
- 功能
- 這個遠端 MCP 伺服器接收 PDF 連結,回傳擷取內容:逐頁文字、轉換為列的表格、Markdown 輸出、文件中繼資料,以及對掃描頁的 OCR。它託管在遠端端點,助理直接連線使用,不必在本機執行任何程式。
- 適用情境
- 適合助理需要閱讀或摘要網路上的 PDF、從報告中擷取表格,或處理需要 OCR 的掃描文件時使用。適用於 PDF 可透過連結存取的檔案處理情境。
- 執行需求
- 透過 streamable HTTP 連線位於 mcp.apify.com 的遠端 MCP 端點。未宣告任何套件、環境變數或標頭,也未宣告身分驗證。PDF 必須可透過連結存取。
安裝前請注意
伺服器會抓取你提供連結中的 PDF,這些文件會被傳送到第三方服務。未宣告任何憑證,但在處理敏感或私密文件前,請確認該端點如何處理抓取的檔案。
安裝
在 SourceWeft 中
- 開啟 儀表板中的 PDF Text, Table and OCR Extractor,將其新增到工作區。
- 為需要使用其工具的對話啟用該服務。
Web executable,透過 Streamable HTTP。 遠端服務在工作區中設定後即可從網頁執行環境執行。
其他 MCP 客戶端
把它新增到你客戶端的 mcpServers 設定中。
{
"mcpServers": {
"pdf-text-table-ocr-extractor": {
"type": "http",
"url": "https://mcp.apify.com/?tools=brenton8907/pdf-text-table-ocr-extractor"
}
}
}工具
0工具後設資料尚未被收錄。
版本歷史
1- v0.1.0最新Oct 7, 2026
