Speech to Text (Whisper) for Audio and Video URLs

io.github.saulius876-lgtmv1.0.0更新於 Oct 2, 2026

Whisper speech to text for podcast, audio and video URLs, 90+ languages, timestamped output.

已驗證Streamable HTTP可網頁執行Media & Design

概覽

AI 產生的概覽

透過 Whisper 將網址中的音訊與影片轉錄為帶時間戳的文字,支援 90 多種語言。

功能
這個遠端 MCP 伺服器為助理提供語音轉文字能力:輸入播客、音訊或影片連結,回傳轉錄文字。輸出帶有時間戳,涵蓋 90 多種語言。它由 Apify 託管,透過 streamable HTTP 存取,不需要在本機安裝套件。
適用情境
當你希望助理把播客、訪談或影片等語音內容連結轉成可搜尋、帶時間戳的文字,又不想在本機執行轉錄軟體時,適合使用。
執行需求
需要支援 streamable HTTP 的遠端 MCP 用戶端,並指向託管端點。需要網路存取。清單未宣告驗證、環境變數或標頭,但提供方在連線時可能仍要求帳號或權杖。
安裝前請注意
提交的音訊或影片連結會傳送給第三方提供方處理,請避免使用機密或私密媒體。清單未宣告任何憑證,但連線前應確認提供方實際要求什麼,並注意長錄音可能消耗付費額度。

安裝

在 SourceWeft 中

  1. 開啟 儀表板中的 Speech to Text (Whisper) for Audio and Video URLs,將其新增到工作區。
  2. 為需要使用其工具的對話啟用該服務。

Web executable,透過 Streamable HTTP。 遠端服務在工作區中設定後即可從網頁執行環境執行。

其他 MCP 客戶端

把它新增到你客戶端的 mcpServers 設定中。

{
  "mcpServers": {
    "speech-to-text": {
      "type": "http",
      "url": "https://mcp.apify.com/?tools=sauliusautomatesit/media-transcriber"
    }
  }
}

工具

0
工具後設資料尚未被收錄。

版本歷史

1
  1. v1.0.0最新Oct 2, 2026