Speech to Text (Whisper) for Audio and Video URLs

io.github.saulius876-lgtmv1.0.0更新于 Oct 2, 2026

Whisper speech to text for podcast, audio and video URLs, 90+ languages, timestamped output.

已验证Streamable HTTP可网页运行Media & Design

概览

AI 生成的概览

通过 Whisper 将 URL 中的音频和视频转写为带时间戳的文本,支持 90 多种语言。

功能
这个远程 MCP 服务器为助手提供语音转文字能力:输入播客、音频或视频链接,返回转写文本。输出带时间戳,覆盖 90 多种语言。它由 Apify 托管,通过 streamable HTTP 访问,无需在本地安装软件包。
适用场景
当你希望助手把播客、访谈或视频等语音内容链接转成可检索、带时间戳的文本,又不想在本地运行转写软件时,适合使用。
运行要求
需要一个支持 streamable HTTP 的远程 MCP 客户端,并指向托管端点。需要网络访问。清单未声明认证、环境变量或请求头,但提供方在连接时可能仍要求账号或令牌。
安装前请注意
提交的音频或视频链接会发送给第三方提供方处理,请避免使用机密或私密媒体。清单未声明任何凭据,但连接前应确认提供方实际要求什么,并注意长录音可能消耗付费额度。

安装

在 SourceWeft 中

  1. 打开 控制台中的 Speech to Text (Whisper) for Audio and Video URLs,将其添加到工作区。
  2. 为需要使用其工具的对话启用该服务。

Web executable,通过 Streamable HTTP。 远程服务在工作区中配置后即可从网页运行时运行。

其他 MCP 客户端

把它添加到你客户端的 mcpServers 配置中。

{
  "mcpServers": {
    "speech-to-text": {
      "type": "http",
      "url": "https://mcp.apify.com/?tools=sauliusautomatesit/media-transcriber"
    }
  }
}

工具

0
工具元数据尚未被收录。

版本历史

1
  1. v1.0.0最新Oct 2, 2026