← 返回目录
S

Supadata MCP Server

官方
通过 Supadata 为 LLM 客户端提供视频转录与网页抓取能力
分类
开发工具 第 199 / 438
Stars
★ 63 热门
运行环境
Node.js
凭据
需要 API Key / 凭据
许可证
MIT
最近提交
工具数
9
54FMRS · D

Supadata MCP Server 是官方维护的服务器,功能覆盖视频转录、网页抓取/爬取及 AI 结构化提取,内置重试与限流机制,适合需要多平台内容采集的开发者;但依赖 Supadata 第三方 API 密钥和服务,不适合无法接受数据外发或有严格合规要求的场景。

最强项 · 文档质量 13/20 最弱项 · 可靠性 8/20

可靠性
8/20
安全与权限
12/20
维护活跃度
11/20
文档质量
13/20
安装易用性
10/20
查看各项评分依据
可靠性 8/20
仓库清单未缓存,提示词中也未提供任何源代码、package.json、CI 配置或测试文件内容,README 仅列出9个工具(transcript、metadata、extract、scrape、map、crawl 及三个状态查询工具)及其命令行式用法示例,但这些示例与'Available Tools'一节的描述是否与实际实现一致完全无法验证。README提到'npm test'但未展示测试用例或测试覆盖范围,也没有CI工作流证据。按静态评审规则,没有可验证的执行证据(真实CI工作流+覆盖关键路径的已提交测试),可靠性上限为12分;由于连基本的源码/清单都缺失,只能判断'happy path看似合理但错误处理、依赖控制、边界情况完全不可见',故评为8分。
安全与权限 12/20
服务器需要 SUPADATA_API_KEY 并通过该密钥调用第三方 Supadata API 来抓取任意用户提供的URL(YouTube/TikTok/Instagram/Twitter/任意网页),存在明显的外部网络与第三方数据流转,但README未说明发送给Supadata的具体数据范围、留存策略或是否有本地缓存/日志泄露风险。crawl工具默认limit=100等操作虽非破坏性(不删除、不支付、不执行远程命令),但缺乏对大范围抓取/爬取操作的确认机制说明,也未提及最小权限或目标域名白名单机制。未发现真实令牌、恶意代码、隐蔽渗出或客观已知的严重漏洞等红线问题,故不触发0-4分红线,但由于权限范围、数据边界披露不完整,评为12分。
维护活跃度 11/20
仓库未被归档(Archived: False),采用MIT许可证,有62星和4个未关闭issue,显示有一定活跃度,但用户提示中未提供任何commit历史、发布版本、依赖更新记录或安全响应渠道的证据。README中的Contributing部分仅是通用模板(fork、分支、npm test、PR),未说明维护者响应时效或版本管理策略。证据不足以判断持续维护质量,故评为11分(有基本治理迹象但证据不全,中等偏下)。
文档质量 13/20
README结构清晰,包含功能列表、环境变量配置、9个工具的独立小节及每个工具的命令行用法示例,并提供了'如何选择工具'的对比表格,便于用户理解各工具用途。但文档存在明显缺口:实际客户端安装/连接步骤被完全外包给外部文档链接(docs.supadata.ai),仓库内没有Claude/Cursor等客户端的JSON配置示例;未说明API调用限流、费用、错误码含义或故障排查方法;重试与限速的配置项虽列出但未说明触发条件或对用户的实际影响。故评为13分:可用但存在隐藏假设与故障排查空白。
安装易用性 10/20
安装被要求在npm生态下进行(npm install/build/test),但真正的MCP客户端连接配置(如Claude Desktop的mcpServers JSON片段)并未包含在仓库README中,而是指向外部集成指南,无法在此静态材料中验证其准确性或步骤数量。按静态校准规则,没有CI+测试等可验证执行证据时setup上限为15分;由于连接配置示例缺失、仅有环境变量说明,实际步骤对新用户并不'清晰、少步骤',评为10分(可行但依赖外部文档且步骤未在本仓库内完整验证)。

静态评测 · 未实际运行收录于 2026-08-26

查看 FMRS 评分方法 →

选型与风险

能访问什么访问网络

适合谁

  • 需要将视频转录整合进内容处理流程的开发者
  • 构建研究或摘要工具、需要网页与视频数据的 AI 应用开发者
  • 需要站内 URL 发现与多页内容爬取的自动化流程

不适合谁

  • 需要通用浏览器自动化(点击、登录、表单交互)的场景
  • 对目标网站服务条款有严格合规要求且未经确认的抓取任务
  • 不希望将目标 URL 或内容发送至第三方 Supadata API 的隐私敏感场景

所需权限

  • 需要有效的 SUPADATA_API_KEY 以调用 Supadata API
  • 需要出站网络访问以请求目标视频平台与网页 URL

风险与副作用

  • 请求的 URL 及抓取内容会发送至第三方 Supadata 服务处理,存在数据外泄风险
  • API 密钥若配置不当可能被滥用,产生额外调用费用
  • 抓取或爬取目标网站可能违反其服务条款或版权限制
  • 异步任务(转录、提取、爬取)依赖 Supadata 服务可用性与限流策略

安装接入

准备工作

运行环境:Node.js

SUPADATA_API_KEY 必填密钥 Supadata 平台的 API 密钥,在 https://supadata.ai 注册获取。
  1. 在 Supadata 官网获取 API 密钥,并设置环境变量 SUPADATA_API_KEY。
  2. 参照 Supadata 官方集成指南(docs.supadata.ai/integrations/mcp)为 Claude、ChatGPT、Cursor、Windsurf、VS Code 等客户端完成 MCP 服务器配置。
  3. 如需本地开发或二次构建,可克隆仓库后执行 npm install 与 npm run build。

验证是否装好

在客户端的工具列表中确认出现 supadata_transcript 等工具,然后让它抓取一个网页(如 https://example.com),能返回内容即说明配置成功。

常见排障

  1. 确认已正确设置 SUPADATA_API_KEY 环境变量
  2. 转录、提取、爬取为异步任务,需使用对应的 check_status 工具轮询任务 ID 获取结果
  3. 确认目标 URL 属于受支持平台(YouTube、TikTok、Instagram、Twitter)或为可访问的文件/网页 URL
  4. 如遇失败,检查网络连通性及 Supadata 服务的限流与重试配置(maxAttempts、initialDelay、maxDelay、backoffFactor)

试试这样问

连接成功后,可以直接对 AI 助手这样说:

  • 提取这个 YouTube 视频的英文字幕:https://youtube.com/watch?v=example
  • 获取这个视频的元数据,包括标题和作者信息
  • 用 AI 从这个视频里提取讨论的主要话题
  • 抓取 https://example.com 的页面内容并转成 markdown

工具能力 9

supadata_transcript 只读
从支持的视频平台(YouTube、TikTok、Instagram、Twitter)及文件 URL 提取转录文本,可指定语言。
supadata_check_transcript_status 只读
通过任务 ID 查询转录提取任务的进度。
supadata_metadata 只读
获取媒体 URL 的元数据,包括平台信息、标题、描述、作者详情、互动数据、媒体详情、标签及创建日期。
supadata_extract 只读
使用 AI 从视频 URL 中提取结构化数据,可提供提示词和/或 JSON Schema 定义输出格式,返回用于异步查询的任务 ID。
supadata_check_extract_status 只读
通过任务 ID 查询结构化提取任务的进度。
supadata_scrape 只读
从单个 URL 抓取内容,支持语言等高级选项。
supadata_map 只读
发现网站上所有已索引的 URL,便于在抓取前定位相关页面。
supadata_crawl 只读
启动异步爬取任务,从网站的多个相关页面提取内容。
展开其余 1 个工具
supadata_check_crawl_status 只读
通过任务 ID 查询爬取任务的进度。

使用场景

批量提取 YouTube/TikTok/Instagram/Twitter 视频的转录文本
抓取单个网页内容用于摘要或知识库构建
爬取博客或文档站点的多个相关页面
在抓取前发现网站的完整 URL 列表
获取视频元数据(标题、作者、互动数据等)
用 AI 从视频内容中提取结构化信息

支持客户端

Claude
ChatGPT
Cursor
Windsurf
VS Code

依据项目文档列出,未经本站实测。

详细介绍

Supadata MCP Server 是 Supadata 官方维护的模型上下文协议服务器,将视频转录提取、网页抓取、网站爬取与 URL 发现能力接入 Cursor、Claude 等任意 LLM 客户端。它支持从 YouTube、TikTok、Instagram、Twitter 及文件 URL 提取转录文本,获取媒体元数据(平台信息、标题、描述、作者信息、互动数据、标签、发布时间等),并可用 AI 从视频内容中提取结构化数据。网页方面提供单页抓取、多页爬取及站内 URL 发现功能。内置自动重试与限流机制,可通过配置参数调整重试次数、延迟与退避倍数。使用需要提供 SUPADATA_API_KEY 环境变量以调用 Supadata 的后端 API。

同类可选方案

Context7 80 · B

Upstash 官方维护,为 AI 编码助手提供实时更新的第三方库文档

★ 62.9k · 工具数 2 与当前对比 →

源版本 40c868a3f820 数据同步于 2026-10-11 查看 FMRS 评分方法