适合谁
- 需要通过自然语言进行网页抓取和结构化数据提取的 AI 助手开发者。
- 需要从多个页面自动提取数据的爬虫和数据分析工作流。
- 需要监控网站变化并定期提取信息的用户。
该 MCP 服务器提供 AI 驱动的网页抓取功能,工具丰富,覆盖抓取、提取、搜索、爬取和监控。配置简单,但需要付费 API 密钥。注意工具名称在 v3 中有重命名,使用前需对照文档。
ScrapeGraph MCP 服务器是一个生产就绪的 Model Context Protocol (MCP) 服务器,提供与 ScrapeGraph AI API 的无缝集成。它使语言模型能够利用先进的 AI 网页抓取能力,支持多种工具:网页抓取(多格式)、基于提示的提取、搜索、多页面异步爬取(开始/状态/停止/恢复)、JSON Schema 生成、计划监控任务(创建/列表/获取/暂停/恢复/删除/活动)、账户额度与历史记录。该服务器采用 stdio 传输,通过环境变量(SGAI_API_KEY、SGAI_API_URL、SGAI_TIMEOUT)配置 API 密钥、基础 URL 和超时。注意:版本 v3 已将工具重命名,例如 smartscraper 改为 extract,smartcrawler_initiate 改为 crawl_start。
npx -y @smithery/cli install @ScrapeGraphAI/scrapegraph-mcp --client claude。3. 或者本地安装:克隆仓库、pip install -e .,然后设置环境变量 SGAI_API_KEY,通过 scrapegraph-mcp 或 python -m scrapegraph_mcp.server 运行。4. 配置 Claude Desktop 或 Cursor,参考 README 中的 JSON 配置。{
"mcpServers": {
"scrapegraph-mcp": {
"command": "npx",
"args": [
"-y",
"@smithery/cli@latest",
"run",
"@ScrapeGraphAI/scrapegraph-mcp",
"--config",
"\"{\\\"scrapegraphApiKey\\\":\\\"YOUR-SGAI-API-KEY\\\"}\""
]
}
}
}