← 返回目录
D

Decodo MCP Server

官方
让 AI 代理动态抓取和解析网页内容,包括受地域限制的网站
GitHub 源仓库 ↗
★ 34 Stars 分类 · 开发工具 热门
57FMRS · C

官方维护的 MCP 服务器,将 Decodo 的商业网页抓取 API 封装为 30 个工具,覆盖 SERP、电商、社媒和 AI 搜索,支持模块化工具集与地理位置控制,适合需要生产级实时网页数据的 AI 代理项目,但依赖第三方云服务和令牌认证。

可靠性
7/20
安全与权限
12/20
维护活跃度
9/20
文档质量
16/20
安装易用性
13/20
查看 FMRS 评分方法 →

Decodo MCP 服务器是面向 AI 代理的网页抓取层,将兼容 MCP 的客户端连接到 Decodo 的 Web Scraping API。它支持抓取网站、搜索引擎、电商平台和社交媒体,提供 Markdown、JSON 和截图等结构化输出,内置 JavaScript 渲染和反爬处理,依托 125M+ 住宅 IP、195+ 地区的基础设施。工具按 web、search、ecommerce、social_media、ai 五个工具集模块化组织,可通过 toolsets 参数按需启用。

工具能力

scrape_as_markdown
抓取任意目标 URL,以 Markdown 格式返回结果。
screenshot
对任意网页截图并返回 PNG 图片。
google_search
抓取 Google 搜索结果并返回解析后的数据。
google_ads
抓取 Google Ads 搜索结果。
google_lens
抓取 Google Lens 图片搜索结果。
google_ai_mode
抓取 Google AI 模式(AI 搜索)结果。
google_travel_hotels
抓取 Google Travel 酒店搜索结果。
amazon_search
抓取 Amazon 搜索结果并返回解析数据。
amazon_product
抓取 Amazon 商品页面。
amazon_pricing
抓取 Amazon 商品价格信息。
amazon_sellers
抓取 Amazon 卖家信息。
amazon_bestsellers
抓取 Amazon 畅销榜列表。
walmart_search
抓取 Walmart 搜索结果并返回解析数据。
walmart_product
抓取 Walmart 商品页面。
target_search
抓取 Target 搜索结果并返回解析数据。
target_product
抓取 Target 商品页面。
tiktok_post
抓取 TikTok 帖子 URL 的结构化数据(互动、文案、话题标签等)。
tiktok_shop_search
抓取 TikTok Shop 搜索结果并返回解析数据。
tiktok_shop_product
抓取 TikTok Shop 商品页面。
tiktok_shop_url
按 URL 抓取 TikTok Shop 页面。
youtube_metadata
抓取 YouTube 视频元数据。
youtube_channel
抓取 YouTube 频道视频。
youtube_subtitles
抓取 YouTube 视频字幕。
youtube_search
搜索 YouTube 视频。
reddit_post
抓取指定的 Reddit 帖子。
reddit_subreddit
抓取 Reddit 子版块的结果。
reddit_user
抓取 Reddit 用户资料及其帖子/评论。
bing_search
抓取 Bing 搜索结果。
chatgpt
搜索并与 ChatGPT 交互,获取 AI 生成的回复。
perplexity
搜索并与 Perplexity 交互,获取 AI 生成的回复。

安装接入

  1. 在 dashboard.decodo.com 注册免费账户(最高 2000 次免费请求)并获取 Web Scraping API 的 Basic 认证令牌。2. 安装 Node.js 18+。3. 在 Claude Desktop 的 claude_desktop_config. 中添加:command 为 npx,args 为 ["-y","@decodo/mcp-server"],环境变量 SCRAPER_API_TOKEN 设为令牌,TOOLSETS 可选 web,ai 等工具集。4. 保存并重启客户端。也可使用托管端点 https://mcp.decodo.com/mcp,在请求头中携带 Basic 授权令牌。
claude_desktop_config.json
{"mcpServers":{"Decodo":{"command":"npx","args":["-y","@decodo/mcp-server"],"env":{"SCRAPER_API_TOKEN":"<basic_auth_token>","TOOLSETS":"web,ai"}}}}

选型与风险

适合谁

  • 需要为 LLM/RAG 提供实时网页数据的开发者
  • 构建电商情报、社媒监控或价格聚合工具的团队
  • 不想自建代理与反爬基础设施的 AI 代理项目

不适合谁

  • 不愿依赖第三方付费抓取服务或云端托管的用户
  • 仅需本地文件或内部数据访问的场景
  • 无法接受将目标 URL 和提示词发送给 Decodo 服务端的隐私敏感场景

所需权限

  • 需要 Decodo Web Scraping API 的 Basic 认证令牌(SCRAPER_API_TOKEN)
  • 通过 npx 从 npm 下载并运行 @decodo/mcp-server 包
  • 需访问网络以调用 Decodo 托管抓取服务

风险与副作用

  • 所有抓取目标 URL 和提示词会经第三方(Decodo)服务端处理
  • 免费额度用尽后产生 API 使用费用
  • 抓取目标网站可能违反其服务条款,需自行确认合规性
  • 依赖外部 npm 包和托管 API,存在供应链与可用性风险

常见排障

  1. 出现认证错误时,检查仪表板中的令牌是否正确配置为 Basic 授权
  2. 确认已安装 Node.js 18 或更高版本
  3. 确认 MCP 客户端配置保存后已重启
  4. 若上下文窗口溢出,可在提示词中要求返回更少 token 或完整内容
  5. 受地域限制时可指定 geo 参数更换出口 IP 国家

使用场景

AI 代理实时网页抓取,突破静态训练数据限制
为 RAG 管道拉取实时 Google、Bing 和 AI 搜索结果
跨电商平台追踪商品价格、列表和卖家
从 Reddit、TikTok、YouTube 采集社交媒体数据
构建实时价格与库存聚合工具
访问受地域限制的内容

支持客户端

Claude Desktop完整支持
Cursor完整支持
Windsurf完整支持
Claude Code部分支持