← 返回目录
B

Bright Data Web MCP

官方
为 AI 提供实时、可解锁的公共网页访问能力
GitHub 源仓库 ↗
★ 2.5k Stars 分类 · 其他 非常热门
58FMRS · C
可靠性
9/20
安全与权限
8/20
维护活跃度
12/20
文档质量
15/20
安装易用性
14/20

Bright Data Web MCP 是 MIT 许可、stdio 传输的公共网页访问服务器,提供搜索、抓取、浏览器自动化和多类结构化数据工具。它适合实时网页研究与 AI 代理工作流,但需要 Bright Data API_TOKEN,并涉及 credits 消耗及可能的 Pro 用量费用。

查看 FMRS 评分方法 →

Bright Data 提供的 Web MCP 服务器,让 AI 代理能够搜索、抓取、提取和浏览实时公共网页内容。它支持 Markdown 内容提取、AI 排名搜索、浏览器自动化,以及电商、社交、金融、商业、研究、应用商店、旅游、GEO 和代码包数据工具。

工具能力

search_engine
执行面向 AI 优化的网页搜索。
search_engine_batch
批量执行网页搜索。
scrape_as_markdown
将网页转换为适合 AI 使用的 Markdown。
scrape_batch
批量抓取网页。
discover
根据意图相关性进行 AI 排名的网页搜索。
scraping_browser_snapshot
获取浏览器页面快照。
scraping_browser_click_ref
在浏览器中点击引用元素。
scraping_browser_screenshot
获取浏览器页面截图。
web_data_amazon_product
提取 Amazon 商品结构化数据。
web_data_walmart_product
提取 Walmart 商品结构化数据。
web_data_google_shopping
提取 Google Shopping 数据。
web_data_linkedin_posts
提取 LinkedIn 帖子数据。
web_data_tiktok_posts
提取 TikTok 帖子数据。
web_data_youtube_videos
提取 YouTube 视频数据。
web_data_yahoo_finance_business
提取 Yahoo Finance 商业数据。
web_data_crunchbase_company
提取 Crunchbase 公司数据。
web_data_zoominfo_company_profile
提取 ZoomInfo 公司资料数据。
web_data_zillow_properties_listing
提取 Zillow 房源数据。
web_data_github_repository_file
提取 GitHub 仓库文件数据。
web_data_reuter_news
提取 Reuters 新闻数据。
web_data_google_play_store
提取 Google Play 商店数据。
web_data_apple_app_store
提取 Apple App Store 数据。
web_data_booking_hotel_listings
提取 Booking 酒店列表数据。
web_data_chatgpt_ai_insights
获取 ChatGPT 生成的品牌洞察、引用和推荐。
web_data_grok_ai_insights
获取 Grok 的 AI 洞察。
web_data_perplexity_ai_insights
获取 Perplexity 的搜索增强回答及来源。
web_data_npm_package
获取 npm 包版本、README、元数据和依赖信息。
web_data_pypi_package
获取 PyPI 包信息、版本和项目详情。
extract
提供 AI 辅助的数据提取能力。

安装接入

在 MCP 客户端中使用 stdio 配置,运行 npx @brightdata/mcp,并将 API_TOKEN 设置为 Bright Data API 密钥。也可使用 README 提供的托管地址,但该地址属于远程连接方式,不能改变本资料中的 manifest transport。

claude_desktop_config.json
{"mcpServers":{"Bright Data":{"command":"npx","args":["@brightdata/mcp"],"env":{"API_TOKEN":"<your-api-token-here>"}}}}

选型与风险

适合谁

  • 需要实时公共网页数据的 AI 代理
  • 需要网页抓取和结构化数据的研究与分析工作流
  • 需要 npm 或 PyPI 实时包信息的编码代理
  • 需要浏览器自动化功能的 Pro 模式用户

不适合谁

  • 需要访问私有、未授权或内部数据的场景
  • 不希望使用 Bright Data API 密钥的用户
  • 离线环境或不具备 Node.js/npx 的本地安装环境
  • 不适合承担按用量计费的 Pro 或数据工具成本的工作流

所需权限

  • 必须提供 Bright Data API_TOKEN
  • 服务器需要访问 Bright Data 服务和公共网页
  • 可选配置 WEB_UNLOCKER_ZONE 和 BROWSER_ZONE
  • 可选启用 PRO_MODE、GROUPS、TOOLS 及超时和重试参数

风险与副作用

  • 请求会消耗账户 credits;基础工具按请求计费,web_data_* 工具按返回记录计费
  • 免费额度为每月 5,000 credits,未使用额度不结转
  • PRO_MODE 会产生基于用量的额外费用
  • API_TOKEN 是秘密凭据,应避免暴露在日志或共享配置中
  • 实时网页内容、可用性和抓取结果可能受目标网站及网络条件影响

常见排障

  1. 出现 spawn npx ENOENT 时检查 Node.js 是否已安装,或配置 node 的完整路径
  2. 复杂网站超时时检查并提高客户端超时设置
  3. 认证失败时检查 API_TOKEN 有效性和权限
  4. 远程连接失败时检查网络连接和防火墙
  5. 数据工具响应缓慢时检查 POLLING_TIMEOUT 配置

使用场景

实时研究和事实核查
电商价格、商品和库存分析
竞争与市场分析
让 AI 代理浏览公共网页
查询 npm 和 PyPI 包信息
GEO 和品牌可见性分析
内容创作和学术研究

支持客户端

Claude Desktop完整支持
Claude Code部分支持
Cursor部分支持
Windsurf部分支持