← 返回目录
W

Web Scout MCP

社区
通过 DuckDuckGo 搜索网页并提取内容。
GitHub 源仓库 ↗
★ 131 Stars 分类 · 浏览器自动化 非常热门
49FMRS · D
可靠性
8/20
安全与权限
9/20
维护活跃度
8/20
文档质量
11/20
安装易用性
13/20

该项目是一个采用 Apache-2.0 许可的 Node.js MCP 服务器,核心能力是 DuckDuckGo 搜索和网页内容提取;README 同时展示了 MIT 徽章,许可证信息存在不一致,建议进一步核对仓库中的 LICENSE 文件。

查看 FMRS 评分方法 →

Web Scout MCP 是一个基于 Node.js 的 MCP 服务器,提供 DuckDuckGo 网页搜索和网页内容提取功能,支持并行处理多个 URL、内存优化、请求限流和错误处理。

工具能力

DuckDuckGoWebSearch
使用 DuckDuckGo 执行搜索,并返回包含标题、URL 和摘要的结构化结果。
UrlContentExtractor
从一个或多个网页中提取整洁、可读的文本,并移除脚本、样式和导航等不必要元素。

安装接入

需要 Node.js 18 或更高版本以及 npm 或 yarn。可通过 npm install -g @pinkpixel/web-scout-mcp 全局安装,或通过 npm install @pinkpixel/web-scout-mcp 本地安装;也可将提供的 npx 配置加入支持 MCP 的客户端,然后运行 web-scout-mcp。从源码运行时,可执行 npm installnpm run buildnpm start。嵌入并自行调用 createServer() 时,设置 WEB_SCOUT_DISABLE_AUTOSTART=1

claude_desktop_config.json
{"mcpServers":{"web-scout":{"command":"npx","args":["-y","@pinkpixel/web-scout-mcp@latest"]}}}

选型与风险

适合谁

  • 需要基础网页搜索和网页文本提取的 AI 助手工作流。
  • 需要一次处理多个 URL 的内容采集任务。
  • 希望使用 DuckDuckGo 搜索的 MCP 客户端用户。

不适合谁

  • 需要浏览器交互、登录态操作或页面自动化的任务。
  • 需要官方搜索 API、身份验证或特定搜索引擎保证的工作流。
  • 需要结构化网页语义或完整页面渲染结果的任务。

所需权限

  • 需要访问 DuckDuckGo 以执行搜索。
  • 需要访问用户提交的目标 URL 以提取网页内容。
  • 需要在本地运行 Node.js 进程并通过 stdio 与 MCP 客户端通信。

风险与副作用

  • 外部网页内容可能因页面结构、网络状况或网站限制而提取不完整。
  • 请求可能触发网站或搜索服务的限流或阻断。
  • 从网页获取的内容应视为外部数据,并在使用前进行核验。

常见排障

  1. 确认 Node.js 版本至少为 18,并已安装 npm 或 yarn。
  2. 检查 MCP 客户端配置中的命令、包名和 `-y` 参数。
  3. 从源码运行时依次检查依赖安装、构建和启动步骤。
  4. 若嵌入包并自行调用 `createServer()`,设置 `WEB_SCOUT_DISABLE_AUTOSTART=1`。
  5. 遇到请求失败或阻断时,检查目标 URL、网络连接和服务限流情况。

使用场景

搜索网页并获取标题、链接和摘要。
提取单个网页或多个网页的可读文本。
为 AI 助手提供网页研究和内容整理能力。

支持客户端

Claude Desktop完整支持
Cursor完整支持