适合谁
- 需要抓取现代 JavaScript 渲染网站的开发者
- 需要批量抓取网页内容的数据采集场景
- 希望自动提取网页主要内容的用户
Fetcher MCP 是一个功能强大的网页抓取服务器,利用 Playwright 支持动态内容,并提供智能提取、批量抓取等功能。适合需要处理现代 Web 应用的开发者,但需注意反爬机制和资源消耗。
Fetcher MCP 是一个基于 Playwright 无头浏览器的 MCP 服务器,用于获取网页内容。它支持执行 JavaScript,能够处理动态网页和现代 Web 应用;内置 Readability 算法,可智能提取主要内容,去除广告和导航等非核心元素;支持 HTML 和 Markdown 两种输出格式;提供并发抓取多个 URL 的工具 fetch_urls;自动阻止不必要资源(图片、样式、字体、媒体)以节省带宽;具备完善的错误处理和日志;可配置超时、内容提取和输出格式等参数。
npx -y fetcher-mcp 直接使用。npx playwright install chromium。--transport=http --host=0.0.0.0 --port=3000 启动。{
"mcpServers": {
"fetcher": {
"command": "npx",
"args": [
"-y",
"fetcher-mcp"
]
}
}
}