适合谁
- 需要自托管、数据可控的网页抓取能力的团队
- 使用 Claude Code、Cursor、Codex、Gemini CLI、OpenCode 或 Windsurf 的开发者
- 希望以单个 Rust 二进制文件低资源运行的场景
- 需要 Firecrawl 兼容 REST API 的迁移项目
CRW Web Scraper(fastCRW)是一个用 Rust 编写的开源网页抓取与搜索 MCP 服务器,提供抓取、爬取、站点地图发现、搜索与结构化提取能力,并兼容 Firecrawl 的 /scrape、/crawl、/search API。它以单二进制、低内存占用和自托管为卖点,同时提供托管云选项,适合需要数据可控且希望接入 AI 智能体的开发者。需要注意的是,它并非 Firecrawl、Tavily 或 Anthropic 的官方项目,引擎采用 AGPL-3.0 许可,使用时需遵守目标网站政策与 robots.txt。
CRW Web Scraper(fastCRW)是一个用 Rust 编写的开源网页抓取、爬虫与搜索工具,并提供 MCP 服务器供 AI 智能体使用。它可以把 URL 转换成干净的 Markdown 或结构化 JSON,支持抓取(scrape)、爬取(crawl)、站点地图发现(map)、搜索(search)与结构化提取(extract)等操作。它提供与 Firecrawl 兼容的 API(/scrape、/crawl、/search),可自托管运行单个二进制文件(约 6 MB 内存占用),也可使用托管云服务。引擎与 MCP 服务器采用 AGPL-3.0 许可,Python 和 TypeScript SDK 采用 MIT 许可。该项目并非由 Firecrawl、Tavily 或 Anthropic 官方维护。
方式一(一键安装):运行 curl -fsSL https://fastcrw.com/install | sh,本地使用无需账号。若要连接云端,可在同一命令中传入密钥:curl -fsSL https://fastcrw.com/install | CRW_API_KEY=crw_live_... sh,安装脚本会在检测到的 AI 编码工具中注册 MCP 服务器。方式二(MCP 专用安装):运行 npx -y crw-mcp@latest install,在已检测到的 AI 工具中安装 CRW 技能与 MCP 服务器。也可单独运行 crw setup 进行交互式配置。容器方式:使用镜像 ghcr.io/us/crw:latest,以 stdio 传输启动,位置参数为 crw-mcp。