适合谁
- 需要访问实时网页数据的AI开发者。
- 在Claude、Cursor或Windsurf中集成实时数据的用户。
- 需要结构化输出(HTML、Markdown、截图)的抓取任务。
- 需要异步大规模爬取并存储在云端的用户。
Crawlbase MCP Server为AI智能体提供实时网页数据抓取能力,集成简单,支持多种客户端,并具备异步存储功能。它适合需要新鲜数据的开发者,但注意依赖外部服务,且需配置Token。
Crawlbase MCP服务器是一个Model Context Protocol (MCP)服务器,连接AI智能体与实时网页。利用Crawlbase的爬取基础设施,使LLM能够获取新鲜、结构化的实时内容,深受超过70,000名开发者信赖。它处理了抓取的复杂性:JavaScript渲染、代理轮换与反爬绕过,以及结构化输出(HTML、Markdown、屏幕截图)。支持stdio和HTTP传输,并提供异步爬取和云存储功能。
your_token_here和your_js_token_here。npm install,然后使用环境变量设置Token并运行npm run start:http。{"mcpServers":{"crawlbase":{"type":"stdio","command":"npx","args":["@crawlbase/mcp@latest"],"env":{"CRAWLBASE_TOKEN":"your_token_here","CRAWLBASE_JS_TOKEN":"your_js_token_here"}}}}