← 返回目录
M

MCP Read Website Fast

社区
快速、令牌高效的网页内容提取,将网站转换为干净的 Markdown。
GitHub 源仓库 ↗
★ 161 Stars 分类 · 浏览器自动化 非常热门 源版本 60695461eb99
51FMRS · D
可靠性
7/20
安全与权限
10/20
维护活跃度
7/20
文档质量
14/20
安装易用性
13/20

轻量、快速的 MCP 服务器,适用于网页抓取和 Markdown 转换,但存在访问限制和缓存管理方面的潜在问题。

查看 FMRS 评分方法 →

为 AI 代理提供快速、令牌高效的网页内容提取,将网站转换为干净的 Markdown,保留链接,并支持智能缓存、robots.txt 和可配置的爬取深度。

工具能力

read_website
获取网页并转换为干净的 Markdown。可配置最大爬取页面数(默认1,最大100)。

安装接入

在 Claude Code 中:claude mcp add read-website-fast -s user -- npx -y @just-every/mcp-read-website-fast。对于其他客户端,复制提供的 JSON 配置到 mcp.json。

claude_desktop_config.json
{
  "mcpServers": {
    "read-website-fast": {
      "command": "npx",
      "args": [
        "-y",
        "@just-every/mcp-read-website-fast"
      ]
    }
  }
}

选型与风险

适合谁

  • Claude Code 用户
  • 需要频繁读取网页的 AI 代理
  • 注重令牌效率和速度的开发者

不适合谁

  • 需要 JavaScript 渲染的网站
  • 需要复杂身份验证的站点
  • 非技术用户(需要命令行操作)

所需权限

  • 网络访问以获取 URL
  • 文件系统访问以缓存(.cache 目录)
  • 运行 npx 命令

风险与副作用

  • 某些网站会阻止自动化访问
  • 由于依赖外部服务,可能存在令牌消耗
  • 跨域爬取(默认关闭)可能违反网站条款

常见排障

  1. 缓存问题:运行 `npm run dev clear-cache`
  2. 超时错误:增加 `-t` 超时值,检查网络连接
  3. 内容未提取:尝试自定义 user agent(`-u`),确保网站不需要 JavaScript

使用场景

快速抓取网页内容用于 LLM 处理
从多个页面构建知识图谱
内容爬取(遵守 robots.txt)

支持客户端

Claude Desktop完整支持
VS Code完整支持
Cursor完整支持
JetBrains IDEs完整支持