← 返回目录
M

Maxun MCP Server

官方
将任何网站转换为结构化 API
分类
开发工具 第 348 / 438
Stars
★ 17.8k 非常热门
传输方式
stdio(本地进程)
运行环境
Docker · Node.js · 远程托管(无需本地环境)
凭据
无需凭据
许可证
AGPL-3.0
最近提交
工具数
9
41FMRS · D

Maxun 提供了一个功能丰富的无代码数据提取平台,并集成了 MCP 支持。其亮点在于易用性和灵活性,允许通过记录操作或 AI 描述来创建机器人,而 MCP 服务器则将这些功能暴露给 AI 助手。不过,用户需要注意抓取的法律和合规风险,以及动态网站可能带来的稳定性问题。总体而言,它是一个有潜力的工具,但尚处早期阶段。

最强项 · 维护活跃度 12/20 最弱项 · 可靠性 5/20

可靠性
5/20
安全与权限
6/20
维护活跃度
12/20
文档质量
8/20
安装易用性
10/20
查看各项评分依据
可靠性 5/20
项目是一个完整的Web应用,而非独立MCP服务器。仓库中的MCP支持仅体现在README提及和可能的代码片段,未见服务器清单或专用MCP入口文件。静态审查无法验证MCP握手或工具行为,文档中也没有提供MCP配置示例。因此,可靠性得分上限为5。
安全与权限 6/20
该应用为自托管平台,涉及数据提取和可能的外部网络请求。源码未完整审查,但未发现明显的恶意行为。缺少明确的权限模型和危险操作确认机制,安全文档不足。因此,得分上限为6。
维护活跃度 12/20
仓库活跃,有大量stars和近期提交,未归档,使用AGPL-3.0许可证。有开放的issues,但缺少版本发布信息和安全响应渠道。因此,得分为12。
文档质量 8/20
README详尽,包含安装、用法和功能说明,有详细的文档站点链接。但作为MCP服务器,缺少MCP特定的使用说明、工具参数和故障排除。因此,得分为8。
安装易用性 10/20
提供Docker和本地安装方式,步骤清晰,有环境变量文档。但作为MCP服务器,缺少在MCP客户端中配置的示例,且需要自行搭建完整应用。因此,得分为10。

静态评测 · 未实际运行收录于 2026-08-07

查看 FMRS 评分方法 →

选型与风险

能访问什么访问网络控制浏览器

适合谁

  • 希望使用无代码方式从网站提取数据的非技术用户。
  • 希望将网页转换为结构化 API 的开发者,用于集成。
  • 需要自动化和定时抓取的个人和企业。
  • 希望自托管数据抓取基础设施的团队。

不适合谁

  • 需要处理反爬虫措施(如复杂验证码)的超大规模抓取,因为它主要模拟真实浏览器,但可能无法应对强反爬。
  • 需要严格实时抓取极快变化的网站。
  • 需要商业支持或已承诺 SLA 的生产环境。
  • 仅需要简单单页 HTML 抓取而不需要完整机器人功能的用户。

所需权限

  • 网络访问:连接到目标网站,打开页面、单击、填写表单等,因此需要能够访问互联网。
  • API 密钥:需要 Maxun 实例的 API 密钥以进行身份验证。
  • 数据访问:可能允许读取和提取网站内容,包括登录后的数据(如果配置了登录)。
  • 存储和调度:在某些配置中,可能需要权限来安排任务和存储提取的数据。

风险与副作用

  • 法律合规:抓取网站可能违反网站的服务条款或适用法律,特别是涉及个人数据时,你需要确保你拥有合法权利。
  • IP 封禁:抓取可能会触发目标网站的反爬机制,导致你的 IP 被临时或永久封禁。
  • 数据准确性:动态网站或布局更改可能导致提取失败或数据不准确。
  • 安全:自托管时需保护基础设施,避免 API 密钥泄露。相对于托管版本,数据存储在本地,需确保安全。

安装接入

准备工作

运行环境:Docker · Node.js · 远程托管(无需本地环境)

  1. 确保你有可用的 Maxun 实例(可以是托管的 app.maxun.dev 或自托管的 Docker/本地安装)。
  2. 通过 npm 或 pip 安装 MCP 服务器包(具体命令请参考官方文档或 npm/PyPI 发布页)。
  3. 配置环境变量,如 MAXUN_API_KEY 和 MAXUN_INSTANCE_URL(详见官方文档)。
  4. 在客户端配置中添加 MCP 服务器:例如在 Claude Desktop 的配置文件中添加 JSON 块,指定命令和参数。
  5. 重启客户端,你应能使用 Maxun MCP 工具。

验证是否装好

在客户端工具列表中确认出现 extract、scrape、crawl、search、get_robots 等工具;调用 get_robots 能返回(可能为空的)robot 列表即证明连接成功。

常见排障

  1. 连接失败:检查 Maxun 实例的 URL 是否可访问,API 密钥是否正确。
  2. 工具出错:确保机器人已提前在 Maxun 中创建,并且工具调用的参数正确。
  3. 提取失败:尝试在 Maxun 中重新录制机器人,或检查目标网站是否更改布局。
  4. 调度问题:确认时区和调度配置正确,检查 Maxun 日志。

试试这样问

连接成功后,可以直接对 AI 助手这样说:

  • 从 Airbnb 提取 10 条房源信息
  • 把 example.com 整页转成 Markdown 并截图
  • 爬取 example.com 全站并提取每个页面的内容
  • 搜索过去一周关于 AI 的新闻结果

工具能力 9

extract 只读
从网页中提取结构化数据(支持模式:记录、AI)。
scrape 只读
将整个网页转换为干净的 Markdown 或 HTML,并可截取屏幕截图。
crawl 只读
爬取整个网站,并从每个相关页面提取内容,可控制范围和发现逻辑。
search 只读
执行自动化的网络搜索,以发现或抓取结果,支持基于时间过滤。
schedule_run 写入
安排机器人运行,实现定时自动化。
get_robot_run 只读
获取特定机器人运行的详细信息。
get_robot_runs 只读
列出机器人运行历史。
get_robot 只读
获取特定机器人的配置。
展开其余 1 个工具
get_robots 只读
获取所有可用机器人的列表。

使用场景

市场研究:收集竞争对手信息、价格和评论。
潜在客户生成:从目录获取联系信息。
内容聚合:从多个来源抓取文章内容。
数据监控:定时跟踪网页变化。
AI 应用:为 RAG 或 LLM 准备干净的文本数据。

支持客户端

Claude Desktop

依据项目文档列出,未经本站实测。

详细介绍

Maxun 是一个开源的无代码网络数据平台,支持从真实网站中提取、抓取、爬取和搜索结构化数据。它结合了 Playwright 浏览器自动化与可选 AI(LLM)驱动,提供 Recorder 和 AI 模式,让你无需编程即可创建可复用的机器人。你还可以通过 RESTful API、SDK 或 CLI 访问数据,并支持定时运行、分页处理、登录后抓取等功能。项目采用 AGPL-3.0 许可,可自托管。

同类可选方案

Context7 80 · B

Upstash 官方维护,为 AI 编码助手提供实时更新的第三方库文档

★ 62.9k · 工具数 2 与当前对比 →

源版本 1ec47a5aa8ab 数据同步于 2026-10-11 查看 FMRS 评分方法