← 返回目录
V

Vexa MCP Server

官方
面向 Google Meet、Teams 与 Zoom 的开源会议机器人与实时转写 MCP 服务
GitHub 源仓库 ↗
★ 2.8k Stars 分类 · 团队协作 非常热门
57FMRS · C

Vexa 是由上游项目方维护的开源会议转写与机器人服务,以 MCP 形式暴露托管 streamable-http 端点(https://api.cloud.vexa.ai/mcp),需要 Bearer 形式的 Vexa API Key。它把机器人加入 Google Meet、Microsoft Teams 与 Zoom 的实时转写能力带给 AI 智能体,并支持完全自托管、Kubernetes 部署与隔离网络运行,采用 Apache-2.0 许可。适合需要数据主权、希望把会议内容编译为自有 Markdown 工作区的团队;不适合只需要托管 SaaS 的用户,或依赖尚未接线功能(中途改配置、机器人语音发言、WebSocket 多路复用)的场景。使用时需注意 API Key 保管、参会者知情同意与智能体对不可信输入的审批门控。

可靠性
9/20
安全与权限
10/20
维护活跃度
13/20
文档质量
14/20
安装易用性
11/20
查看 FMRS 评分方法 →

Vexa 是一个开源的会议机器人与实时转写服务,机器人可加入 Google Meet、Microsoft Teams 和 Zoom 通话,并以实时方式输出带说话人标注的转写内容。它提供 Meeting API(发送机器人、获取转写、录音)和 Agent API(工作区问答、定时例程、事件触发派发),并在网关的 /mcp 路径暴露 MCP 端点供 AI 智能体客户端使用。可自托管(Docker Compose 或 Kubernetes/OpenShift 上的 Helm),也可使用官方托管服务。源码以 Apache-2.0 许可发布,支持完全隔离(air-gapped)部署。

安装接入

  1. 托管方式:在 vexa.ai/signin 登录,从 vexa.ai/account 复制 API Key。
  2. 自托管方式:克隆仓库 https://github.com/Vexa-ai/vexa 并执行 make all(拉取已发布镜像并生成 .env、打印 API Key 与地址);make lite 为单容器轻量部署,make dev 为从源码构建。
  3. 默认需要语音转写(STT)能力:使用 vexa.ai/account 的免费令牌,或在 deploy/transcription 部署 GPU 转写服务并在 .env 中指向它;缺少 STT 时 POST /bots 返回 503。
  4. MCP 客户端连接地址为 https://api.cloud.vexa.ai/mcp(托管)或自托管网关的 /mcp 路径,使用 streamable-http 传输。
  5. 认证头:Authorization: Bearer <Vexa API key>,该请求头为必填且属于敏感凭证。
  6. 除 MCP 之外,也可以直接调用网关上的 HTTP API,使用 X-API-Key 认证。

选型与风险

适合谁

  • 希望自托管并完全掌控会议数据与转写内容的团队
  • 需要在隔离网络(air-gapped)中运行会议智能的受监管行业组织
  • 希望把会议转写接入自有 AI 智能体与知识库的开发者

不适合谁

  • 只想使用托管 SaaS 且不需要自托管的用户(自托管专属能力如智能体平面不包含在托管服务中)
  • 需要已完整支持中途修改机器人语言/任务或让机器人语音发言的用户(这些端点在开源核心中返回 404)
  • 需要官方保证 100% 说话人归因准确率的场景(严重串话时约 4–7% 的行会输出空说话人)

所需权限

  • 访问远程 MCP 端点需要 Vexa API Key(Authorization: Bearer 头,敏感凭证)
  • 调用 HTTP API 需要 X-API-Key 请求头
  • 自托管部署需要 Docker(建议引擎 ≥ v26)或 Kubernetes/OpenShift 集群
  • 如需转写需配置 STT 服务或使用托管令牌;如启用录音需对象存储(MinIO)

风险与副作用

  • API Key 泄露可能导致他人以此身份发送机器人、读取转写与派发智能体
  • 机器人加入会议会以参与者身份出现在通话中,需获得参会者知情与同意
  • 录音与转写内容可能包含敏感信息,自托管时可使用 MinIO 等自有存储以控制数据边界
  • 智能体处理不可信输入(邮件、网页)时应采用仅提议模式并保留人工审批,否则可能产生不可逆写入
  • 开源核心中中途修改机器人配置与语音发言端点当前返回 404,不应依赖这些能力

常见排障

  1. POST /bots 返回 503:通常是未配置语音转写(STT),请配置令牌或部署转写服务,或显式设置 transcribe_enabled=false 做纯采集
  2. MCP 连接失败:确认使用 streamable-http 传输、URL 正确且 Authorization: Bearer 头携带有效 API Key
  3. Agent API 返回的通用错误:确认使用 X-API-Key 认证,且身份由服务端根据密钥推导
  4. 实时转写查询:当前需轮询 GET /transcripts/{platform}/{native_meeting_id},WebSocket 多路复用仍属计划功能
  5. 调用 PUT /bots/{...}/config 或 POST /bots/{...}/speak 返回 404:这些能力在开源核心中尚未接线

使用场景

让机器人自动加入 Google Meet、Microsoft Teams 或 Zoom 会议并获取带说话人标注的实时转写
在会议进行中用 AI 智能体结合实时转写与自有工作区提问
通过定时(cron)例程生成晨间简报或会议纪要
在会议结束后自动派发一次性智能体输出报告、决议与行动项
以事件触发方式(如收到邮件)派发只读或仅可提议的智能体流程
浏览与读取以 Markdown(OKF kg/ 包)形式存储的工作区知识

支持客户端

Claude Code部分支持
Codex部分支持