← 返回目录
A

Ask LLM MCP Server

社区
让 AI 编程助手从另一个模型获得第二意见
分类
开发工具 第 133 / 438
Stars
★ 18 非常热门
传输方式
stdio(本地进程)
运行环境
Node.js 20+
凭据
可选 API Key
许可证
MIT
最近提交
工具数
14
59FMRS · C

Ask LLM 是一个由 Lykhoyda 维护的第三方 MIT 许可 MCP 服务器,提供统一的多模型编排能力,支持 Codex、Claude、Grok、Antigravity、Ollama 和 Gemini 等提供商,并附带 multi-llm 并行分发、诊断、用量统计与会话等实用工具。它适合已安装并登录相应提供商 CLI 的开发者用于代码审查和第二意见,但需要自行承担密钥配置、数据外传与按量计费风险;Gemini 的企业席位限制与 Antigravity 的实验状态也需注意。该项目为非官方工具,与相关模型厂商无隶属关系。

最强项 · 文档质量 14/20 最弱项 · 可靠性 9/20

可靠性
9/20
安全与权限
12/20
维护活跃度
11/20
文档质量
14/20
安装易用性
13/20
查看各项评分依据
可靠性 9/20
静态证据仅限 README 与 server.json 清单。清单结构完整(名称、版本 0.2.0、npm 包 @ask-llm/mcp、stdio 传输、16 个环境变量含默认值),声明的工具清单与 README 描述基本自洽。但未提供任何源代码、提交的单元测试或 CI 工作流文件内容,无法验证 MCP 初始化握手、工具 schema 与真实行为是否一致;6 个提供方 CLI(Codex/Claude/Grok/Cursor/Antigravity/Ollama/Gemini)与外部二进制的耦合、超时(默认 600000ms=10 分钟)与回退逻辑(Codex/Gemini 配额回退、Claude 过载回退)只在文档层面陈述,缺少可复现证据。按静态校准规则,可靠度上限 12,因关键路径缺乏可验证证据、错误路径仅文本描述,取 9。
安全与权限 12/20
安全设计在同清单中体现较清晰:密钥类变量(XAI_API_KEY、CURSOR_API_KEY)显式标记 isSecret: true;提供方默认采用只读式顾问模式(Claude 仅 Read/Glob/Grep、ask-cursor-agent 为 read-only ask 模式、Antigravity 默认 --sandbox),并明确声明 Ask LLM 不启用计费或额度、Grok 无 harness/模型回退、ASK_GROK_MAX_OUTPUT_TOKENS 默认 16384 用于限制意外开销。风险面仍存在:工具会把源码/仓库内容发送给第三方模型厂商(数据边界涉及外部网络),README 未在服务器清单层面给出统一的确认/披露机制;Codex 的 sessionId 持久化、Ollama 会话回放、Cursor Agent 与 agy CLI 的调用范围缺少源码级验证;11 个未解决 issue 的状态未知。未发现恶意代码、凭据窃取、隐蔽外传或安装示例含真实令牌等红线证据,故不触发 0-4 判定;但权限确认与数据流披露并不完整,取 12。
维护活跃度 11/20
许可证为 MIT,版本号 0.2.0,清单与 README 版本一致,README 展示 CI 与 release 徽章、迁移表(旧包名弃用映射)、贡献指南与文档站点,显示有维护意图与发布流程。扣分点:仅有 18 stars,存在 11 个未解决 issue 且无任何响应时效或处理状态证据;依赖(7 个各提供方 CLI 及多个 npm 包)的更新策略、安全响应渠道(SECURITY.md、披露流程)在给定材料中缺失;未提供提交历史、发布节奏或维护者身份的独立佐证。静态证据不足以支持高分,取 11。
文档质量 14/20
文档层次丰富:快速开始覆盖 Claude Code、Cursor、Codex CLI、Claude Desktop、Pi 与其他 STDIO 客户端;提供方选型表列出默认模型与回退模型、前置条件(Codex 账户、Claude Code CLI、XAI_API_KEY、AI Pro/Ultra、本地 Ollama、企业版 Gemini);明确披露 Gemini CLI 自 2026-06-18 起企业版限定并给出替代方案;包含工具参数说明(sessionId、outputSchema、usage://current-session 资源)、诊断命令(doctor 及 --json/--format)、成本与超时默认值、迁移映射、免责声明与 llms.txt。扣分点:模型名称(gpt-6-astra、grok-4.7、qwen3.8:27b 等)无法在给定材料中核对;缺少故障排查的逐条错误码说明;部分功能(codex-pair 的标记文件授权、Fable 模型验证限制)虽有披露但语义含混;文档内容来自仓库自述,属不可信证据,仅作分析对象。取 14。
安装易用性 13/20
安装路径清晰且步骤少:npx -y @ask-llm/mcp 一条命令接入 Claude Code,并给出 Cursor/Codex CLI/Claude Desktop 的多份客户端配置片段与 STDIO 通用写法;提供 doctor 诊断、REPL 与全局安装后 ask-llm-mcp 可执行文件的替代方式。扣分点:前置条件要求 Node.js 20+ 且仅声明支持 Linux/macOS,Windows 未提及;实际可用性依赖用户自行安装并认证多个外部提供方 CLI(Codex、Claude Code、agy>=1.1.5、gemini login、Ollama 本地模型),Ollama 需手动 pull、Gemini 受企业版限制,单提供方失败即影响对应工具;环境变量达 16 个,虽均非必填但增加配置复杂度;无安装成功的可验证证据。静态校准上限 15,故取 13。

静态评测 · 未实际运行评测于 2026-09-25

查看 FMRS 评分方法 →

选型与风险

能访问什么读取本地文件执行命令或代码访问网络

适合谁

  • 已安装并登录至少一个受支持提供商 CLI 或配置了相应 API 密钥的开发者
  • 希望在编码流程内获得跨模型代码审查与方案辩论的团队
  • 需要在本地或离线环境中进行私密评审的用户(Ollama)
  • 使用 Claude Code、Codex CLI、Cursor、Claude Desktop 等 MCP 客户端的用户

不适合谁

  • 没有安装任何提供商 CLI 或未配置密钥的用户(服务器不会代为提供模型能力)
  • 无法在机器上安装 Node.js 20+ 或不支持 Linux/macOS 的环境
  • 期望完全托管、免配置或官方支持的用户
  • 对数据外发有严格禁止、但又无法使用 Ollama 等本地提供商的场景

所需权限

  • 读取本地工作区文件的上下文(如 Claude 提供商的 Read/Glob/Grep 只读访问、Gemini 的 @ 文件语法)
  • 在本地启动并调用已安装的提供商 CLI(codex、claude、agy、gemini、agent 等)
  • 访问网络以调用 xAI API(使用 XAI_API_KEY 时)和本地 Ollama 服务(默认 http://localhost:11434)
  • 读取环境变量中的 API 密钥(如 XAI_API_KEY、CURSOR_API_KEY)
  • Cursor Agent 为只读 ask 模式,不更改 force/trust/花费设置

风险与副作用

  • 代码与提示内容可能被发送到外部模型提供商,产生数据外传风险;需要本地私密时可选择 Ollama
  • 使用 xAI API 等按量计费接口会产生真实费用,配置项 ASK_GROK_MAX_OUTPUT_TOKENS 只是上限而非免费保证
  • Grok 与 Ollama 不进行模型回退,可能在请求未满足时直接失败
  • Gemini CLI 自 2026-06-18 起仅限企业席位,非企业账户会收到提示而非输出
  • Antigravity 为实验性、一次性调用,稳定性有限
  • 插件中的 codex-pair 等连续评审流程可能持续触发外部调用与费用,需要显式标记和同意
  • 本工具为第三方非官方项目,与 Anthropic、Google、OpenAI、xAI 无隶属或背书关系

安装接入

准备工作

运行环境:Node.js 20+

XAI_API_KEY 可选密钥 xAI API 密钥,用于按量计费的 Grok 请求,可从 xAI 控制台获取;不设置也可使用其他提供商。
CURSOR_API_KEY 可选密钥 可选的 Cursor CLI 凭据,供 ask-cursor-agent 使用,替代 agent 登录。
其他可选配置项(14 个)
ASK_GROK_HARNESS 可选 指定 Grok 运行方式:xai-api(默认)或 grok-cli,二者之间不会自动切换。
ASK_GROK_MODEL 可选 所选 Grok 运行方式的精确模型覆盖值(API 与 CLI 默认均为 grok-4.7,无回退)。
ASK_GROK_REASONING_EFFORT 可选 Grok 推理强度,可选 low、medium、high 或 xhigh,默认 high。
ASK_GROK_MAX_OUTPUT_TOKENS 可选 xAI API 输出 token 上限,用于限制意外花费,默认 16384。
ASK_GROK_TIMEOUT_MS 可选 xAI API 请求超时时间(毫秒),默认 600000。
ASK_CURSOR_TIMEOUT_MS 可选 Cursor Agent 调用的超时时间(毫秒),默认 600000。
ASK_CLAUDE_MODEL 可选 默认 Claude 模型别名或完整模型名,默认 opus。
ASK_CLAUDE_FALLBACK_MODEL 可选 Opus 过载或不可用时使用的 Claude CLI 回退模型,默认 sonnet。
ASK_CLAUDE_TIMEOUT_MS 可选 Claude CLI 执行超时时间(毫秒),默认 600000(10 分钟)。
OLLAMA_HOST 可选 Ollama 服务器地址,默认 http://localhost:11434。
ASK_ANTIGRAVITY_TIMEOUT_MS 可选 Antigravity(agy)执行超时时间(毫秒),默认 300000(5 分钟)。
ASK_ANTIGRAVITY_SANDBOX 可选 设为 0 可去掉 agy 的 --sandbox 标志(当它阻碍 --add-dir 上下文读取时),默认开启沙箱。
GMCPT_TIMEOUT_MS 可选 CLI 执行超时时间(毫秒),默认 300000(5 分钟)。
GMCPT_LOG_LEVEL 可选 日志详细程度:debug、info、warn、error,默认 warn。
  1. 确认已安装 Node.js 20+(Linux 或 macOS),并至少安装并登录一个提供商 CLI。
  2. Claude Code:运行 claude mcp add --scope user ask-llm -- npx -y @ask-llm/mcp(全局安装 @ask-llm/mcp 后也可用 ask-llm-mcp)。
  3. Cursor:在 .cursor/mcp.json 或 ~/.cursor/mcp.json 中加入 {"mcpServers":{"ask-llm":{"command":"npx","args":["-y","@ask-llm/mcp"]}}}。
  4. Codex CLI:在 ~/.codex/config.toml 中加入 [mcp_servers.ask-llm] command = "npx", args = ["-y", "@ask-llm/mcp"]。
  5. Claude Desktop:在 claude_desktop_config.json 中加入同样的 mcpServers 配置。
  6. 其他 STDIO 客户端使用 {"command":"npx","args":["-y","@ask-llm/mcp"]}。
  7. 可选:设置 XAI_API_KEY、CURSOR_API_KEY 等环境变量;运行 npx @ask-llm/mcp doctor 检查配置。
.mcp.json
{"mcpServers":{"ask-llm":{"command":"npx","args":["-y","@ask-llm/mcp"]}}}

以 Claude Code 为例。其他客户端的配置文件位置或字段可能不同(如 VS Code 使用 servers 字段),可用下方配置生成器转换。

.vscode/mcp.json
{
  "servers": {
    "ask-llm": {
      "command": "npx",
      "args": [
        "-y",
        "@ask-llm/mcp"
      ]
    }
  }
}

写入项目的 .vscode/mcp.json(VS Code 使用 servers 字段)。

Terminal
claude mcp add ask-llm -- npx -y @ask-llm/mcp

在终端运行;先把 <…> 占位符换成你自己的值。

验证是否装好

安装后在客户端工具列表里应能看到 ask-llm、multi-llm、ping 等工具;输入“ask codex to review my last commit”,若 Codex 返回审查内容即说明连接成功。运行 npx @ask-llm/mcp doctor 可检查 Node 版本、PATH 与各提供商 CLI 是否存在。

常见排障

  1. 运行 npx @ask-llm/mcp doctor 检查 Node 版本、PATH 解析、提供商 CLI 是否存在及其版本
  2. 确认目标提供商 CLI 已安装并完成登录,或所需 API 密钥已通过环境变量传入
  3. 若 Codex 会话无法恢复,检查首次调用是否传入了 sessionId 为空字符串
  4. 若 Grok 请求失败,确认 ASK_GROK_HARNESS 与实际使用的 harness 一致,且不存在回退机制
  5. 若 Ollama 报错,按提示执行 ollama pull 拉取所需模型并确认 OLLAMA_HOST 正确
  6. 若 Antigravity 读取上下文被沙箱阻止,可设置 ASK_ANTIGRAVITY_SANDBOX=0 去掉 --sandbox 标志
  7. 若 Gemini 无输出,确认账户为企业 Gemini Code Assist 席位;订阅用户可改用 Antigravity
  8. 调整 ASK_*_TIMEOUT_MS 以应对超时(部分默认 600000 毫秒,部分 300000 毫秒)

试试这样问

连接成功后,可以直接对 AI 助手这样说:

  • 让 codex 审查 src/auth.ts 的安全问题
  • 让 claude 对这份架构给出独立意见
  • 用 multi-llm 比较 codex 和 grok 对这个方案怎么看
  • 让 ollama 解释 src/config.ts 的内容

工具能力 14

ask-llm 只读
统一编排工具:每次调用选择单个提供商,或并行分发到所有已安装的提供商
multi-llm 只读
将一个提示并行发送给多个提供商,一次调用返回各提供商的响应与用量
ask-codex 只读
通过 Codex CLI 提问,默认 GPT-6 Astra,Terra 作为回退;可省略 sessionId 临时使用,或首次传入 sessionId 为空字符串以持久化并恢复会话
ask-claude 只读
通过 Claude Code CLI 提问,默认 opus(Opus 5.5),Sonnet 回退;支持原生会话,工作区访问仅限 Read/Glob/Grep
ask-grok 只读
通过显式选择的 xai-api(默认)或 grok-cli 发送一次性 Grok 提示;使用精确的 harness 模型 ID,无 harness 或模型回退
ask-cursor-agent 只读
模型中立的 Cursor Agent harness:选择提供商(claude、codex、gemini、grok)并指定经该家族校验的精确 Cursor 目录模型;只读 ask 模式,不更改 force/trust/花费,无回退
ask-antigravity 只读
通过 Google Antigravity(agy)获取订阅支持的第二意见,实验性,一次性调用
ask-ollama 只读
本地 Ollama,完全私密、零成本;通过 sessionId 在服务端重放对话
展开其余 6 个工具
ask-gemini 只读
Gemini CLI,支持 @ 文件语法,1M+ token 上下文,通过 stream-json 实时渐进输出
ask-gemini-edit 写入
由 Gemini 返回结构化的 OLD/NEW 代码编辑块
fetch-chunk 只读
从缓存的大型响应中检索分块内容
get-usage-stats 只读
按会话统计 token 总量、回退次数以及按提供商/模型的细分;仅存于内存
diagnose 只读
自诊断:Node 版本、PATH 解析、提供商 CLI 是否存在及版本;只读
ping 只读
连接测试

使用场景

让 Codex 等模型审查代码改动或最近一次提交,发现主模型遗漏的问题
把架构或计划发给另一个模型进行批判、替代方案与权衡分析
在提交方案前获取独立于主模型的第二意见
用 Gemini 或 Antigravity 一次性读取整个代码库(1M+ token 上下文)
通过 Ollama 在本地完成评审,数据不出本机
用 multi-llm 并行比较多个模型对同一提示的回答

支持客户端

Claude Code
Claude Desktop
Cursor
Codex
Pi部分支持

依据项目文档列出,未经本站实测。

详细介绍

Ask LLM 是一个统一的 MCP 服务器,通过标准 MCP 协议让 Claude Code、Codex CLI、Cursor、Claude Desktop 等 40 多个 MCP 客户端调用 Gemini、Codex、Claude、Grok、Ollama 和 Antigravity 等其他模型,用于代码审查、方案辩论和第二意见。它支持多轮会话与结构化 AskResponse,提供诊断与用量统计等辅助工具,但需要用户自行安装并登录各提供商 CLI 或配置相应密钥,且为第三方非官方项目。

同类可选方案

Context7 80 · B

Upstash 官方维护,为 AI 编码助手提供实时更新的第三方库文档

★ 62.4k · 工具数 2 与当前对比 →

数据同步于 2026-09-25 查看 FMRS 评分方法