问LLM
 ](https://github.com/Lykhoyda/ask-llm/releases) 
| 包 | 类型 | 版本 | 下载 |
|---|---|---|---|
ask-gemini-mcp | MCP服务器 | ](https://www.npmjs.com/package/ask-gemini-mcp) | ](https://www.npmjs.com/package/ask-gemini-mcp) |
ask-codex-mcp | MCP服务器 | ](https://www.npmjs.com/package/ask-codex-mcp) | ](https://www.npmjs.com/package/ask-codex-mcp) |
ask-ollama-mcp | MCP服务器 | ](https://www.npmjs.com/package/ask-ollama-mcp) | ](https://www.npmjs.com/package/ask-ollama-mcp) |
ask-llm-mcp | MCP服务器 | ](https://www.npmjs.com/package/ask-llm-mcp) | ](https://www.npmjs.com/package/ask-llm-mcp) |
@ask-llm/plugin | Claude代码插件 | ](https://github.com/Lykhoyda/ask-llm/releases) | /plugin install |
MCP服务器+用于AI到AI协作的Claude Code插件
MCP服务器将您的AI客户端与多个LLM提供商连接起来,实现AI到AI的协作。与Claude Code、Claude Desktop、Cursor、Warp、Copilot和 40+其他MCP客户端利用Gemini的1M+代币上下文、Codex的GPT-5.5或当地Olama模型——所有这些都是通过标准 主控程序.
为什么?
- 获取第二意见 --在提交之前,请另一个AI审查你的编码方法
- 辩论计划 --发送架构提案以征求意见和替代建议
- 审查变更 --让多个AI分析差异,以捕捉你的主要AI可能错过的问题
- 海量上下文 --Gemini读取会溢出其他模型的整个代码库(1M+令牌)
- 本地和私人 --在没有数据离开您的机器的情况下,使用Ollama进行评论
快速开始
克劳德代码
# All-in-one — auto-detects installed providers
claude mcp add --scope user ask-llm -- npx -y ask-llm-mcpOr install providers individually
claude mcp add --scope user gemini -- npx -y ask-gemini-mcp
claude mcp add --scope user codex -- npx -y ask-codex-mcp
claude mcp add --scope user ollama -- npx -y ask-ollama-mcp克劳德桌面
添加 claude_desktop_config.json:
{
"mcpServers": {
"ask-llm": {
"command": "npx",
"args": ["-y", "ask-llm-mcp"]
}
}
}Or install providers individually
{
"mcpServers": {
"gemini": {
"command": "npx",
"args": ["-y", "ask-gemini-mcp"]
},
"codex": {
"command": "npx",
"args": ["-y", "ask-codex-mcp"]
},
"ollama": {
"command": "npx",
"args": ["-y", "ask-ollama-mcp"]
}
}
}Cursor, Codex CLI, OpenCode, and other clients
光标 (.cursor/mcp.json):
{
"mcpServers": {
"ask-llm": { "command": "npx", "args": ["-y", "ask-llm-mcp"] }
}
}Codex CLI (~/.codex/config.toml):
[mcp_servers.ask-llm]
command = "npx"
args = ["-y", "ask-llm-mcp"]任何MCP客户端 (STDIO传输):
{ "command": "npx", "args": ["-y", "ask-llm-mcp"] }替换 ask-llm-mcp 和 ask-gemini-mcp, ask-codex-mcp,或 ask-ollama-mcp 对于单一供应商。
Claude代码插件
这 询问LLM插件 将多提供商代码审查、头脑风暴和自动挂钩直接添加到Claude code中:
/plugin marketplace add Lykhoyda/ask-llm
/plugin install ask-llm@ask-llm-plugins所得
| 特性 | 描述 |
|---|---|
/multi-review | 并行Gemini+Codex审查,包括4阶段验证管道和共识突出 |
/gemini-review | 仅限Gemini的带有置信度过滤的评论 |
/codex-review | 仅对食品法典委员会进行置信度过滤审查 |
/ollama-review | 本地审核-没有数据离开您的机器 |
/brainstorm | 多LLM头脑风暴:Claude Opus与外部提供商(Gemini/Copyro/Ollama)并行研究真实文件的主题,然后将所有发现与权重较高的验证结果进行综合 |
/compare | 来自多个提供者的并排原始响应,无需综合——当您想了解每个提供者如何表达相同的答案时 |
| 预提交挂钩 | 审查之前的阶段性变更 git commit,警告关键问题 |
审查代理使用受以下启发的4相管道 Anthropic的代码审查插件:收集上下文,通过明确的假阳性排除进行快速构建,对每个发现进行综合和源级验证。
请参阅 插件文档 了解详情。
先决条件
- **** v20.0.0或更高版本(LTS)
- 至少有一个提供商:
- Gemini CLI — npm install -g @google/gemini-cli && gemini login - Codex CLI --已安装并验证 - 奥拉玛 --使用拉取的模型在本地运行(ollama pull qwen2.5-coder:7b)
MCP工具
| 工具 | 包 | 目的 |
|---|---|---|
ask-gemini | ask gemini mcp | 向gemini CLI发送提示 @ 文件语法。1M+令牌上下文。实时渐进式输出 stream-json |
ask-gemini-edit | 询问gemini mcp | 从gemini获取结构化的旧/新代码编辑块 |
fetch-chunk | ask gemini mcp | 从缓存的大响应中检索块 |
ask-codex | ask codex mcp | 向codex CLI发送提示。GPT-5.5,配备迷你回退功能。通过以下方式恢复本机会话 sessionId |
ask-ollama | 询问ollama mcp | 向当地ollama发送提示。完全私人,零成本。服务器端对话回放 sessionId |
ask-llm | ask llm-mcp | 统一编排器--每次调用选择提供者。向所有已安装的提供商扇出 |
multi-llm | ask llm-mcp | 并行向多个提供者发送相同的提示;返回每个提供者的响应+一次调用中的使用情况 |
get-usage-stats | all | 每个会话令牌总数、回退计数、按提供者/模型细分——全部在内存中,没有持久性 |
diagnose | ask llm mcp | 自我诊断:节点版本、PATH解析、提供程序CLI存在+版本。只读 |
ping | all | 连接测试--验证MCP设置 |
全部 ask-* 工具接受可选 sessionId 用于多回合对话的参数,现在返回一个结构化的 AskResponse (提供者、响应、模型、会话ID、用法)通过MCP outputSchema 在人类可读的文本旁边。编排者(ask-llm-mcp)也暴露 usage://current-session 作为实时JSON快照的MCP资源。
用法示例
ask gemini to review the changes in @src/auth.ts for security issues
ask codex to suggest a better algorithm for @src/sort.ts
ask ollama to explain @src/config.ts (runs locally, no data sent anywhere)
use gemini to summarize @. the current directory
use multi-llm to compare what gemini and codex think about this approachCLI子命令
编排器二进制文件(ask-llm-mcp)除了默认的MCP服务器外,还支持两种CLI模式:
# Interactive multi-provider REPL — switch providers, persist sessions, see usage live
npx ask-llm-mcp repl
# Diagnose your setup — Node version, PATH, provider CLI versions, env vars
npx ask-llm-mcp doctor # human-readable
npx ask-llm-mcp doctor --json # machine-readable, exit 1 on errorREPL为每个提供商发送会话(/provider gemini, /provider codex, /new, /sessions, /usage)并继承所有执行器行为(配额回退、Gemini的流json输出、本机会话恢复)。
模型
| 提供者 | 默认值 | 回退 |
|---|---|---|
| 双子座 | gemini-3.1-pro-preview | gemini-3-flash-preview (按配额) |
| 食品法典委员会 | gpt-5.5 | gpt-5.5-mini (按配额) |
| 奥拉马 | qwen2.5-coder:7b | qwen2.5-coder:1.5b (如果未找到) |
所有提供者都会自动退回到错误较轻的模型。
文档
- 文档站点:
贡献
欢迎投稿!看 未解决的问题 为了工作。
许可证
MIT许可证。看 许可证 了解详情。
免责声明: 这是一个非官方的第三方工具,不隶属于谷歌或OpenAI,也不受其认可或赞助。
