适合谁
- 已将Claude Code用于大型重构、希望降低令牌费用的开发者。
- 拥有本地GPU服务器并希望利用本地模型处理重复任务的用户。
- 需要从Claude卸载边界清晰且时间要求不高的任务。
- 熟悉MCP和OpenAI兼容API的开发者。
Houtini LM为Claude Code用户提供了一种实用的令牌节省方案,通过将边界清晰的任务卸载到本地或云端LLM。它提供了自主模型路由、性能跟踪和结构化输出支持,显着减少了Claude的令牌消耗。对于希望控制成本的开发者来说,这是一个有价值的工具,但需要注意安全风险并确保正确配置。
Houtini LM是一个MCP服务器,它连接Claude Code到任何兼容OpenAI的LLM端点(如LM Studio、Ollama、vLLM、DeepSeek、Groq、Cerebras),通过将边界清晰的任务(如生成样板代码、代码审查、提交消息、格式转换等)委托给更便宜的本地或云端模型,从而节省Claude的令牌消耗。Claude保留架构规划、多文件更改等复杂推理工作,而本地模型处理重复性工作。它提供自动模型路由、性能跟踪、结构化JSON输出和模型发现功能。
{
"mcpServers": {
"houtini-lm": {
"command": "npx",
"args": [
"-y",
"@houtini/lm"
],
"env": {
"HOUTINI_LM_ENDPOINT_URL": "http://localhost:1234"
}
}
}
}