KimiClaw本地部署+手机部署教程:不想走云端API,配置步骤全解

公司内网环境想用KimiClaw但不能调外网API,想问下:

  1. KimiClaw能不能本地部署?不走Moonshot的云端API?
  2. 手机上能用KimiClaw吗?出差的时候想用手机看代码
  3. 如果能本地部署,具体的配置步骤是什么?

服务器配置:2卡RTX 4090 + 64G内存 + Ubuntu 22.04

KimiClaw(Kimi Code插件)本身不能脱离Moonshot API使用,但你可以通过OpenClaw框架实现类似的效果:

本地部署方案

KimiClaw的VS Code插件底层用的是OpenClaw协议,所以你可以:

  1. 部署本地模型(替代Moonshot API):
# 安装Ollama
curl -fsSL https://ollama.com/install.sh | sh

# 拉取编程模型(2卡4090够跑32B)
ollama pull qwen2.5-coder:32b

# 启动OpenAI兼容API
# Ollama默认就在 http://localhost:11434/v1
  1. 修改Kimi Code插件配置指向本地:
{
  "kimi-code.api.endpoint": "http://localhost:11434/v1",
  "kimi-code.api.key": "ollama",
  "kimi-code.api.model": "qwen2.5-coder:32b"
}
  1. 重启VS Code,补全和对话就走本地模型了。

注意:这种方式用的是本地模型不是Kimi的模型,所以128K长上下文的优势就没了(Qwen2.5-Coder-32B支持32K)。如果需要长上下文能力,可以试试部署Yi-Coder或DeepSeek-Coder-V2。

手机部署

严格来说不是"部署",而是远程访问:

  1. 服务器装code-server(网页版VS Code)
  2. 配好Kimi Code插件
  3. 手机浏览器访问code-server地址
  4. 就能在手机上用KimiClaw了

或者直接用Kimi App(手机端),虽然不是完整的KimiClaw体验,但代码问答够用。

你2卡4090 + 64G内存跑Qwen2.5-Coder-32B绰绰有余,推理速度也不错。

code-server手机访问方案+1。我就是这么用的,出差用iPad连公司服务器上的code-server,体验跟电脑差不多。建议配个域名+HTTPS+密码保护,直接暴露端口不安全。

补充一个方案:如果你不想折腾本地模型但又想在内网用,可以考虑走Moonshot API的专线接入

Moonshot有企业方案,可以通过专线/方式访问API,数据不走公网。价格比自建便宜(不用买GPU),而且能用到Kimi的128K长上下文能力。

当然要走采购流程就是了,适合公司有预算的情况。

@linuxjinrun 本地Ollama方案我试了,配置改完重启后确实能用了!补全速度还挺快的,2卡4090跑32B模型延迟在1秒以内。

就是像你说的,长上下文优势没了有点可惜。大文件还是得用云端的128K模型。

手机方案我也搞一下code-server,出差时候应急够用了。感谢!

关于本地模型的选择再说两句。如果你追求代码补全质量,Qwen2.5-Coder-32B确实是目前开源里最好的选择之一。但如果想兼顾对话能力(比如让AI帮你分析架构),建议用DeepSeek-V2.5,代码和对话能力都不错。

2卡4090只能跑到32B级别,想跑更大的模型就得上A100了。

提个安全提醒:code-server暴露到外网一定要加认证。建议用Nginx反代+Basic Auth或者配Tailscale 只允许内部访问。之前有人code-server裸奔被挖矿了…

本地部署不走云端是好但配置门槛不低

大米极客觉得颗粒度可以再细一点

Codex注册流程比想象中麻烦

这个对比测试样本量太小了20条不够起码200条才有参考价值