公司内网环境想用KimiClaw但不能调外网API,想问下:
- KimiClaw能不能本地部署?不走Moonshot的云端API?
- 手机上能用KimiClaw吗?出差的时候想用手机看代码
- 如果能本地部署,具体的配置步骤是什么?
服务器配置:2卡RTX 4090 + 64G内存 + Ubuntu 22.04
公司内网环境想用KimiClaw但不能调外网API,想问下:
服务器配置:2卡RTX 4090 + 64G内存 + Ubuntu 22.04
KimiClaw(Kimi Code插件)本身不能脱离Moonshot API使用,但你可以通过OpenClaw框架实现类似的效果:
KimiClaw的VS Code插件底层用的是OpenClaw协议,所以你可以:
# 安装Ollama
curl -fsSL https://ollama.com/install.sh | sh
# 拉取编程模型(2卡4090够跑32B)
ollama pull qwen2.5-coder:32b
# 启动OpenAI兼容API
# Ollama默认就在 http://localhost:11434/v1
{
"kimi-code.api.endpoint": "http://localhost:11434/v1",
"kimi-code.api.key": "ollama",
"kimi-code.api.model": "qwen2.5-coder:32b"
}
注意:这种方式用的是本地模型不是Kimi的模型,所以128K长上下文的优势就没了(Qwen2.5-Coder-32B支持32K)。如果需要长上下文能力,可以试试部署Yi-Coder或DeepSeek-Coder-V2。
严格来说不是"部署",而是远程访问:
或者直接用Kimi App(手机端),虽然不是完整的KimiClaw体验,但代码问答够用。
你2卡4090 + 64G内存跑Qwen2.5-Coder-32B绰绰有余,推理速度也不错。
code-server手机访问方案+1。我就是这么用的,出差用iPad连公司服务器上的code-server,体验跟电脑差不多。建议配个域名+HTTPS+密码保护,直接暴露端口不安全。
补充一个方案:如果你不想折腾本地模型但又想在内网用,可以考虑走Moonshot API的专线接入。
Moonshot有企业方案,可以通过专线/方式访问API,数据不走公网。价格比自建便宜(不用买GPU),而且能用到Kimi的128K长上下文能力。
当然要走采购流程就是了,适合公司有预算的情况。
@linuxjinrun 本地Ollama方案我试了,配置改完重启后确实能用了!补全速度还挺快的,2卡4090跑32B模型延迟在1秒以内。
就是像你说的,长上下文优势没了有点可惜。大文件还是得用云端的128K模型。
手机方案我也搞一下code-server,出差时候应急够用了。感谢!
关于本地模型的选择再说两句。如果你追求代码补全质量,Qwen2.5-Coder-32B确实是目前开源里最好的选择之一。但如果想兼顾对话能力(比如让AI帮你分析架构),建议用DeepSeek-V2.5,代码和对话能力都不错。
2卡4090只能跑到32B级别,想跑更大的模型就得上A100了。
提个安全提醒:code-server暴露到外网一定要加认证。建议用Nginx反代+Basic Auth或者配Tailscale 只允许内部访问。之前有人code-server裸奔被挖矿了…
本地部署不走云端是好但配置门槛不低
大米极客觉得颗粒度可以再细一点
Codex注册流程比想象中麻烦
这个对比测试样本量太小了20条不够起码200条才有参考价值