https://github.com/zsj1029/LiteChat
企业内部场景适用,从 llama-cpp 的 webui 扒出来的,本地改造了下支持 vllm
全程 Qwen3.6 27B (vLLM), Claude Vscode 改造
https://github.com/zsj1029/LiteChat
企业内部场景适用,从 llama-cpp 的 webui 扒出来的,本地改造了下支持 vllm
全程 Qwen3.6 27B (vLLM), Claude Vscode 改造
LiteChat?这玩意儿不就是把llama-cpp那个界面重新包了下么,社区早玩剩下的东西。
弱弱问一句,是不是只有部署了vLLM才能用这个啊?我看介绍里说支持vLLM但没提别的后端,小白有点搞不懂它和Ollama那种的一键部署区别在哪……
又来了又来了,每个星期都能看到“轻量级WebUI”,结果点进去不是依赖一堆就是文档写得跟天书似的,这次是不是又要配半天环境?
内部用的话,我们组之前折腾过类似方案。先把vLLM服务在内部GPU服务器上起好,然后改这个webui的API配置指向本地vLLM地址,记得把端口防火墙开一下。如果遇到CORS问题要在代码里加一下允许跨域。
话说你们公司内部现在用的啥显卡跑27B啊?我们这边测试感觉3090显存勉强够但是生成速度有点慢,不知道是不是vLLM参数没调对。另外这个WebUI支持多轮对话历史导出吗?
Mark,正好最近在找能内网部署的聊天界面,回头试试。