单实例的 OpenClaw 有单点故障风险。对于团队使用场景,高可用部署很有必要。
架构设计
[Nginx LB]
├── [OpenClaw 实例 1] ──→ [Redis(共享会话)]
├── [OpenClaw 实例 2] ──→ [Redis(共享会话)]
└── [OpenClaw 实例 3] ──→ [Redis(共享会话)]
↓
[共享存储 NFS/S3]
核心要点:
- 用 Redis 共享会话状态
- 用 NFS 或 S3 共享数据目录
- Nginx 做负载均衡(upstream round-robin)
Redis 会话共享
session:
store: redis
redis:
host: redis.internal
port: 6379
password: your-redis-password
db: 0
Nginx 配置
upstream openclaw {
server 10.0.1.1:18789;
server 10.0.1.2:18789;
server 10.0.1.3:18789;
}
注意事项
- Skill 的执行状态也要放 Redis,不然不同实例之间会冲突
- 建议 3 个实例起步,2 个实例没有容错能力
- 监控要覆盖所有实例,用 Prometheus + Grafana
部署完测试了一下,kill 掉一个实例,服务完全无感知。