感谢论坛大佬 @那个红色头像的 https://www.nodeseek.com/post-625116-1 这篇帖子给与灵感和点子..
我通过chatgpt 5.3 codex 也完成了类似功能的openclaw探针.现在免费分享.大家自取.欢迎fork二开.本人不保留版权.
以下是 5.3 AI整理发布.
一个可对接 OpenClaw 的多节点监控与告警面板(Node.js + SQLite + WebSocket)
仓库:https://github.com/llw2011/oc-monitor
这次我把项目从“自己能用”整理成了“别人也能直接复用”的开源版本,重点不是炫技,而是解决实际运维痛点。
它到底是干什么的?
OC-Monitor 里最核心的是 探针(Agent)+ 看板(Dashboard):
• 探针持续上报每台节点的心跳和资源指标(CPU/内存/磁盘/Swap)
• 服务端统一汇总并实时推送
• 看板负责告警展示、确认(ACK)、静默(Mute)、审计追踪
一句话:
它是 OpenClaw 的外部监控治理层,不替代 OpenClaw,本质是给多节点运行加“可观测+可追责+可处理”的闭环。
对接 OpenClaw 的价值(重点)
如果你是单机/多机跑 OpenClaw,这套东西能直接解决:
- 统一监控:不用逐台 SSH 看状态
- 故障前置:离线、心跳延迟、资源高占用会进入告警中心
- 处理闭环:告警可 ACK/静默,行为可审计
- 分享友好:配置已外置化,适合公开仓库和第三方部署
版本演进(V0 → V3.1)
• V0:冻结范围,避免乱扩需求
• V1:MVP 跑通(注册、心跳、节点看板、日志、WS)
• V2:UI 与权限升级(脱敏视图、token 解锁、admin 会话)
• V2.5:稳态化(告警中心、审计、留存、健康总览、ACK/静默)
• V3.1:通知引擎基线(critical 告警 Telegram 推送,默认关闭)
已落地功能
• 多节点状态总览
• Provider 健康矩阵
• 实时日志流
• 告警中心(offline/stale/cpu/mem/disk)
• 告警 ACK / 静默
• 管理员登录与审计导出
• 数据留存与自动清理
• 健康总览
• 可选 Telegram critical 告警通知
快速启动
git clone https://github.com/llw2011/oc-monitor.git
cd oc-monitor
cp .env.example .env
cd server
npm install
node index.js
文档入口
• 中文首页:README.md
• 英文说明:README-English.md
• 演进记录:docs/EVOLUTION_V0_TO_V31.md
• Scope:docs/v1-scope.md / docs/v2-scope.md / docs/v3.1-scope.md
• 完整安装:docs/INSTALL_FULL_ZH.md
跪一个先
帮顶
先赞后看
有演示没
@linbei #5
没有演示,在仓库readme有演示图片.
当然你可以先让机器人审计一下代码然后本地先部署测试一下.
厉害,很棒。顶一个