外观
Uptime Kuma:服务可用性监控
系统自带的监控关注硬件和存储,但一个卡死的应用,容器状态可能一直显示正常。Uptime Kuma 从外部定期请求每个服务,真正验证它还能不能用。
适合谁
跑了三个以上常驻服务,希望它们挂掉时能主动知道,而不是下次用到时才发现。
部署
yaml
services:
uptime-kuma:
image: louislam/uptime-kuma:1
container_name: uptime-kuma
restart: unless-stopped
ports:
- "3001:3001"
volumes:
- /vol1/docker/uptime-kuma/data:/app/data配置要点
- 检测间隔 60 秒通常足够,太频繁只增加负载。
- 设置「连续失败 N 次才告警」,避免网络抖动造成误报。
- 监控类型除了 HTTP,还支持 TCP 端口、Ping 和 DNS,按服务特性选。
- 通知渠道配好之后发一条测试消息确认能收到。
它监控不了自己所在的机器
如果 NAS 整体故障或断网,Uptime Kuma 也一起挂了,通知发不出来。要覆盖这种情况,需要把它部署在另一台设备上,或者使用外部的监控服务。至少要知道这个局限存在。
数据与备份
所有配置和历史数据在挂载的 /app/data 目录里(一个 SQLite 数据库)。备份时建议先停止容器再复制,避免数据库处于写入状态。
已知坑
- 监控项太多、间隔太短时,历史数据会持续增长,注意设置保留期限。
- 告警配置不当很容易造成告警疲劳,见监控与告警中的讨论。