跳转到内容

Uptime Kuma:服务可用性监控

系统自带的监控关注硬件和存储,但一个卡死的应用,容器状态可能一直显示正常。Uptime Kuma 从外部定期请求每个服务,真正验证它还能不能用。

适合谁

跑了三个以上常驻服务,希望它们挂掉时能主动知道,而不是下次用到时才发现。

部署

yaml
services:
  uptime-kuma:
    image: louislam/uptime-kuma:1
    container_name: uptime-kuma
    restart: unless-stopped
    ports:
      - "3001:3001"
    volumes:
      - /vol1/docker/uptime-kuma/data:/app/data

配置要点

  • 检测间隔 60 秒通常足够,太频繁只增加负载。
  • 设置「连续失败 N 次才告警」,避免网络抖动造成误报。
  • 监控类型除了 HTTP,还支持 TCP 端口、Ping 和 DNS,按服务特性选。
  • 通知渠道配好之后发一条测试消息确认能收到。

它监控不了自己所在的机器

如果 NAS 整体故障或断网,Uptime Kuma 也一起挂了,通知发不出来。要覆盖这种情况,需要把它部署在另一台设备上,或者使用外部的监控服务。至少要知道这个局限存在。

数据与备份

所有配置和历史数据在挂载的 /app/data 目录里(一个 SQLite 数据库)。备份时建议先停止容器再复制,避免数据库处于写入状态。

已知坑

  • 监控项太多、间隔太短时,历史数据会持续增长,注意设置保留期限。
  • 告警配置不当很容易造成告警疲劳,见监控与告警中的讨论。

参考资料

fnOS 非官方中文使用指南,与飞牛官方无隶属关系。