监控中心
介绍
监控中心提供了轻量级的可用性监控,页面上方的 总览 实时展示各监控项的状态(可按分组、类型、名称过滤,自动刷新),下方为监控任务列表。

该模块提供了以下几种常用的监控类型:
-
站点检测
通过
GET请求指定的 url 匹配返回的状态码来确定站点是否异常,目前 200 - 399 之间状态码均为正常,否则为异常,默认请求超时时间为 30 秒;可以额外设置 响应时间 阈值,超过则视为异常。 -
端口检测
检测指定目标主机的 TCP 端口是否可以正常建立连接。
-
Ping 检测
使用
Ping检测目标主机是否存活,默认超时时间为 3 秒,在部署Spug的主机(或容器)上执行,需要安装ping命令。 -
进程检测
检测指定目标主机的某个进程是否存活,进程名称为执行
ps -ef看到的进程名称。 -
自定义脚本检测
在指定主机上运行自定义的脚本,通过判断返回的退出状态码是否为 0 来确定是否有异常。脚本执行中输出的内容将作为报警的描述信息,可利用此特性来灵活控制 报警的规则和报警的内容。
新建监控
1. 创建任务

- 监控分组:监控项的分组,可直接输入新的分组。
- 监控类型 / 监控名称:见上文。
- 监控地址 / 监控主机:站点检测填写 URL(可批量填写多个,以逗号或空格分隔);端口与 Ping 检测填写 IP / 域名;进程与自定义脚本检测选择主机管理中的主机,支持多选,一个监控项可以覆盖多个对象,减少重复的监控条目。
- 检测端口 / 进程名称 / 脚本内容:根据类型填写,脚本内容可以从批量执行模板中添加。
2. 设置规则

- 监控频率: 每隔多长时间检测一次,可选 1 / 5 / 15 / 30 / 60 分钟,默认 5 分钟。
- 报警阈值: 连续指定次数检测失败后才会触发报警,例如:报警阈值设置为 3,则表示当出现故障时连续 3 次检测都为失败的情况才触发报警。
- 报警联系人组: 报警联系人的集合,可以包含一个或多个报警联系人,在 报警联系组 中维护。
- 报警方式: 支持
微信、钉钉、邮件、企业微信、飞书,可多选。内置的微信和邮件报警服务需要关注下方服务号获取调用凭据,将调用凭据配置至系统设置 / 基本设置中的调用凭据;钉钉、企业微信、飞书使用群机器人;邮件也可以在系统设置 / 报警服务设置中配置自定义邮件服务。- 微信报警,需要设置报警联系人的 微信 Token
- 钉钉报警,需要设置报警联系人的钉钉机器人 URL(及加签密钥),请在钉钉群安全设置里面添加部署服务器的外网 IP,或者设置关键字
通知 - 飞书报警,需要设置报警联系人的飞书机器人 URL(及签名密钥)
- 企业微信报警,需要设置报警联系人的企业微信机器人 URL
- 邮件报警,需要设置报警联系人的邮箱地址
- 通道沉默: 相同的检测失败事件在通道沉默周期内只触发一次报警,避免过于频繁重复的报警信息,可选 5 / 10 / 15 / 30 / 60 分钟或 3 / 6 / 12 / 24 小时,默认 24 小时。例如:通道沉默设置为 5 分钟,第一次触发报警后,5 分钟内再次触发相同的报警信息则不会发送。
告警与恢复
- 达到报警阈值后发送 监控告警通知,故障恢复后发送 告警恢复通知(包含故障持续时间),两类事件都会记录在 报警历史 中。
- 通知发送失败(例如未配置调用凭据、联系人缺少对应渠道信息)会以系统通知的形式提示。
- 监控告警可以联动 任务计划:任务的触发器选择
监控告警并关联监控项,告警时自动执行任务实现故障自愈。
操作说明
- 列表中可以 启用 / 禁用 监控项,禁用后不再检测;编辑 时可修改全部配置;执行测试 可立即检测一次查看结果。
- 监控中心依赖
runmonitor与runworker后台服务,手动部署请参考 二开相关问题。
Spug 推送服务号
