直接答案
可用性监控应验证用户真正需要的 HTTP、登录或 API 路径;Ping 成功不代表业务可用。
按这个顺序执行
- 选一个无副作用健康任务
完成后保存时间、环境与结果;一次只改变这个变量,失败样本也保留。 - 从外部网络定期执行
完成后保存时间、环境与结果;一次只改变这个变量,失败样本也保留。 - 记录状态码与延迟
完成后保存时间、环境与结果;一次只改变这个变量,失败样本也保留。 - 为连续失败而非单点设告警
完成后保存时间、环境与结果;一次只改变这个变量,失败样本也保留。
服务可用性监控记录卡
固定项:账号、设备、版本、目标与任务。
变量:每轮只修改步骤中的一项。
结果:同时写成功、失败、耗时与恢复动作。
结论边界:仅适用于本次记录的地区、网络、时段和版本。
怎样做决定
告警能对应明确负责人和处置动作才保留。
容易误判的边界
监控请求不要包含真实用户数据。
这项结论不应被扩大成所有城市、所有运营商、所有账号或长期表现。涉及价格、地区、版本和政策时,请在操作当天重新核对官方页面。
官方来源与适用范围
Atlassian Statuspage 文档
状态页、事件和通知机制;核验日期 2026-09-07。
状态页、事件和通知机制;核验日期 2026-09-07。
DigitalOcean Monitoring
主机指标、告警和监控边界;核验日期 2026-09-07。
主机指标、告警和监控边界;核验日期 2026-09-07。