【OPM】通过工作流进一步检测设备可用性参考
【OPM】通过工作流进一步检测设备可用性参考
目的:设备可用性出现“问题”级别告警时,通过工作流 ping 4 个包验证设备是否确实 ping 不通,并对不同结果添加相应告警注释,设备可以 ping 通时自动清除本次告警。
配置步骤:
1.OPM web GUI->工作流->新建工作流:
2.拖动左侧设备-> ping 设备到指定箭头位置:
3.弹窗中可以调整的设置为:
请求数、数据包大小、超时时间、重试次数。
如无特殊需求,按照默认设置配置为 4、32、1、0 即可。
4.左侧OpManager 下,拖动添加告警注释到 Ping 设备结果为否的位置。
Ping 设备结果为否代表 ping 4 个包均请求超时。
5.在弹窗中,自定义编辑名称和注释内容。
例如名称更改为:确认设备Down
添加注释的内容编辑为:自动ping $DeviceField(ipAddress) 确认设备Down,请管理员立即检查!
6.再次拖动添加一个告警注释到 ping 设备,是处:
是代表设备可以 ping 通。
编辑告警注释名称为:验证设备Up
告警注释为:自动ping $DeviceField(ipAddress) 确认设备Up,自动清除本次告警
7.拖动 OpManager 下清除告警到验证设备Up下的箭头位置,并确认。
8.点击下一步,在设备选择中,将想要触发此工作流的设备添加到右侧清单中,可以过滤不同的业务视图、设备类型以便选择,设置完成后点击下一步:
9.配置触发器->选择告警触发器->勾选常规触发器下,当设备错过“要关注的”重要度,并到最下方点击下一步。
这里的条件选择说明有些问题,实际意义为:当设备出现“问题”(黄色叹号)可用性告警时。
10.给这个工作流自定义一个名称。
并选择是否添加描述、让这个工作流工作的时间、是否延迟执行、是否循环执行。
最后保存。
实际应用效果:
当出现设备“问题”级别可用性告警时,会立即触发 ping 对应设备 4 个包,若依然全部请求超时,则添加告警备注:
若设备可以 ping 通,则添加告警注释,并自动恢复此次告警:
在工作流日志中,会记录每次触发此工作流执行的过程和结果: