システム監視

Zabbixによる監視サービスの提供を行っております。

監視項目と障害対応

LinuxOS ポーリング周期
[sec]
障害判定基準
警告 障害
死活監視 pingによる疎通確認
(※1)
120 5秒以上応答なし
(2回リトライ)
リソース監視
(※2)
CPU CPU使用率
(iowait)
300 >= 70% >= 80%
CPU使用率
(irq)
300 >= 70% >= 80%
CPU使用率
(nice)
300 >= 70% >= 80%
CPU使用率
(softirq)
300 >= 70% >= 80%
CPU使用率
(system)
300 >= 70% >= 80%
CPU使用率
(user)
300 >= 70% >= 80%
メモリ メモリ使用率 300 >= 90% >= 95%
ディスク /(全パーティション)
使用率
300 >= 70% >= 80%
プロセス監視
(※3)
プロセス
存在監視
vsftpd 300 存在しない
sshd 300 存在しない
postfix 300 存在しない
qmail 300 存在しない
named 300 存在しない
httpd 300 存在しない
dovecot (※4) 300 存在しない
mysqld 300 存在しない
postgresql 300 存在しない
プロセス
応答監視
ftp応答
(vsftpd)
300 5秒以上応答なし
ssh応答
(sshd)
300 5秒以上応答なし
smtp応答
(postfix)
300 5秒以上応答なし
smtp応答
(qmail)
300 5秒以上応答なし
DNS応答
(named)
300 5秒以上応答なし
http応答
(httpd)
300 5秒以上応答なし
POP応答
(dovecot)(※4)
300 5秒以上応答なし
MySQL応答
(mysqld)
300 5秒以上応答なし
PostgreSQL応答
(postgresql)
300 5秒以上応答なし
(※1)この監視項目を設定するには、インターネットからのpingに応答するサーバーである必要があります。
(※2)しきい値を超えた場合にアラート通知を行うのみとなります。
(※3)障害状態検知時に関連プロセスの再起動を実行する項目です。再起動を実施できるのは起動スクリプトが存在し、”service サービス名 restart”の実行が可能なものです。
(※4)管理ツールPleskをご利用の場合、POPサーバーにdovecotを利用しないため監視できません。