Monitor & alert
同じ仕事の両輪で、どちらも FPT Database Engine が管理する他の engine と同じように動作します。monitoring は自分で見に行くときのために metric と log を Grafana dashboard に表示し、alert rule は何かが起きたときに email または Telegram で知らせます。
備考
手順はすべての engine 共通で、一箇所にまとめてあります。
- Monitor database with FMON — workspace を統合し、Grafana で metric と log を確認します。
- Manage alert rules — alert rule の作成と管理、Telegram の channel ID の取得。
警告
Sharded Cluster では利用できません。詳細ページに Monitoring タブがなく、タブは Overview、Backup、Resource、Notification、Action logs のみです。Notification と alert の配信は機能しますが、Grafana dashboard は利用できません。
Monitoring
- monitoring は自分で有効化できません。FPT Support によるアカウントごとの有効化が必要です。有効化されるまで Monitor タブにはサポートへの連絡を促す画面が表示されるため、障害発生時ではなく事前に依頼してください。
- workspace の Integrate で metric と log の収集を開始し、Disintegrate で停止します。現在の状態は Integrated Status 列に表示されます。
- metric と log は Grafana で確認します。workspace 詳細ページの dashboard URL から開きます。log の data source は Loki です。
Alert
- alert の対象は backup と restore の結果、resource のしきい値、maintenance の通知です。
- Resource の alert では vCPU、RAM、storage のしきい値を設定します。いずれか 1 つを超えた時点で alert が発生するため、3 つとも超えると通知は 3 通届きます。
- recipient の設定は任意ではなく前提条件です。backup サービスは、recipient が 1 つもない状態では有効化できません。
警告
Telegram は Maintenance サービスに対応していません。maintenance の通知は、7 日前と 1 日前の 2 回の事前通知を含め、email でしか届きません。他を Telegram で受け取る場合でも、email の recipient を最低 1 つ設定してください。
次のステップ
- Maintenance Window の管理。maintenance の通知について
- resource 構成の変更。metric がボトルネックを示したとき