Kubernetes監視のアラート

本ページは機械翻訳をもとに提供しています。正確かつ最新の情報は英語版の内容をご参照ください。

効果的なKubernetesの監視は、アプリケーションのパフォーマンスや可用性に影響が及ぶ前に、潜在的な問題をプロアクティブに特定して対処することに基づいています。Site24x7は、しきい値の設定を重要な要素として、堅牢なKubernetes監視機能を提供します。

しきい値を使用することで、さまざまなKubernetesリソースに対する許容パフォーマンスの制限を定義し、これらの制限を超えたときにアラートを受信できるため、迅速に是正措置を講じることが可能になります。

目次

Kubernetesでしきい値が重要な理由

Kubernetes監視にしきい値を使用することには、いくつかの利点があります。

  • パフォーマンスのボトルネックの早期検出:リソースの制約(CPU、メモリ、ディスクI/O)がアプリケーションのパフォーマンスに影響を与える前に特定します。

  • 潜在的な問題に対するプロアクティブなアラート:問題が大きなインシデントにエスカレートする前に、潜在的な問題に関する通知を受け取ります。

  • ダウンタイムの削減とアプリケーションの可用性の向上:問題が発生する前にアラートを受け取ることで、問題を迅速に解決し、ダウンタイムを最小限に抑えます。

  • リソース管理の改善:パフォーマンスデータとしきい値違反に基づいてリソース割り当てを最適化します。

しきい値設定

Site24x7では、サポートされているすべてのリソースタイプに対して、幅広いKubernetesメトリックにしきい値を設定できます。
監視対象のすべてのKubernetesリソースに対して、新しいしきい値プロファイルを作成するか、既存のプロファイルを関連付けることができます。

以下の手順でしきい値プロファイルを作成します。

  1. Site24x7にログインします。
  2. [K8s]→クラスターを選択→しきい値プロファイルに関連付けるKubernetesリソース監視に移動します。
  3. 表示名の横にあるハンバーガーアイコンにカーソルを合わせます。[編集]をクリックします。
  4. [設定プロファイル]→[しきい値と可用性]で、プラスアイコン[+]をクリックして新しいプロファイルを作成します。既存のプロファイルを編集するには、鉛筆アイコンをクリックします。
  5. [保存]をクリックします。

特定のKubernetesリソースのしきい値設定

Site24x7では、Kubernetes環境のさまざまなレベルでしきい値を設定できます。
ここでは、主要コンポーネントであるPodのサンプル設定を紹介します。

これらのクリティカルなメトリックには、CPU使用率、メモリ使用率、再起動回数、準備プローブの失敗などがあります。

サンプル設定1:

Podの再起動回数がしきい値を超えたときにアラートを設定する場合、Podの再起動回数が理想的なしきい値制限を超えたとき、およびリソース使用率が定義された制限を突破したときにアラートを受け取ることができます。

  1. Pod監視に移動し、ハンバーガーアイコン→[編集]をクリックします。
  2. [設定プロファイル]→[しきい値と可用性]で、プラスアイコン[+]をクリックして新しいプロファイルを作成します。既存のプロファイルを編集するには、鉛筆アイコンをクリックします。
  3. [しきい値プロファイル]のポップアップウィンドウで、[しきい値設定]の[しきい値の設定]ドロップダウンメニューから[再起動回数]を選択します。
  4. このしきい値設定には、以下の仕様を選択します。
    • メトリック:再起動回数
    • しきい値タイプ:静的しきい値
    • 深刻度レベル:クリティカル
    • しきい値カウント:5
    • 条件:超過

条件、しきい値カウント、ポーリング値を選択し、[保存]をクリックして変更を保存します。

サンプル設定2:

同様に、PodのCPU使用率が90%を超えたときにアラートを受け取ることができます。

上記の手順で[Kubernetes監視の編集]ページに移動し、このしきい値設定には以下の仕様を選択します。

    • メトリック:PodのCPU使用率
    • しきい値タイプ:静的しきい値
    • 深刻度レベル:クリティカル
    • しきい値:90%
    • 条件:超過

これを設定することで、PodのCPU使用率が90%を超えたときにアラートが通知されます。

また、Kubernetesコンポーネントの異なるレベルで特定のメトリックにしきい値を設定することもできます。例えば、Podから始まり、デプロイメントレベル、ネームスペース、ノード、またはクラスタレベルで、PodのCPU使用率のアラートを設定し、全体的な追跡を行うことができます。

同様に、以下を含むすべてのコンポーネントのすべての異なるしきい値属性に対してアラートを作成できます。

深刻度レベルの設定

しきい値を設定する際には、しきい値を超過したときにトリガーされるアラートに深刻度レベル(クリティカル、警告、トラブル)を割り当てる必要があります。問題の影響に基づいて深刻度レベルを選択してください。

  • ダウン:アプリケーションの可用性やパフォーマンスに直接影響し、即時の対応が必要な問題に使用します。
  • クリティカル:調査が必要ですが、現在アプリケーションの可用性に影響を与えていない潜在的な問題に使用します。
  • トラブル:監視が必要ですが、即時のアクションを必要としない軽微な問題や通常動作からの逸脱に使用します。

アラートメカニズム

Site24x7は、Eメール、SMS、Webhook、音声通話など、さまざまなアラートメカニズムを提供し、しきい値を超過した際に通知します。

Kubernetes監視において、しきい値の設定は極めて重要な要素です。適切な値を設定することで、アプリケーションのパフォーマンスや可用性に影響が及ぶ前に、潜在的な問題をプロアクティブに特定して対処することができます。