ヘルプ Kubernetes Kubernetes kubelet監視

Kubernetes kubelet監視

本ページは機械翻訳をもとに提供しています。正確かつ最新の情報は英語版の内容をご参照ください。

Kubernetes kubeletは、各ノード上のコンテナが正常に実行されていることを保証するノードエージェントです。
kubeletを監視することで、Podの起動失敗のトラブルシューティング、コンテナランタイムエラーの追跡、PLEG(Pod Lifecycle Event Generator)の停滞検出、クラスター全体での一貫したPodライフサイクル管理が可能になります。
Site24x7は、各Kubernetesノードで実行されているkubeletを自動的に検出し、監視します。

目次

仕組み

Site24x7エージェントは、各ノードから次のkubuletメトリクスを収集します。

  • kubeletプロセスのランタイムおよびプロセスレベルのメトリクス
  • Podのライフサイクルおよびコンテナの状態に関するメトリクス
  • コンテナランタイムの操作数、エラー、および所要時間
  • Podの起動とワーカー操作のタイミング
  • ストレージ操作の成功と失敗の追跡
  • Cgroupマネージャー操作の所要時間
  • PLEG(Pod Lifecycle Event Generator)の再リスト間隔と所要時間

これらのメトリクスは、スケジューリングの遅延、起動の失敗、コンテナランタイムのエラー、Podライフサイクルイベントのパフォーマンス低下を検出するのに役立ちます。

前提条件

kubelet監視を有効にする前に、Site24x7 Kubernetesエージェントをクラスターにインストールし、実行する必要があります。

Kubernetes kubulet監視の表示

エージェントをアップグレードするとすぐに、Site24x7 Kubernetes監視エージェントがすべてのkubulet監視メトリクスを取得します。

Kubernetes kubulet監視を表示するには:

  1. Site24x7アカウントにログインします。
  2. K8sに移動し、クラスター名を選択します。
  3. kubuletをクリックします。

これにより、特定のクラスター内のkubelet監視のリストが開きます。いずれかを選択すると、その監視に関する詳細なインサイトが表示されます。

サポートされるメトリック

サポートされるメトリックは以下の通りです。

使用率

メトリクス名 説明 単位
実行中のPod 最後のポーリング時間中に実行中のPodサンドボックスを持つPodの総数。 カウント
Pod起動数 最後のポーリング期間中に、kubeletがPodを初めて認識してからPodが実行を開始するまでのカウント。 カウント
RESTクライアントリクエスト合計 最後のポーリング期間中のHTTPリクエストの総数。 カウント
コンテナログファイルシステム使用量 最後のポーリング時間中に、ファイルシステム上でコンテナのログによって使用された合計バイト数。 バイト
プロセスCPU時間 最後のポーリング期間中にkubeletプロセスによって消費されたCPU時間。
プロセスオープンファイルディスクリプタ 最後のポーリング時間中に、kubeletプロセスによって開かれているファイルディスクリプタの数。 カウント
コンテナの状態
作成済み状態のコンテナ 最後のポーリング時間中に、現在作成済み状態にあるコンテナの数。 カウント
終了状態のコンテナ 最後のポーリング時間中に、現在終了状態にあるコンテナの数。 カウント
実行中状態のコンテナ 最後のポーリング時間中に、現在実行中状態にあるコンテナの数。 カウント
Pod起動時間
Pod起動時間の平均 最後のポーリング期間中に、kubeletがPodごとにPodを起動して実行するまでにかかった平均時間。
Pod起動時間の合計 最後のポーリング期間中に、kubeletがPodを起動して実行するまでにかかった合計時間。
ランタイム操作
kubuletランタイム操作 最後のポーリング期間中のランタイム操作の総数。 カウント
kubuletランタイム操作エラー 最後のポーリング期間中のランタイム操作エラーの総数。 カウント
ランタイム操作の所要時間
ランタイム操作の平均所要時間 最後のポーリング期間中のランタイム操作ごとにかかった平均時間。
ランタイム操作の合計所要時間 最後のポーリング期間中のランタイム操作にかかった合計時間。
プロセス・メモリー使用量
プロセス常駐メモリー 最後のポーリング期間中にkubeletプロセスによって使用された常駐メモリーサイズ(バイト単位)。 バイト
プロセス仮想メモリー 最後のポーリング期間中にkubeletプロセスによって使用された仮想メモリーサイズ(バイト単位)。 バイト
Go使用状況
Goスレッド 最後のポーリング期間中に、kubeletプロセス内のGoランタイムによって作成されたOSスレッドの数。 カウント
Goroutine 最後のポーリング期間中に、kubeletプロセスに現在存在するgoroutineの数。 カウント

操作

メトリクス名 説明 単位
Podワーカー起動 最後のポーリング期間中にワーカーを起動したPodの総数。 カウント
Cgroupマネージャー操作 最後のポーリング期間中のCgroupマネージャー操作の総数。 カウント
Podワーカー操作
Podワーカー操作 - 作成 最後のポーリング期間中に、kubeletが作成操作のために同期したPodの総数。 カウント
Podワーカー操作 - 同期 最後のポーリング期間中に、kubeletが同期操作のために同期したPodの総数。 カウント
Podワーカー操作 - 更新 最後のポーリング期間中に、kubeletが更新操作のために同期したPodの総数。 カウント
Podワーカー操作の所要時間
Podワーカー操作の平均所要時間 - 作成 最後のポーリング期間中に、kubeletが作成操作のためにPodごとに同期するのにかかった平均時間。
Podワーカー操作の平均所要時間 - 同期 最後のポーリング期間中に、kubeletが同期操作のためにPodごとに同期するのにかかった平均時間。
Podワーカー操作の平均所要時間 - 更新 最後のポーリング期間中に、kubeletが更新操作のためにPodごとに同期するのにかかった平均時間。
Podワーカー起動時間
Podワーカー起動時間の平均 最後のポーリング期間中に、kubeletがPodを認識してからワーカーを起動するまでにかかった平均時間。
Podワーカー起動時間の合計 最後のポーリング期間中に、kubeletがPodを認識してからワーカーを起動するまでにかかった合計時間。
ストレージ操作
ストレージ操作 - 成功 最後のポーリング期間中に、ステータスが成功だったストレージ操作の総数。 カウント
ストレージ操作 - 失敗 最後のポーリング期間中に、ステータスが失敗だったストレージ操作の総数。 カウント
ストレージ操作の所要時間
ストレージ操作の平均所要時間 - 成功 最後のポーリング期間中に、ステータスが成功だったストレージ操作ごとにかかった平均時間。
ストレージ操作の平均所要時間 - 失敗 最後のポーリング期間中に、ステータスがfail-unknownだったストレージ操作ごとにかかった平均時間。
Cgroupマネージャー操作の所要時間
Cgroupマネージャー操作の平均所要時間 最後のポーリング期間中のCgroupマネージャー操作ごとにかかった平均時間。
Cgroupマネージャー操作の合計所要時間 最後のポーリング期間中のCgroupマネージャー操作にかかった合計時間。

Pod Lifecycle Event Generator (PLEG)

メトリクス名 説明 単位
PLEG再リスト 最後のポーリング期間中のPLEGにおける再リストの総数。 カウント
PLEG最終確認 PLEGが最後にアクティブであったことが確認されたタイムスタンプ(秒)。 タイムスタンプ
PLEG最終確認からの経過時間 PLEGが最後にイベントを報告してからの経過時間(秒)。PLEGの停滞の可能性を示します。
PLEG破棄イベント 最後のポーリング期間中のPLEGにおける破棄イベントの数。 カウント
PLEG再リスト間隔
PLEG再リスト間隔の平均 最後のポーリング期間中に、PLEGでPodを再リストする間の平均時間。
PLEG再リスト間隔の合計 最後のポーリング期間中に、PLEGでPodを再リストする間の合計時間。
PLEG再リストの所要時間
PLEG再リストの平均所要時間 最後のポーリング期間中に、PLEGでPodを再リストするのにかかった平均時間。
PLEG再リストの合計所要時間 最後のポーリング期間中に、PLEGでPodを再リストするのにかかった合計時間。