ヘルプ Kubernetes Kubernetes kubelet監視
Kubernetes
kubeletは、各ノード上のコンテナが正常に実行されていることを保証するノードエージェントです。
kubeletを監視することで、Podの起動失敗のトラブルシューティング、コンテナランタイムエラーの追跡、PLEG(Pod Lifecycle Event Generator)の停滞検出、クラスター全体での一貫したPodライフサイクル管理が可能になります。
Site24x7は、各Kubernetesノードで実行されているkubeletを自動的に検出し、監視します。
Site24x7エージェントは、各ノードから次のkubuletメトリクスを収集します。
これらのメトリクスは、スケジューリングの遅延、起動の失敗、コンテナランタイムのエラー、Podライフサイクルイベントのパフォーマンス低下を検出するのに役立ちます。
kubelet監視を有効にする前に、Site24x7 Kubernetesエージェントをクラスターにインストールし、実行する必要があります。
エージェントをアップグレードするとすぐに、Site24x7 Kubernetes監視エージェントがすべてのkubulet監視メトリクスを取得します。
Kubernetes kubulet監視を表示するには:
これにより、特定のクラスター内のkubelet監視のリストが開きます。いずれかを選択すると、その監視に関する詳細なインサイトが表示されます。
サポートされるメトリックは以下の通りです。
| メトリクス名 | 説明 | 単位 |
|---|---|---|
| 実行中のPod | 最後のポーリング時間中に実行中のPodサンドボックスを持つPodの総数。 | カウント |
| Pod起動数 | 最後のポーリング期間中に、kubeletがPodを初めて認識してからPodが実行を開始するまでのカウント。 | カウント |
| RESTクライアントリクエスト合計 | 最後のポーリング期間中のHTTPリクエストの総数。 | カウント |
| コンテナログファイルシステム使用量 | 最後のポーリング時間中に、ファイルシステム上でコンテナのログによって使用された合計バイト数。 | バイト |
| プロセスCPU時間 | 最後のポーリング期間中にkubeletプロセスによって消費されたCPU時間。 | 秒 |
| プロセスオープンファイルディスクリプタ | 最後のポーリング時間中に、kubeletプロセスによって開かれているファイルディスクリプタの数。 | カウント |
| コンテナの状態 | ||
| 作成済み状態のコンテナ | 最後のポーリング時間中に、現在作成済み状態にあるコンテナの数。 | カウント |
| 終了状態のコンテナ | 最後のポーリング時間中に、現在終了状態にあるコンテナの数。 | カウント |
| 実行中状態のコンテナ | 最後のポーリング時間中に、現在実行中状態にあるコンテナの数。 | カウント |
| Pod起動時間 | ||
| Pod起動時間の平均 | 最後のポーリング期間中に、kubeletがPodごとにPodを起動して実行するまでにかかった平均時間。 | 秒 |
| Pod起動時間の合計 | 最後のポーリング期間中に、kubeletがPodを起動して実行するまでにかかった合計時間。 | 秒 |
| ランタイム操作 | ||
| kubuletランタイム操作 | 最後のポーリング期間中のランタイム操作の総数。 | カウント |
| kubuletランタイム操作エラー | 最後のポーリング期間中のランタイム操作エラーの総数。 | カウント |
| ランタイム操作の所要時間 | ||
| ランタイム操作の平均所要時間 | 最後のポーリング期間中のランタイム操作ごとにかかった平均時間。 | 秒 |
| ランタイム操作の合計所要時間 | 最後のポーリング期間中のランタイム操作にかかった合計時間。 | 秒 |
| プロセス・メモリー使用量 | ||
| プロセス常駐メモリー | 最後のポーリング期間中にkubeletプロセスによって使用された常駐メモリーサイズ(バイト単位)。 | バイト |
| プロセス仮想メモリー | 最後のポーリング期間中にkubeletプロセスによって使用された仮想メモリーサイズ(バイト単位)。 | バイト |
| Go使用状況 | ||
| Goスレッド | 最後のポーリング期間中に、kubeletプロセス内のGoランタイムによって作成されたOSスレッドの数。 | カウント |
| Goroutine | 最後のポーリング期間中に、kubeletプロセスに現在存在するgoroutineの数。 | カウント |
| メトリクス名 | 説明 | 単位 |
|---|---|---|
| Podワーカー起動 | 最後のポーリング期間中にワーカーを起動したPodの総数。 | カウント |
| Cgroupマネージャー操作 | 最後のポーリング期間中のCgroupマネージャー操作の総数。 | カウント |
| Podワーカー操作 | ||
| Podワーカー操作 - 作成 | 最後のポーリング期間中に、kubeletが作成操作のために同期したPodの総数。 | カウント |
| Podワーカー操作 - 同期 | 最後のポーリング期間中に、kubeletが同期操作のために同期したPodの総数。 | カウント |
| Podワーカー操作 - 更新 | 最後のポーリング期間中に、kubeletが更新操作のために同期したPodの総数。 | カウント |
| Podワーカー操作の所要時間 | ||
| Podワーカー操作の平均所要時間 - 作成 | 最後のポーリング期間中に、kubeletが作成操作のためにPodごとに同期するのにかかった平均時間。 | 秒 |
| Podワーカー操作の平均所要時間 - 同期 | 最後のポーリング期間中に、kubeletが同期操作のためにPodごとに同期するのにかかった平均時間。 | 秒 |
| Podワーカー操作の平均所要時間 - 更新 | 最後のポーリング期間中に、kubeletが更新操作のためにPodごとに同期するのにかかった平均時間。 | 秒 |
| Podワーカー起動時間 | ||
| Podワーカー起動時間の平均 | 最後のポーリング期間中に、kubeletがPodを認識してからワーカーを起動するまでにかかった平均時間。 | 秒 |
| Podワーカー起動時間の合計 | 最後のポーリング期間中に、kubeletがPodを認識してからワーカーを起動するまでにかかった合計時間。 | 秒 |
| ストレージ操作 | ||
| ストレージ操作 - 成功 | 最後のポーリング期間中に、ステータスが成功だったストレージ操作の総数。 | カウント |
| ストレージ操作 - 失敗 | 最後のポーリング期間中に、ステータスが失敗だったストレージ操作の総数。 | カウント |
| ストレージ操作の所要時間 | ||
| ストレージ操作の平均所要時間 - 成功 | 最後のポーリング期間中に、ステータスが成功だったストレージ操作ごとにかかった平均時間。 | 秒 |
| ストレージ操作の平均所要時間 - 失敗 | 最後のポーリング期間中に、ステータスがfail-unknownだったストレージ操作ごとにかかった平均時間。 | 秒 |
| Cgroupマネージャー操作の所要時間 | ||
| Cgroupマネージャー操作の平均所要時間 | 最後のポーリング期間中のCgroupマネージャー操作ごとにかかった平均時間。 | 秒 |
| Cgroupマネージャー操作の合計所要時間 | 最後のポーリング期間中のCgroupマネージャー操作にかかった合計時間。 | 秒 |
| メトリクス名 | 説明 | 単位 |
|---|---|---|
| PLEG再リスト | 最後のポーリング期間中のPLEGにおける再リストの総数。 | カウント |
| PLEG最終確認 | PLEGが最後にアクティブであったことが確認されたタイムスタンプ(秒)。 | タイムスタンプ |
| PLEG最終確認からの経過時間 | PLEGが最後にイベントを報告してからの経過時間(秒)。PLEGの停滞の可能性を示します。 | 秒 |
| PLEG破棄イベント | 最後のポーリング期間中のPLEGにおける破棄イベントの数。 | カウント |
| PLEG再リスト間隔 | ||
| PLEG再リスト間隔の平均 | 最後のポーリング期間中に、PLEGでPodを再リストする間の平均時間。 | 秒 |
| PLEG再リスト間隔の合計 | 最後のポーリング期間中に、PLEGでPodを再リストする間の合計時間。 | 秒 |
| PLEG再リストの所要時間 | ||
| PLEG再リストの平均所要時間 | 最後のポーリング期間中に、PLEGでPodを再リストするのにかかった平均時間。 | 秒 |
| PLEG再リストの合計所要時間 | 最後のポーリング期間中に、PLEGでPodを再リストするのにかかった合計時間。 | 秒 |