Kubernetes 応用コース / Chapter 11

PrometheusによるPodメトリクス収集

変動するPodを検出して時系列データを集め、容量と異常を観測する仕組みを学ぶ。

  1. Prometheusは対象のmetrics endpointを定期的にscrapeする。
  2. Kubernetesのlabelは集計・絞り込みの重要な軸になる。
  3. CPUやメモリの傾向はスケーリングと障害調査の根拠になる。

01 Prometheusはtargetをpullして時系列化する

Prometheusがmetrics endpointへ定期アクセスし、取得値を時系列DBへ保存する。

Prometheusのpull型収集
targetがDownなら取得経路のどこかが切れている。

02 ServiceMonitorが観測対象を宣言する

Service selectorとportを指定して、Operatorにscrape targetを発見させる。

Prometheus target発見の経路
port名とselectorがずれるとtargetが登録されない。

03 TargetsとPromQLで観測を確認する

UP状態を確認してから、labelで絞った時系列をPromQLで読む。

Prometheusメトリクス確認
metrics-serverと時系列監視の役割を混同しない。

章のまとめ

  1. Prometheusは対象のmetrics endpointを定期的にscrapeする。
  2. Kubernetesのlabelは集計・絞り込みの重要な軸になる。
  3. CPUやメモリの傾向はスケーリングと障害調査の根拠になる。