問題文
ある企業は12個のアカウントで Amazon EKS のクラスターを運用している。各クラスターの中で Prometheus のサーバーと Grafana のサーバーを自分たちで動かしており、開発チームは Prometheus のクエリ言語で書いたダッシュボードを数百枚持っている。現状はクラスターごとに監視が独立しているため、全クラスターを横断した比較ができず、監視サーバー自体の容量不足とバージョン更新の作業が毎月発生している。既存のダッシュボードとクエリをそのまま使い続けたうえで、全クラスターのメトリクスを1か所で見られるようにしたい。最も運用のオーバーヘッドが小さい構成はどれか。
選択肢
- 各クラスターのメトリクスを Amazon CloudWatch のカスタムメトリクスとして送信し、CloudWatch のダッシュボードを作り直してアカウントごとに参照する
- Amazon Managed Grafana のワークスペースだけを作り、各クラスターで動いている既存の Prometheus サーバーをデータソースとして登録する
- 各クラスターのコレクターから Amazon Managed Service for Prometheus のワークスペースへメトリクスを書き込み、Amazon Managed Grafana のワークスペースをそのワークスペースに接続して既存のダッシュボードを取り込む
- Amazon Managed Service for Prometheus のワークスペースにメトリクスを集め、アラートとダッシュボードは Amazon Athena で定期的にクエリして表計算ソフトに出力する