Prometheus, sistemlerin performansını ve durumunu gerçek zamanlı izlemek için güçlü bir araçtır. Disk kullanımı gibi kritik metriklerin izlenmesi ve olası sorunların önceden tespiti, sistem güvenliği ve performansı açısından oldukça önemlidir. Bu nedenle, disk kullanımına yönelik uyarı (alert) sistemleri tasarlamak, modern IT altyapılarında temel bir gerekliliktir.
Prometheus’un temel avantajlarından biri, veri toplama ve sorgulama yeteneğinin yanı sıra, Alertmanager ile uyum içinde çalışmasıdır. Disk kullanımına yönelik alertler oluştururken, öncelikle node exporter gibi uygun exporter’ların sisteminizde aktif ve doğru yapılandırıldığından emin olmalısınız. Örneğin, disk kullanımını izlemek için şu metrik kullanılır:
.
Uyarı kurallarını belirlerken, genellikle %90 veya %95 gibi yüksek limitler tercih edilir. Örneğin, aşağıdaki Prometheus kuralı, disk kullanımı %85’i geçtiğinde uyarı tetikler:
123456789
alert HighDiskUsage
if (node_filesystem_usage{mountpoint="/"} > 0.85)
for 5m
labels
severity = "warning"
annotations
summary = "Disk kullanımı yüksek"
description = "Ana disk bölümünde kullanım oranı %85'i geçti."
Buradaki önemli noktalar;
for 5m ifadesi, kullanımın sürekli 5 dakika boyunca yüksek kalması durumunda alarmın tetiklenmesini sağlar. Bu, ani yükselişlerde gereksiz uyarıları engeller.
Son olarak, Alertmanager’ı yapılandırarak, bu uyarıların e-posta, Slack veya diğer iletişim kanallarına iletilmesini sağlayabilirsiniz. Uygun threshold ve zaman dilimi ayarlarıyla, sistemlerinizin yüksek disk kullanımını önceden tespit edip proaktif önlemler alabilirsiniz. Sizin sisteminizde disk kullanımı için kullanılan en uygun uyarı limitleri ve yapılandırmaları nelerdir?