İçeriğe geç
BTAdmin

Hizmet

Monitoring & Observability

Zabbix, Grafana, Prometheus ve SolarWinds ortamlarının kurulumu ve operasyonel hale getirilmesi. Alarm üreten bir sistem değil, güvenilebilen bir sistem.

Monitoring projelerinin çoğu kurulumla değil, kurulumdan sonrasıyla batar. Sistem ayağa kalkar, birkaç yüz host eklenir, sonra alarm sayısı okunamayacak kadar artar ve ekip bir süre sonra bildirimlere bakmayı bırakır. Bu noktadan sonra ortada izleme sistemi değil, gürültü üreten bir uygulama vardır.

Buradaki iş, ürünü kurmaktan çok neyin izleneceğine ve neyin alarm üreteceğine karar vermektir. Hangi metrik hangi eşikte kimi uyandırır, bir servis çöktüğünde altındaki elli host da alarm üretmeli mi, bakım penceresinde ne susar — bunlar ürün ayarı değil mimari kararlardır.

Sıfırdan kurulum da, çalışan ama güvenilmeyen bir ortamın toparlanması da aynı yaklaşımla ele alınıyor: önce mevcut durumun envanteri, sonra alarm gürültüsünün ölçülmesi, sonra kademeli düzeltme.

Ne teslim ediliyor

  • Zabbix kurulumu ve mevcut ortamın iyileştirilmesi
  • Grafana dashboard tasarımı
  • Prometheus ve exporter mimarisi
  • Alarm standardizasyonu ve gürültü azaltma
  • Monitoring migration ve health check
  • Kapasite ve performans analizi

Teknolojiler

ZabbixGrafanaPrometheusSolarWindsAPMBlackbox

Bu alanda gelen talepler

Talepler genelde şu cümlelerle geliyor

  • Zabbix'i sıfırdan kurmak istiyoruz.

    Mimari, host gruplama, template ve alarm yapısıyla birlikte üretime hazır kurulum.

  • Grafana dashboard'larımızı yeniden tasarlamak istiyoruz.

    Kime ne gösterdiği belli olan, okunabilir ve tutarlı dashboard seti.

  • Monitoring sistemimiz çok fazla alarm üretiyor.

    Eşik ve bağımlılık gözden geçirmesi, alarm standardizasyonu, gürültünün ölçülebilir şekilde azaltılması.

  • Mevcut monitoring sisteminden başka bir ürüne geçmek istiyoruz.

    Envanter çıkarma, eşleştirme, paralel çalıştırma ve kontrollü geçiş planı.

Sık sorulanlar

Bu konuda en çok sorulanlar

Mevcut bir monitoring ortamımız var. Sıfırdan mı kuracaksınız?
Hayır. Çalışan bir ortam varsa önce envanteri ve mevcut yapılandırması çıkarılır, sonra kademeli iyileştirilir. Sıfırdan kurulum yalnızca mevcut yapı gerçekten kurtarılamayacak durumdaysa ya da ürün değişikliği kararı verilmişse gündeme gelir.
Alarm gürültüsünü nasıl azaltıyorsunuz?
Önce ölçerek: hangi alarm ne sıklıkla çalıyor, kaçı gerçek bir aksiyonla sonuçlanmış. Ardından bağımlılık tanımları (bir servis çöktüğünde altındaki host'lar susmalı), eşik gözden geçirmesi ve bakım pencereleri devreye giriyor. Alarmı kapatmak değil, çalma nedenini ortadan kaldırmak esas.
Birden fazla monitoring ürününü bir arada kullanabilir miyiz?
Evet, yaygın bir durum. Ağ ve altyapı tarafında SolarWinds, Linux ve Kubernetes tarafında Zabbix ya da Prometheus çalışan ortamlar var. Bu durumda metrikleri tek bir görünümde toplamak için Prometheus federation ve merkezi Grafana dashboard'ları kullanılıyor.
Zabbix'i yüksek erişilebilir hale getirebilir misiniz?
Evet. Tek node çalışan bir Zabbix, çoklu server node, PostgreSQL Patroni HA, HAProxy ve Keepalived VIP bileşenleriyle yüksek erişilebilir mimariye taşınabiliyor. Otomatik agent onboarding de aynı çalışmanın parçası.

Bir IT probleminiz mi var?

Uzun satış süreçleri yerine doğrudan teknik konuyu konuşalım. İlk görüşmede karşınızda işi yapacak uzman olur.