Projekt · Monitoring
Monitoring sieci i serwerów z Elastic Stack
Dane są dostępne w jednym panelu, który pokazuje stan najważniejszych urządzeń i połączeń.
- Monitoring 24/7 w umowie
- Jeden zespół, cała infrastruktura
- Najpierw to, co blokuje pracę
Fundament
Monitoring pod własną kontrolą
Całe środowisko monitoringu działa on-premise, na licencji Basic. Nie ma subskrypcji ani wynoszenia danych o infrastrukturze poza firmę.
Rozwiązanie konfigurujemy dla konkretnego środowiska i nie rozliczamy go wyłącznie według liczby urządzeń. Elastic Stack składamy pod konkretną sieć: od źródeł danych, przez ich przetwarzanie, po widoki, z których faktycznie się korzysta.
Zbieranie danych
Źródła danych
Dane zbieramy tam, gdzie powstają. Logstash przyjmuje SNMP z urządzeń sieciowych i czyta systemowy syslog. Filebeat zbiera najróżniejsze logi, Winlogbeat dzienniki zdarzeń Windows, a Metricbeat metryki wydajności.
Wszystko trafia do wspólnego magazynu w Elasticsearch. Dzięki temu wpis z przełącznika, zdarzenie z serwera Windows i metryka z maszyny są dostępne w jednym widoku, a nie w czterech osobnych narzędziach.
Widok operacyjny
Jeden ekran, odpowiedź w 30 sekund
Wszystkie te dane łączy jeden kompletny dashboard z natychmiastowym podglądem najważniejszych węzłów sieci. Widać na nim wysycenie łączy i czasy odpowiedzi węzłów.
Cel jest prosty i policzalny: w 30 sekund od otwarcia ekranu wiadomo, czy w sieci coś się dzieje. Bez logowania się po kolei do urządzeń i bez zgadywania, od czego zacząć.
Alerty
Alerty, które trafiają do człowieka
Monitoring bez alertu jest tylko wykresem. Progi kontrolują zasoby i wybrane błędy w logach, a kanał powiadomienia dobieramy do wagi zdarzenia: od wiadomości e-mail po telefon przy sprawach krytycznych.
Zasoby pod progiem
Zajętość dysków, CPU i pamięć. Alert jest wysyłany, zanim zabraknie miejsca na dysku lub zasobów obliczeniowych.
Błędy w logach
Analiza logów pod kątem wybranych błędów, nie samo zbieranie danych.
E-mail, SMS i czat
Powiadomienia trafiają do kanału, z którego zespół korzysta na co dzień.
Efekty
- Około 200 routerów i pozostałe urządzenia sieciowe pod jednym nadzorem.
- Alertów od kilku do kilkudziesięciu dziennie, zależnie od dnia.
- Powiadomienia trafiają do kilkunastu osób po stronie klienta.
