Serwery i sieci
Monitorowanie serwerów i sieci
Monitorować można praktycznie każdy parametr serwera. Sens ma jednak obserwowanie tego, co realnie wpływa na działanie usługi, i uzgodnienie, co się dzieje po alercie.
Standardowo obserwowane punkty
Poniższa lista to zestaw wyjściowy, rozszerzany zależnie od tego, co na serwerze jest krytyczne.
- dostępna przestrzeń dyskowa i inody na partycjach
- parametry S.M.A.R.T., czyli stan dysków
- obciążenie systemu i liczba zalogowanych użytkowników
- czas odpowiedzi ping oraz synchronizacja czasu NTP
- czas odpowiedzi HTTP i HTTPS oraz działanie stron
- data wygaśnięcia certyfikatów SSL/TLS
Co się dzieje po alercie
Sam alert mówi tylko, że coś się zmieniło. Wartość pojawia się dopiero wtedy, gdy ktoś to sprawdza i wie, co zrobić dalej.
- weryfikacja, czy zdarzenie jest realne, czy chwilowe
- ocena wpływu na działającą usługę
- działanie naprawcze albo kontakt, jeśli wymaga decyzji
- wskazanie, co warto poprawić, żeby się nie powtórzyło
Porozmawiajmy o Twoim środowisku
Napisz, co działa na serwerze i co sprawia kłopot. Odpowiemy, co warto sprawdzić w pierwszej kolejności.