Monitoring IT

Monitoring, který upozorní dřív než uživatel

Sledujeme dostupnost a vybrané provozní stavy serverů, sítí, služeb, úložišť a zálohovacích úloh. Monitoring pomáhá problém včas zachytit, ale musí být doplněn jasnými pravidly, kdo a kdy na upozornění reaguje.

Včasné upozorněnína změnu nebo nedostupnost
Historie událostípro hledání příčin
Jednotný přehlednad více systémy
Rozsah reakcestanovený předem

Typické situace

Co lze monitoringem odhalit

!

Nedostupnost serveru, webové služby, VPN nebo důležitého síťového prvku.

!

Docházející místo na disku, rostoucí zatížení nebo neobvyklé využití prostředků.

!

Selhání vybrané služby nebo procesu, na kterém závisí aplikace.

!

Neúspěšnou nebo dlouho neprovedenou zálohovací úlohu.

!

Výpadky internetového připojení a změny dostupnosti poboček.

!

Opakující se provozní problém, který by bez historie zůstal skrytý.

Rozsah služby

Jaké oblasti lze sledovat

Monitoring se navrhuje podle významu služeb. Není účelné sbírat stovky údajů, pokud na ně nikdo nereaguje.

Servery a služby

  • dostupnost operačního systému
  • procesor, paměť a disková kapacita
  • vybrané systémové a aplikační služby
  • certifikáty a důležité porty
  • události vyžadující pozornost

Sítě a lokality

  • dostupnost routerů, firewallů a switchů
  • internetové připojení a VPN
  • latence a výpadky mezi lokalitami
  • napájení a stav podporovaných zařízení
  • základní přehled provozních návazností

Zálohy a reporty

  • výsledek zálohovacích úloh
  • stáří poslední úspěšné kopie
  • využití zálohovací kapacity
  • eskalace opakovaných chyb
  • pravidelný provozní souhrn

Postup

Od metriky k užitečnému upozornění

1

Výběr služeb

Určíme, které systémy jsou důležité a jaký stav je skutečně problém.

2

Nastavení limitů

Prahy a upozornění přizpůsobíme běžnému chování prostředí, aby nevznikal zbytečný šum.

3

Eskalace

Stanovíme příjemce, pracovní dobu, prioritu a postup při opakovaném nebo kritickém stavu.

4

Vyhodnocení

Pravidelně upravujeme monitoring podle změn infrastruktury a skutečně užitečných událostí.

Rozsah a odpovědnost

Co monitoring znamená a co nezaručuje

Dohled není automaticky pohotovost

Nepřetržitý sběr dat neznamená automaticky lidskou reakci 24/7. Pohotovost musí být výslovně sjednaná.

Upozornění není oprava

Monitoring problém identifikuje nebo signalizuje. Samotné odstranění závady může být běžná správa, incident nebo samostatný projekt.

Úplnost závisí na rozsahu

Lze sledovat pouze systémy a parametry, ke kterým je přístup a které byly zahrnuty do monitorovacího návrhu.

Časté otázky

Praktické otázky před zahájením spolupráce

Je monitoring vhodný i pro malou firmu?

Ano, pokud má několik důležitých služeb, server, NAS, VPN nebo zálohy, jejichž výpadek by ovlivnil provoz.

Může monitoring kontrolovat zálohy?

Ano, ale ideální je kombinovat stav úlohy s kontrolou stáří poslední kopie a pravidelným testem obnovy.

Jak často se stav kontroluje?

Frekvence závisí na typu služby a dohodnutém rozsahu. Kritické dostupnostní testy mohou běžet často, kapacitní a reportovací kontroly v delších intervalech.

První krok

Proberme současný stav a bezpečný další postup

Stačí popsat počet uživatelů, zařízení, používané služby a největší současný problém. Nejdříve určíme, co je potřeba ověřit a které změny mají nejvyšší prioritu.

info@pcspravce.cz+420 601 212 311Praha, Středočeský kraj a vzdáleně celá ČR