Riešenia a služby · Prevádzka

Monitoring prevádzky dátových centier

V dátovom centre nezlyháva len server. Ističe, UPS, klimatizácia a teplota majú vlastné dáta — a práve tie bývajú príčinou výpadku, ktorý na prvý pohľad vyzerá ako IT problém.

Zbierame ich z rozvádzačov, meračov energie, UPS a teplotných snímačov, vedieme do jedného prehľadu a napájame na technickú podporu s prioritami P1–P4 — aby na nameraný stav mal kto reagovať.

Výpadok často nezačína na serveri

Keď prestane fungovať služba, hľadá sa v IT. Príčina však býva o poschodie nižšie — v napájaní, v zálohovaní alebo v chladení. Tieto veličiny sú merateľné a menia sa postupne, takže varujú dávno pred tým, než niečo vypadne. Podmienkou je, že ich niekto zbiera.

NapájanieIstič, ktorý sa priblížil k limitu, sa neohlási. Ohlási sa až vtedy, keď vypadne — a s ním celá vetva.
Záložné napájanieUPS drží, kým nedôjde na batérie, ktoré nikto roky netestoval. Ich stav je merateľný dávno pred výpadkom.
ChladenieKlimatizačná jednotka v poruche sa prejaví najprv teplotou, nie chybovou hláškou. Stúpajúci trend je varovanie.
Teplota v priestoreRozdiel medzi studenou a teplou uličkou ukáže problém s prúdením skôr, než sa začnú vypínať servery.

Veličiny, ktoré vedieme do jedného prehľadu

Non-IT prevádzka dátového centra a klasický IT monitoring patria vedľa seba. Operátor má vidieť oboje naraz — nie prepínať dva nástroje.

Rozvádzače a ističeStav a zaťaženie jednotlivých vetiev, prúd a napätie po fázach.
Merače energieOdber v čase — podklad pre kapacitné plánovanie aj pre rozúčtovanie.
UPSRežim, stav batérií, zostávajúci čas zálohovania a prechody na batérie.
KlimatizácieChod jednotiek, poruchové stavy a striedanie v prevádzke.
Teplotné snímačeTeplota po uličkách a v skriniach vrátane trendu, nie len okamžitej hodnoty.
Servery, siete a aplikácieDostupnosť a vyťaženie — aby sa IT a non-IT stav čítali vedľa seba, nie v dvoch nástrojoch.

Od snímača po obrazovku

Postup je vždy rovnaký a nezačína nákupom. Začína zistením, čo už v dátovom centre meria.

Obhliadka a súpis zdrojov dátČo v dátovom centre už meria a čo z toho vieme prečítať. Väčšina zariadení dáta poskytuje — len ich nikto nezbiera.
Zber z priemyselných zbernícZ rozvádzačov, meračov a UPS čítame priemyselnými protokolmi, napríklad cez Modbus. Zariadenia sa nemenia.
Jeden prehľad pre operátoraDáta idú do spoločného prehľadu, kde je IT aj non-IT stav vedľa seba — v reálnom čase a s históriou.
Prahy, výstrahy a reakciaNad hodnotami sú prahy a výstrahy napojené na technickú podporu v prioritách P1–P4. Monitoring bez reakcie je len graf.

Kde to už beží

Uvádzame len realizácie, ktoré máme v referenciách.

Realizácia

Dátové centrum v akademickom sektore

Klientovi chýbal centralizovaný prehľad o kritickej non-IT infraštruktúre. Dodali sme aplikáciu, ktorá v reálnom čase zbiera a vizualizuje dáta z ističov, meračov energie, UPS, klimatizácií a teplotných snímačov — operátor vidí celú infraštruktúru na jednom mieste.

Detail referencie →

Technológie

Čím je to postavené

Zber cez Modbus, aplikačná vrstva na .NET API s rozhraním v Angulari a Blazore, vizualizácia v Grafane a Metabase. Pre dostupnosť serverov, sietí a aplikácií používame Zabbix.

Nadväznosť

Monitoring a podpora idú spolu

Na namerané stavy nadväzuje technická podpora v prioritách P1–P4. Rozsah, servisné hodiny a reakčné časy sa dohadujú v servisnej zmluve podľa kritickosti prevádzky.

Monitoring a technická podpora →

Časté otázky k monitoringu dátových centier

Prečo monitorovať aj to, čo nie je IT?
Lebo výpadok často nezačína na serveri. Istič na hranici, UPS so starými batériami alebo klimatizácia v poruche sa prejavia ako nedostupná služba — a hľadá sa v IT, kde príčina nie je.
Musíme kvôli tomu meniť rozvádzače alebo UPS?
Nie. Väčšina zariadení dáta už poskytuje, len ich nikto nezbiera. Čítame ich priemyselnými protokolmi, napríklad cez Modbus, bez zásahu do samotného zariadenia.
Uvidíme IT aj non-IT stav na jednom mieste?
Áno, to je zmyslom celého riešenia. Operátor vidí dostupnosť serverov aj teplotu v uličke v jednom prehľade, nie v dvoch nástrojoch.
Na čom to beží?
Dostupnosť serverov, sietí a aplikácií riešime Zabbixom. Pre prevádzkové veličiny dátového centra sme dodali vlastnú aplikáciu so zberom cez Modbus a vizualizáciou v Grafane a Metabase.
Kto reaguje na výstrahu?
Podľa dohody buď váš tím, alebo naša technická podpora v modeli priorít P1–P4. Monitoring bez dohodnutej reakcie je len graf.
Dá sa z toho robiť aj kapacitné plánovanie?
Áno. Odber a teploty sa ukladajú v čase, takže z histórie vidno trend — či má vetva ešte rezervu a ako sa mení odber pri raste osadenia.

Dátové centrum · Konzultácia

Zistite, čo vaše dátové centrum už meria.

Prejdeme s vami rozvádzače, UPS, chladenie a snímače a povieme, čo sa z nich dá čítať bez výmeny zariadení.