Server Monitoring

Kroz raniju seriju tekstova o IT održavanju, pisali smo o opštem konceptu monitoringa IT infrastrukture. U ovom tekstu fokusiramo se specifično na servere, s obzirom na to koliko su kritični za funkcionisanje cele firme, i koliko je monitoring ovih sistema fundamentalno drugačiji po važnosti od praćenja pojedinačnih radnih stanica.

Zašto server monitoring zaslužuje posebnu pažnju

Za razliku od pojedinačnog računara zaposlenog, čiji problem obično pogađa samo tu jednu osobu, problem na serveru često pogađa celu firmu odjednom — ako server koji hostuje deljene fajlove, poslovni softver, ili email prestane da radi, svi zaposleni koji zavise od tog sistema ostaju bez mogućnosti za rad. Ova razmera potencijalnog uticaja čini kontinuirano, pouzdano praćenje servera prioritetom.

Šta konkretno treba pratiti kod servera

Opterećenje procesora

Kontinuirano visoko opterećenje procesora može ukazivati na to da server dostiže granice svojih mogućnosti, na problem sa određenim procesom koji troši previše resursa, ili čak na maliciozni softver koji radi u pozadini.

Korišćenje memorije

Slično opterećenju procesora, praćenje memorije pomaže da se identifikuje da li server ima dovoljno resursa za trenutno opterećenje, ili se približava tački gde bi nedostatak memorije mogao izazvati nestabilnost ili usporenje.

Prostor na disku

Popunjavanje diska je jedan od najčešćih, a lako predvidljivih uzroka problema — server koji ostane bez slobodnog prostora može prestati da funkcioniše ispravno, uključujući nemogućnost kreiranja backupa. Praćenje trenda popunjenosti omogućava planiranje proširenja pre nego što postane hitan problem.

Temperatura komponenti

Za fizičke servere, praćenje temperature ključnih komponenti (procesor, diskovi) pomaže da se otkriju problemi sa hlađenjem pre nego što dovedu do pregrevanja i potencijalnog oštećenja hardvera.

Status ključnih servisa

Pored opštih resursa, važno je pratiti i da li specifični servisi koje server hostuje (baza podataka, email server, deljeni folderi) zaista rade i odgovaraju, ne samo da li je sam server tehnički “uključen”.

Mrežna povezanost i saobraćaj

Praćenje mrežne aktivnosti servera pomaže da se identifikuju neuobičajeni obrasci koji bi mogli ukazivati na problem sa mrežnom opremom, ili, u bezbednosnom kontekstu, na potencijalno kompromitovanje.

Status backupa

Kao što smo naglašavali kroz raniju seriju o backupu, redovna provera da li se backup servera zaista uspešno izvršava treba biti sastavni deo monitoring rutine, ne odvojena, zaboravljena aktivnost.

Nivoi ozbiljnosti alarma

Slično konceptu koji smo objasnili u ranijoj seriji o monitoringu računara, dobar sistem za praćenje servera razlikuje nivoe ozbiljnosti — informativna upozorenja koja ne zahtevaju hitnu akciju, upozoravajući alarmi koji zahtevaju pažnju u razumnom roku, i kritični alarmi koji zahtevaju trenutnu reakciju, poput potpune nedostupnosti servera ili kritičnog nedostatka prostora na disku.

Proaktivno naspram reaktivnog praćenja

Vrednost dobrog monitoringa nije samo u tome da vas obavesti kada server prestane da radi (što je već reaktivno, nakon što je problem nastupio), već u prepoznavanju trendova koji ukazuju na nadolazeći problem — na primer, disk koji se popunjava predvidljivom brzinom i koji će dostići kritičan nivo za dve nedelje, omogućavajući planiranu intervenciju pre nego što se problem stvarno dogodi.

24/7 praćenje kao standard za kritične servere

S obzirom na to da mnogi problemi mogu nastupiti u bilo koje doba dana, kontinuirano, dvadesetčetvoročasovno praćenje kritičnih servera predstavlja standard, ne luksuz — problem koji nastupi noću i ostane neotkriven do jutra znači produžen, nepotreban zastoj.

Dashboard i izveštavanje za direktore

Iako sirovi tehnički podaci monitoringa nisu direktno korisni za direktora firme, prevedeni u jasan, razumljiv izveštaj — status svih kritičnih sistema, broj rešenih problema pre nego što su postali ozbiljni, trendovi koji zahtevaju buduću pažnju — pružaju vrednu, dostupnu sliku stanja IT infrastrukture bez potrebe za tehničkim predznanjem.

Monitoring virtuelizovane infrastrukture

Za firme sa virtuelizovanim serverima, o kojima smo pisali u ranijim tekstovima ove serije, monitoring treba da pokrije i nivo fizičkog hosta (hipervizora), i nivo pojedinačnih virtuelnih mašina, s obzirom na to da problem na fizičkom nivou može istovremeno uticati na više virtuelnih servera koji dele taj isti hardver.

Naš pristup u Trace Link-u

Implementiramo kontinuirani monitoring servera za sve klijente, sa jasno definisanim nivoima alarma i brzim vremenom reakcije na kritične probleme, uz redovne izveštaje koji prevode tehničke podatke u razumljive informacije o stanju infrastrukture. Radimo sa firmama u Novom Sadu, Beogradu i širom Srbije.

Zaključak

Server monitoring predstavlja kritičnu komponentu proaktivnog IT održavanja, s obzirom na to koliko širok uticaj problem na serveru može imati na celokupno poslovanje firme. Kontinuirano praćenje ključnih pokazatelja, uz jasno definisane nivoe alarma i brzu reakciju, omogućava da se problemi otkriju i reše pre nego što izazovu značajan zastoj. Ako vaši serveri trenutno nemaju adekvatan monitoring, javite nam se preko kontakt forme.