Obsah

Úvod

Monitorování Windows Serveru se často vyvíjí z nativních nástrojů, skriptů a softwaru třetích stran na systémy, které se stávají fragmentovanými, nákladnými nebo obtížně spravovatelnými. Účinná výměna vyžaduje více než jen porovnání funkcí produktů. Tento článek vysvětluje, kdy má smysl výměna, co by mělo monitorování Windows Serveru pokrývat, které schopnosti upřednostnit, jak určit vhodný rozsah monitorování a jak migrovat, aniž by došlo ke ztrátě kritické viditelnosti infrastruktury.

V jakém případě by IT tým hledal náhradu za monitorování serveru Windows?

Neexistuje jeden produkt nazvaný "Windows Server Monitoring", který by všichni chtěli nahradit. To, co mají nyní, může být kombinací nástrojů nativních pro Windows, komplexního řešení třetí strany, domácích skriptů nebo holistického stohu pro sledování podnikových systémů.

Důvod, proč chtějí něco jiného, může být stejně tak spirálovité zvyšování nákladů na licence, jako potřeba lepších akčních informací dodávaných správným lidem v IT organizaci.

Jindy je to jednoduše otázka měřítka - rostoucí infrastruktura nyní vyžaduje více, než může poskytnout amatérský domácí systém, nebo nástroje dostupné sysadminovi jednoduše neodhalují typy informací nezbytné k detekci a vyřešení problémů, než ovlivní obchodní operace.

Když nativní nástroje Windows již nestačí

Nativní nástroje Windows mají určitou diagnostickou a monitorovací hodnotu. Monitor výkonu například má výkonnostní čítače pro procesory, paměť, disky, procesy a mnohem více.

Z pohledu Server Manageru lze získat data o výkonu, událostech nebo službách pro místní a vzdálené servery.

Nicméně, to jsou pouze diagnostiky. Monitorovací a upozorňovací schopnosti, které IT tým potřebuje pro své fyzické a virtuální servery Windows, v žádném z těchto nástrojů nejsou přítomny.

Začněte tím, co vaší současné monitorovací nastavení chybí

První otázka, kterou je třeba si položit při zvažování změny, není "Jaký produkt má nejvíce funkcí?", ale "Co našemu stávajícímu softwaru pro monitorování serverů chybí?" Protože to jsou ta omezení, která by měla definovat výběrová kritéria pro potenciální náhradní řešení.

V jakém případě by vaše aktuální nastavení monitorování serveru Windows potřebovalo výměnu?

Monitorovací řešení nemusí být nahrazeno jen proto, že je staré, ale spíše pokud brání administrátorům v tom, aby mohli rychle detekovat, porozumět a reagovat na problémy s infrastrukturou.

Několik varovných signálů může naznačovat, že současný přístup již tuto potřebu nesplňuje.

Monitoring se stal příliš fragmentovaným

Administrátoři mohou využívat jeden nástroj pro výkon serveru, jiný pro protokoly událostí, různé nástroje pro dostupnost služeb a ještě další panel pro webové stránky nebo aplikace.

I když každý komponent může fungovat samostatně, proces odstraňování problémů se stává složitějším, pokud musí administrátoři ručně korelovat data, protože to vyžaduje mnohem více úsilí. Kromě toho může být obtížné zajistit, aby byly všechny kritické systémy neustále monitorovány.

Proto by měla možnost náhrady kombinovat základní komponenty a umožnit správcům pečlivěji upřednostnit systémy, které potřebují sledovat, a eliminovat ty, které nejsou.

Upozornění generují šum místo užitečných informací

Systém upozornění, který hlásí každé dočasné zvýšení CPU, může být téměř stejně zbytečný jako ten, který přehlíží důležité problémy.

Účinné monitorování vyžaduje kontext; krátké zvýšení využití zdrojů pravděpodobně nebude vyžadovat žádnou akci, zatímco zvýšení využití CPU v kombinaci s dlouhodobými zvýšeními paměti, opakovanými selháními služeb nebo poklesem místa na disku by naznačovalo rozvíjející se problém. Základní hodnoty a trendy jsou důležité faktory při určování, zda existuje problém nebo normální variabilita operací.

Pokud administrátoři ignorují upozornění, protože jsou běžná a nepodstatná, měla by být konfigurace systému upozornění klíčovou prioritou při výběru náhrady.

Náklady rostou rychleji než infrastruktura

Monitoringové produkty mají velmi různorodé licenční modely. V závislosti na dodavateli se mohou škálovat podle počtu serverů, senzorů, služeb, prvků, jader CPU, metrik nebo objemu dat.

Platforma, která byla nákladově efektivní pro deset serverů, může být tedy výrazně méně atraktivní při padesáti nebo sto. Růst infrastruktury může také zvýšit nepřímé náklady, pokud monitorovací platforma vyžaduje další úložiště, sběrače nebo administrativní zdroje.

Plánování náhrady by mělo zohlednit nejen dnešní cenu, ale také to, co způsobuje, že celkové náklady na monitoring rostou v průběhu času.

Problémy dosahují uživatelů dříve, než dosáhnou IT.

Jedním z nejběžnějších varovných signálů je, že podpora pravidelně identifikuje problémy s infrastrukturou, než je odhalí monitorovací systém.

Nedostatečná paměť, nedostatek volného místa na discích, selhání služeb, anomální spotřeba šířky pásma, nebo degradace výkonu aplikace měly by být ideálně identifikovány dostatečně brzy, aby administrátoři mohli provést nápravná opatření, než dojde k vážným výpadkům postižených systémů.

Pokud se IT oddělení organizace musí pravidelně zabývat problémy s infrastrukturou, které byly odhaleny prostřednictvím kanálů uživatelské podpory, může být nutné přehodnotit stávající nastavení.

Co by měl monitor pro sledování serveru Windows nahradit?

Před změnou platforem je třeba identifikovat monitorovací schopnosti, které IT týmy potřebují zachovat, a ty, které musí nová řešení splnit.

Většina implementací Windows Server vyžaduje monitorování alespoň několika kategorií.

Výkon CPU, paměti a disku

Zatímco využití CPU je užitečné, procenta zřídka vyprávějí celou historii. Udržovaný tlak na procesor, aktivita procesů a proměnlivé vzorce využití poskytují více kontextu o celkových operacích než izolované vrcholy.

Sledování paměti by mělo podobně identifikovat trvalou spotřebu, tlak na stránkování a neobvyklý růst, spíše než jen zobrazovat aktuální využití RAM. Sledování disku musí zahrnovat jak kapacitu, tak aktivitu, protože server může mít dostatek volného úložiště, zatímco se setkává s úzkým hrdlem I/O, nebo může fungovat normálně, zatímco dostupná kapacita se blíží kritické úrovni.

Výkonové pokyny společnosti Microsoft pro Windows Server používají čítače napříč procesory, pamětí, logickými a fyzickými disky, procesy a dalšími komponenty k prozkoumání systémových úzkých míst. Důležitým bodem pro plánování výměny je zachovat dostatečnou hloubku, aby bylo možné pochopit, proč se mění spotřeba zdrojů, nikoli pouze to, zda je vysoká.

Procesy a kritické služby

Zdraví operačního systému je pouze částí celkového obrazu.

Windows Server stroj může být v provozu, i když aplikace, proces nebo služba, kterou uživatelé skutečně chtějí spustit, přestala fungovat. Požadavky na monitorování by měly odrážet roli každého serveru a služby, které jsou potřebné k naplnění této role.

Server Internet Information Services (IIS), databázový server, řadič domény a hostitel relací vzdálené plochy nemají identické požadavky. Užitečná náhrada by umožnila správcům sledovat, co je důležité pro každý server, místo aby se pouze použila jediná definice zdraví pro celé prostředí.

Aktivita sítě a šířky pásma

Nečekané vzory provozu, síťové chyby nebo neobvyklá spotřeba šířky pásma může odhalit jak problémy s výkonem, tak s infrastrukturou.

Viditelnost sítě se stává obzvlášť užitečnou, když administrátoři potřebují určit, zda pomalý výkon aplikace pochází ze serveru, sítě nebo jiného závislého systému.

Náhrada monitorování Windows Serveru nemusí nutně představovat kompletní platformu pro monitorování sítě. Měla by však poskytovat úroveň viditelnosti sítě, kterou vyžadují běžné procesy odstraňování problémů vašeho týmu.

Události, aplikace a pracovní zátěže

Pro některé organizace jsou obecné metriky operačního systému dostatečné. Pro jiné jsou pouze začátkem.

Windows Server prostředí mohou hostit služby Active Directory Domain Services, IIS, SQL Server, Hyper-V a další pracovní zátěže se svými vlastními indikátory zdraví. Základní monitorování CPU, paměti a disku nemůže odhalit každé selhání specifické pro pracovní zátěž.

Toto vytváří důležité kritérium pro nahrazení: potřebuje organizace především obecné monitorování zdraví Windows Serveru, nebo vyžaduje hlubokou viditelnost do konkrétních pracovních zátěží a aplikací Microsoft?

Odpověď může výrazně změnit, jaký typ monitorovací platformy je vhodný.

Co by měla náhrada zlepšit?

Udržování důležitého pokrytí monitorováním je pouze část úkolu. Nový systém musí také vyřešit provozní omezení, která vedla k výměně.

Čtyři funkce si zaslouží zvláštní pozornost.

Centralizovaná viditelnost

Administrátoři by měli být schopni vyhodnotit stav mnoha monitorovaných serverů, aniž by se museli obtěžovat s připojením pokaždé nebo používáním souboru různých nástrojů.

Centralizace se stane důležitější, jak se infrastruktura rozšiřuje na více míst, virtuálních instancí, vzdálené servery nebo na zákaznických prostorách. Cílem není vytvořit další panel, ale poskytnout administrátorům přehled, ze kterého mohou identifikovat oblasti, kde je potřeba bližší inspekce.

Historická data a základní linie

Sledování v reálném čase odpovídá na otázku „Co se teď děje?“ ale historické sledování odpovídá na stejně důležitou otázku „Je to, co se teď děje, něco, co by se mělo dít?“

Server, který běží s 70% využitím paměti, může být zcela zdravý, pokud je to maximum, kterého kdy dosáhne, ale pomalý vzestup z 30% na 70% využití může být také začátkem důležitého incidentu.

Historická data umožňují IT týmům, aby stanovit základní úrovně výkonu prozkoumat opakující se incidenty, aby se odhalily jejich základní příčiny, plánovat kapacitu a posuzovat, zda změny v infrastruktuře měly pozitivní nebo negativní dopad na výkon. Náhrada by měla být proto hodnocena na základě schopnosti poskytovat hodnotu z historických dat, stejně jako toho, co nabízí pro real-time panely.

Akční upozornění

Hodnocení náhrad by mělo přesáhnout binární otázku, zda platforma „podporuje upozornění“.

Administrátoři budou chtít vědět, zda lze prahy přizpůsobit jejich prostředí, kdo bude informován a zda oznámení usnadňují rozlišování mezi přechodnými anomáliemi a podmínkami vyžadujícími zásah.

Cílem není generovat více upozornění. Je to snížit šum a ztížit přehlédnutí důležitých podmínek.

Užitečné reportování

Zprávy jsou užitečné jako prostředek k předávání informací, které je třeba přezkoumat během určitého časového období nebo které je třeba hlásit nad rámec administrátora, který aktuálně přezkoumává řídicí panel.

Mohou pomoci IT pracovníkům přezkoumat spotřebu zdrojů, vyšetřit opakující se problémy, dokumentovat dostupnost nebo poskytnout informace o infrastruktuře zákazníkům a vedení. Naplánované reporty mohou ušetřit administrátorům manuální úsilí při opakovaném získávání stejných informací.

Klíčovým kritériem není počet dostupných šablon zpráv, ale to, že zprávy se zabývají provozními otázkami, které si organizace skutečně potřebuje klást.

Potřebujete monitorování serveru nebo plnou viditelnost?

Toto může být nejdůležitější rozhodnutí o rozsahu při výběru náhrady za monitorování Windows Serveru. Moderní platformy pro pozorování mohou zpracovávat metriky a protokoly infrastruktury, zatímco také podporují stopy, monitorování výkonu aplikací, cloudové služby, kontejnery a telemetrii ve velkém měřítku.

Pro distribuované aplikace, mikroservisy nebo složité hybridní cloudové prostředí mohou být tyto schopnosti nezbytné.

Když je sledování serveru Focused dostatečné

Není však vždy nezbytné pro každé prostředí serveru Windows.

IT tým zaměřený výhradně na výkon serverů, procesy, uživatele, šířku pásma, webové stránky, upozornění a trendy v infrastruktuře nemusí mít prospěch z zavedení architektury pozorovatelnosti, která přidává další telemetrické kanály, požadavky na úložiště a specializovanou administraci.

Když se širší pozorovatelnost stane nezbytnou

Opak je také pravdou. Zaměřená platforma pro monitorování serverů může být nedostatečná, pokud inženýři vyžadují distribuované sledování, mapování závislostí aplikací, centralizovanou analýzu protokolů nebo podrobné monitorování výkonu aplikací.

Rozhodnutí se tedy týká rozsahu více než toho, která možnost je sofistikovanější. Vyberte monitorování serveru když je požadována pohoda infrastruktury a provozní viditelnost. Zvolte širší pozorovatelnost, když řešení problémů vyžaduje, aby administrátoři nebo inženýři korelovali chování infrastruktury s aplikacemi, protokoly, stopami a distribuovanými službami.

Správná náhrada je platforma, která poskytuje požadovanou hloubku, aniž by zbytečně komplikovala architekturu monitorování.

Jak byste měli porovnat náhrady monitorování serveru Windows?

Jakmile jsou požadavky a rozsah identifikovány, srovnání produktů se stává mnohem užitečnějším.

Místo toho, abyste začali s funkcemi různých dodavatelů, porovnejte produkty podle stejné sady otázek:

  • Podporuje verze Windows Server a role serveru, které používáte?
  • Může monitorovat CPU, paměť, disky, procesy a služby a síťovou aktivitu v požadované míře?
  • Mohou administrátoři monitorovat více serverů z centrální konzole?
  • Udržuje dostatek historických informací pro identifikaci trendů a vyšetřování incidentů?
  • Lze prahové hodnoty a upozornění přizpůsobit vašemu prostředí?
  • Zajišťuje to zprávy potřebné pro administrátory, management nebo zákazníky?
  • Kolik infrastruktury je potřeba k provozu monitorovacího systému?
  • Závisí monitorování na agentech, vzdáleném dotazování nebo jiné metodě sběru?
  • Jak se mění licencování, když se zvyšuje monitorovaná infrastruktura?

Potřebuje tým monitorování zátěže specifické pro Windows nebo širší pozorovatelnost?

Tohoto vytváří mnohem užitečnější srovnání než počet funkcí na stránce produktu.

Hlubka monitorování, složitost nasazení, správa, kvalita upozornění, licencování a čas k dosažení hodnoty vše ovlivňuje hodnotu platformy. Menší možnost se může z pohledu provozu ukázat jako lepší volba než větší platforma díky menším nákladům a splnění požadavků potřebných organizací.

Jak můžete nahradit monitorovací systém, aniž byste ztratili přehled?

Změna monitorovacího softwaru představuje určité riziko, protože vždy existuje možnost, že viditelnost klesne během kritického okamžiku přechodu, kdy organizace nahrazuje software, který poskytuje takovou službu.

Migrační proces bude méně riskantní, pokud bude prováděn po etapách.

Pokrytí stávajícího monitorování inventáře

Současný systém by měl být inventarizován, aby se stanovila základní linie toho, co by měl nový nástroj monitorovat před zahájením migračního procesu a před demontáží jakýchkoli komponent.

Inventář by měl obsahovat všechny servery, webové stránky, programy, služby, nejdůležitější ukazatele výkonnosti, prahy, oznámení a zprávy.

Zvláštní pozornost by měla být věnována vlastním kontrolám vytvořeným v průběhu času, které mohly ztratit svůj význam pro toho, kdo systém spravuje po migraci. Tento základní inventář pak bude sloužit jako kritické pokrytí pro ověření náhrady.

Stanovit aktuální základní hodnoty

Zaznamenejte normální výkon před migrací.

Využití CPU, spotřeba paměti, aktivita disku a šířka pásma se liší v závislosti na zátěži a roli serveru. Řadič domény nemusí mít nutně stejné normální chování jako aplikační nebo databázový server.

Existující základní informace poskytují správcům referenci pro konfiguraci a hodnocení nové platformy.

Spusťte obě monitorovací systémy dočasně

Kdekoliv je to možné, udržujte stávající a náhradní systémy v provozu po celou dobu přechodu.

Paralelní monitorování pomáhá administrátorům ověřit, že shromážděné informace na obou systémech jsou konzistentní a že žádné důležité prvky nechybí. Je také užitečné identifikovat jakékoli rozdíly v intervalu sběru, metodách měření a dalších faktorech před tím, než je náhradní systém plně nasazen.

Nové a staré platformy nemusí poskytovat přesně stejná data, ale měly by umožnit administrátorům přístup k potřebným informacím.

Ověřit pokrytí monitorování

Porovnejte novou platformu s inventářem, který byl vytvořen před migrací na ni.

Ujistěte se, že jsou zohledněny důležité servery, služby, webové stránky, metriky a další monitorované zdroje. Toto je také dobrý čas zvážit, zda mají dědictví kontroly hodnotu, provozní, nebo zda jen slepě znovu implementují staré konfigurace.

Iniciativa na výměnu by měla usilovat o zachování viditelnosti, která byla potřebná, ale nikoli složitosti, která nebyla.

Testovací upozornění před ukončením staré platformy

Nepředpokládejte, že upozornění bude fungovat jen proto, že je nastaven práh.

Ujistěte se, že očekávané podmínky posílají oznámení, že jsou doručena správným lidem a že prahy nejsou nastaveny příliš vysoko/nízko. Kde je to možné, sledujte, jak náhrada prochází dostatečnou normální variabilitou pracovního zatížení, abyste viděli zřejmý hluk upozornění.

Starou platformu vyřaďte až poté, co jste sledovali pokrytí a upozornění.

Hledáte jednodušší náhradu za monitorování serveru Windows?

Ne každá organizace potřebuje platformu pro pozorování na podnikové úrovni, aby udržela užitečnou viditelnost nad svou serverovou infrastrukturou. Pro IT týmy, které primárně monitorují zdraví serveru, spotřebu zdrojů, procesy, šířku pásma, uživatele a webové stránky, může cílené řešení poskytnout požadovanou provozní viditelnost, aniž by zavádělo zbytečnou složitost monitorování.

TSplus Server Monitoring centralizuje monitorování Windows a Linux serverů a webových stránek v reálném čase a historické monitorování, s konfigurovatelnými upozorněními a přizpůsobitelnými zprávami. Správci mohou sledovat CPU, paměť, diskovou aktivitu, procesy, šířku pásma a připojené uživatele z jednoho místa, což z něj činí praktickou volbu pro nahrazení fragmentovaného nebo příliš složitého monitorovacího nastavení.

Závěr

Výběr náhrady za monitorování Windows Serveru začíná pochopením, proč stávající nastavení již nefunguje, a definováním viditelnosti, kterou vaše infrastruktura skutečně vyžaduje. Důležité jsou pokrytí monitorováním, akční upozornění, historická data, reportování, správa a škálovatelnost, více než jen výběr platformy s nejdelším seznamem funkcí.

Jakmile je stanoven správný rozsah, migrujte postupně a ověřte pokrytí monitorování před vyřazením stávajícího systému. Cílem není reprodukovat každou starou konfiguraci, ale zachovat nezbytnou viditelnost při snižování nákladů, složitosti nebo provozních omezení, která vedla k výměně v první řadě.

Další čtení

back to top of the page icon