Въведение
Настройките за мониторинг на Windows Server често се развиват от родни инструменти, скриптове и софтуер на трети страни в системи, които стават фрагментирани, скъпи или трудни за управление. Ефективната им замяна изисква повече от просто сравняване на характеристиките на продуктите. Тази статия обяснява кога замяната има смисъл, какво трябва да обхваща мониторингът на Windows Server, кои възможности да се приоритизират, как да се определи подходящият обхват на мониторинга и как да се мигрира без загуба на критична видимост на инфраструктурата.
В кой случай ИТ екипът би търсил заместител на мониторинг на Windows Server?
Не съществува един продукт, наречен "Мониторинг на Windows Server", който всеки иска да замени. Това, което имат в момента, може да бъде комбинация от инструменти, родени в Windows, обширно решение на трета страна, собствени скриптове или по-холистичен стек за наблюдение на предприятието.
Причината, поради която искат нещо друго, може да бъде толкова вероятно нарастващите разходи за лицензи, колкото и нуждата от по-добра приложима информация, предоставена на правилните хора в ИТ организацията.
Други пъти това е просто въпрос на мащаб - нарастващата инфраструктура сега изисква повече, отколкото един аматьорски домашен система може да предостави, или инструментите, налични на системния администратор, просто не разкриват типовете информация, необходими за откриване и разрешаване на проблеми, преди те да повлияят на бизнес операциите.
Когато родните инструменти на Windows вече не са достатъчни
Нативните инструменти на Windows наистина имат известна диагностична и мониторинг стойност. Монитор на производителността например, има производствени броячи за процесори, памет, дискове, процеси и много други.
Прегледано през Server Manager, данни за производителност, събития или услуги могат да бъдат достъпни за локални и отдалечени сървъри.
Въпреки това, това са само диагностика. Функциите за мониторинг и известяване, от които IT екипът се нуждае за своите физически и виртуални Windows сървъри, не са налични в нито един от тези инструменти.
Започнете с това, което липсва на вашата текуща система за мониторинг
Първото нещо, което трябва да се запитате, когато обмисляте промяна, не е "Кой продукт има най-много функции?", а "Какво липсва на нашия съществуващ софтуер за мониторинг на сървъри?" Защото именно тези ограничения трябва да определят критериите за избор на потенциално заместител.
В кой случай вашата текуща настройка за мониторинг на Windows Server би се нуждаела от подмяна?
Решение за мониторинг не трябва да бъде заменяно само защото е старо, а по-скоро ако пречи на администраторите да могат бързо да откриват, разбират и реагират на проблеми с инфраструктурата.
Няколко предупредителни знака могат да показват, че текущият подход вече не удовлетворява тази нужда.
Наблюдението стана твърде фрагментирано
Администраторите могат да използват един инструмент за производителността на сървъра, друг за дневниците на събитията, различни инструменти за наличността на услугите и още една табло за уебсайтове или приложения.
Въпреки че всеки компонент може да работи самостоятелно, процесът на отстраняване на проблеми става по-предизвикателен, ако администраторите трябва ръчно да корелират данните, тъй като това изисква много повече усилия. Освен това може да стане трудно да се гарантира, че всички критични системи се наблюдават последователно.
Следователно, опцията за замяна трябва да комбинира основните компоненти и да позволи на администраторите да приоритизират системите, които трябва да наблюдават по-внимателно, като елиминират тези, които не са.
Уведомленията генерират шум вместо полезна информация
Система за известяване, която докладва за всяко временно покачване на CPU, може да бъде почти толкова безполезна, колкото и такава, която пропуска важни проблеми.
Ефективното наблюдение изисква контекст; краткосрочното увеличение на използването на ресурси едва ли ще изисква действия, докато увеличенията в използването на CPU, комбинирани с дългосрочни увеличения в паметта, повторни провали на услугата или намаляване на дисковото пространство биха подсказали за развиващ се проблем. Основните линии и тенденциите са важни фактори при определянето дали има проблем или нормална вариация в операциите.
Ако администраторите игнорират известията, тъй като те са чести и незначителни, конфигурирането на системата за известия трябва да бъде основен приоритет при избора на заместител.
Разходите нарастват по-бързо от инфраструктурата
Продуктите за мониторинг имат изключително разнообразни лицензионни модели. В зависимост от доставчика, те могат да се увеличават с броя на сървърите, сензорите, услугите, елементите, ядрата на процесора, метриките или обема на данните.
Платформа, която е била икономически изгодна за десет сървъра, може да бъде значително по-малко привлекателна при петдесет или сто. Растежът на инфраструктурата може също да увеличи непреките разходи, ако платформа за мониторинг изисква допълнително хранилище, колектори или административни ресурси.
Планирането на замяна трябва да вземе предвид не само днешната цена, но и какво води до увеличаване на общите разходи за мониторинг с течение на времето.
Проблемите достигат до потребителите, преди да достигнат до ИТ.
Един от най-честите предупредителни знаци е, че билетите за поддръжка редовно идентифицират проблеми с инфраструктурата, преди те да бъдат открити от системата за мониторинг.
Недостатъчна памет, липса на свободно пространство на дисковете, неуспешни услуги, аномално потребление на честотна лента или влошаване на производителността на приложението трябва да бъде идентифициран достатъчно рано, за да могат администраторите да извършат коригиращи действия, преди засегнатите системи да претърпят сериозно време на неработоспособност.
Ако ИТ отделите на една организация редовно трябва да се справят с проблеми с инфраструктурата, които са били открити чрез канали за поддръжка на потребители, може да се наложи да се преоценят съществуващите настройки.
Какво трябва да наблюдава заместник на монитор за Windows Server?
Преди да смените платформите, има възможности за мониторинг, които ИТ екипите трябва да идентифицират като изискващи запазване и тези, които новото решение трябва да изпълни.
Повечето реализации на Windows Server изискват мониторинг на поне няколко категории.
Производителност на CPU, памет и диск
Докато използването на CPU е полезно, процентите рядко разказват цялата история. Устойчивото натоварване на процесора, активността на процесите и променливите модели на използване предоставят повече контекст относно общите операции, отколкото изолирани върхове.
Мониторингът на паметта трябва по подобен начин да идентифицира устойчивото потребление, натиска при странициране и необичайния растеж, вместо просто да показва текущото използване на RAM. Мониторингът на диска трябва да включва както капацитет, така и активност, тъй като сървърът може да има достатъчно свободно хранилище, докато среща задръстване при I/O или да работи нормално, докато наличният капацитет приближава критично ниво.
Ръководството за производителност на Windows Server на Microsoft използва броячи за процесора, паметта, логическите и физическите дискове, процесите и други компоненти, за да изследва системните задръствания. Важната точка за планиране на замяната е да се запази достатъчна дълбочина, за да се разбере защо се променя потреблението на ресурси, а не просто дали е високо.
Процеси и критични услуги
Здравето на операционната система е само част от картината.
Windows Server машина може да бъде активна и работеща, дори когато приложението, процесът или услугата, които потребителите всъщност искат да стартират, са спрели да работят. Изискванията за мониторинг трябва да отразяват ролята на всеки сървър и услугите, които са необходими за изпълнение на тази роля.
Сървър на Internet Information Services (IIS), сървър на база данни, контролер на домейн и хост на сесии за Remote Desktop нямат идентични изисквания. Полезна замяна би позволила на администраторите да наблюдават какво е важно за всеки сървър, вместо просто да въвеждат едно единствено определение за здраве за цялата среда.
Мрежова и честотна активност
Неочаквани трафик модели, мрежови грешки или необичайно потребление на честотна лента може да разкрие както проблеми с производителността, така и с инфраструктурата.
Мрежовата видимост става особено полезна, когато администраторите трябва да определят дали бавната производителност на приложението произтича от сървъра, мрежата или друга зависима система.
Замяна на мониторинг на Windows Server не е задължително да стане пълна платформа за мониторинг на мрежата. Тя обаче трябва да предоставя нивото на видимост в мрежата, което нормалните процеси за отстраняване на проблеми на вашия екип изискват.
Събития, Приложения и Работни натоварвания
За някои организации общите метрики на операционната система са достатъчни. За други те са само началото.
Windows Server средища могат да хостват услуги на домейн Active Directory, IIS, SQL Server, Hyper-V и други натоварвания с техните собствени индикатори за здраве. Основното наблюдение на CPU, памет и диск не може да разкрие всяка специфична за натоварването неизправност.
Това създава важен критерий за замяна: нуждае ли се организацията основно от общо наблюдение на здравето на Windows Server, или изисква дълбока видимост в специфични работни натоварвания и приложения на Microsoft?
Отговорът може значително да промени кой тип платформа за мониторинг е подходяща.
Какво трябва да подобри замената?
Поддържането на жизненоважно покритие за мониторинг е само част от задачата. Новата система трябва също така да разреши оперативните ограничения, които са довели до подмяната.
Четири функции заслужават специално внимание.
Централизирана видимост
Администраторите трябва да могат да оценят състоянието на много наблюдавани сървъри, без да преминават през трудността да се свързват всеки път или да използват набор от различни инструменти.
Централизацията ще стане по-важна, тъй като инфраструктурата се разширява до множество локации, виртуални инстанции, отдалечени сървъри или клиентски помещения. Целта не е да се създаде поредната табло за управление, а да се предостави на администраторите преглед, от който те могат да идентифицират областите, в които е необходимо по-близко проучване.
Исторически данни и базови стойности
Мониторинг в реално време отговаря на въпроса „Какво се случва сега?“, но историческият мониторинг отговаря на също толкова важния въпрос „Дали това, което се случва сега, е нещо, което трябва да се случва?“
Сървър, който работи с 70% използване на паметта, може да бъде напълно здрав, ако това е максималното ниво, до което достига, но бавното покачване от 30% до 70% използване също може да бъде началото на важен инцидент.
Историческите данни позволяват на ИТ екипите да установяване на основни нива на производителност задълбочете се в повтарящите се инциденти, за да откриете техните основни причини, планирайте капацитета и правете оценки относно това дали промените в инфраструктурата са оказали положително или отрицателно влияние върху производителността. Следователно, замяната трябва да бъде оценена на базата на способността да предоставя стойност от исторически данни, както и какво предлага за табла с данни в реално време.
Действащи известия
Оценките за замяна трябва да надхвърлят бинарното разграничение дали платформа „поддържа известия“.
Администраторите ще искат да знаят дали праговете могат да бъдат настроени спрямо тяхната среда, кой получава известия и дали известията правят разграничаването между преходни аномалии и условия, изискващи намеса, практично.
Целта не е да се генерират повече предупреждения. Тя е да се намали шумът и да се затрудни пренебрегването на важни условия.
Полезно отчитане
Докладите са полезни като средство за предаване на информация, която трябва да бъде прегледана за период от време или докладвана извън администратора, който в момента преглежда таблото.
Те могат да помогнат на ИТ персонала да прегледа потреблението на ресурси, да разследва повтарящи се проблеми, да документира наличността или да предостави информация за инфраструктурата на клиенти и управление. Планирането на отчети може да спести на администраторите ръчния труд по многократно извличане на същата информация.
Ключовият критерий не е броят на наличните шаблони за отчети, а че отчетите адресират оперативни въпроси, които организацията наистина трябва да зададе.
Нуждаете ли се от мониторинг на сървъри или пълна наблюдаемост?
Това може да бъде най-критичното решение за обхвата при избора на заместител за мониторинг на Windows Server. Съвременните платформи за наблюдение могат да приемат метрики и логове от инфраструктурата, като същевременно поддържат трасета, мониторинг на производителността на приложенията, облачни услуги, контейнери и мащабна телеметрия.
За разпределени приложения, микросервизи или сложни хибридни облачни среди, тези възможности могат да бъдат съществени.
Когато мониторингът на сървъра е достатъчен
Не винаги са съществени за всяка среда на Windows сървър, обаче.
ИТ екип, който е изцяло фокусиран върху производителността на сървъра, процесите, потребителите, пропускателната способност, уебсайтовете, известията и тенденциите в инфраструктурата, може да не се възползва от въвеждането на архитектура за наблюдаемост, която добавя допълнителни телеметрични канали, изисквания за съхранение и специализирана администрация.
Когато по-широката наблюдаемост стане необходима
Обратното също е вярно. Платформа за мониторинг на сървъри, която е фокусирана, може да бъде недостатъчна, ако инженерите изискват разпределено проследяване, картографиране на зависимостите на приложенията, централизирана аналитика на логовете или детайлен мониторинг на производителността на приложенията.
Решението е, следователно, за обхват повече, отколкото коя опция е по-усъвършенствана. Изберете наблюдение на сървъра когато благосъстоянието на инфраструктурата и оперативната видимост са изискване. Изберете по-широка наблюдаемост, когато отстраняването на проблеми изисква администратори или инженери да свързват поведението на инфраструктурата с приложения, журнали, следи и разпределени услуги.
Правилната замяна е платформата, която предоставя необходимата дълбочина, без да усложнява ненужно архитектурата на мониторинга.
Как да сравните заместителите на мониторинг на Windows Server?
След като изискванията и обхватът бъдат определени, сравнението на продуктите става много по-полезно.
Вместо да започвате с характеристиките на различни доставчици, сравнете продуктите спрямо същия набор от въпроси:
- Поддържа ли версиите на Windows Server и ролите на сървъра, които използвате?
- Може ли да наблюдава CPU, памет, дискове, процеси и услуги, и мрежова активност до необходимата степен?
- Могат ли администраторите да наблюдават множество сървъри от централна конзола?
- Запазва ли достатъчно историческа информация, за да идентифицира тенденции и да разследва инциденти?
- Могат ли праговите стойности и известията да бъдат персонализирани за вашата среда?
- Предоставя ли отчетите, необходими на администраторите, управлението или клиентите?
- Колко инфраструктура е необходима за работа на системата за мониторинг?
- Зависи ли мониторингът от агенти, дистанционно проучване или друг метод за събиране?
- Как се променя лицензиране, когато инфраструктурата, която се наблюдава, нараства?
Изисква ли екипът наблюдение на натоварването, специфично за Windows, или по-широка видимост?
Това създава много по-полезно сравнение от броя на функциите на страницата на продукта.
Дълбочината на мониторинга, сложността на внедряването, администрирането, качеството на известията, лицензиране и времето до стойност всички влияят на стойността на платформата. По-малката опция може да се окаже по-подходяща от оперативна гледна точка в сравнение с по-голямата платформа поради по-малките разходи и удовлетворяване на изискванията, необходими на организацията.
Как можете да замените система за мониторинг, без да загубите видимост?
Смяната на софтуера за мониторинг представлява определен рисков фактор, тъй като винаги съществува възможност видимостта да намалее по време на критичния момент на преход, когато организацията заменя софтуера, който предоставя такава услуга.
Процесът на миграция ще бъде по-малко рисков, ако е етапен.
Наблюдение на съществуващото покритие на инвентара
Настоящата система трябва да бъде инвентаризирана, за да се установи основа за това какво новото средство трябва да наблюдава, преди да започне процесът на миграция и да бъдат свалени каквито и да е компоненти.
Инвентаризацията трябва да включва всички сървъри, уебсайтове, програми, услуги, най-важните показатели за производителност, прагове, известия и отчети.
Особено внимание трябва да се обърне на персонализираните проверки, създадени с времето, които могат да са загубили значението си за онзи, който поддържа системата след миграцията. Този базов инвентар след това ще служи като критично покритие за валидиране на замяната.
Установяване на текущи базови линии
Запишете нормалната производителност преди миграцията.
Използването на CPU, консумацията на памет, активността на диска и пропускателната способност варират в зависимост от натоварването и ролята на сървъра. Контролер на домейн не е задължително да има същото нормално поведение като приложение или база данни.
Съществуващата базова информация предоставя на администраторите справка за конфигуриране и оценка на новата платформа.
Стартирайте и двете системи за мониторинг временно
Където е възможно, поддържайте съществуващите и заменящите системи в работно състояние през целия преход.
Паралелното наблюдение помага на администраторите да проверят, че събраната информация и за двете системи е последователна и важни елементи не липсват. То също така е полезно за идентифициране на всякакви разлики в интервала на събиране, методите на измерване и други фактори, преди заменящата система да бъде напълно внедрена.
Новите и старите платформи не е необходимо да предоставят точно същите данни, но трябва да позволят на администраторите да получат необходимата информация.
Проверка на обхвата на мониторинга
Сравнете новата платформа с инвентара, който беше създаден преди мигрирането към нея.
Уверете се, че важните сървъри, услуги, уебсайтове, метрики и други наблюдавани ресурси са отчетени. Това е също добро време да се обмисли дали наследствените проверки имат стойност, оперативна, или просто отново прилагат стари конфигурации сляпо.
Инициативата за замяна трябва да се стреми да запази видимостта, която беше необходима, но не и сложността, която не беше.
Тестови известия преди да се откаже старата платформа
Не предполагайте, че предупреждението ще работи само защото е зададен праг.
Убедете се, че очакваните условия изпращат известия, че те се доставят на правилните хора и че праговете не са зададени твърде високо/ниско. Където е възможно, наблюдавайте замяната да премине през достатъчно нормални вариации в натоварването, за да видите очевиден шум от известия.
Декомисирайте старата платформа само след като сте наблюдавали покритие и известяване.
Търсите ли по-просто решение за мониторинг на Windows Server?
Не всяка организация се нуждае от платформа за наблюдение в мащаб на предприятие, за да поддържа полезна видимост над своята сървърна инфраструктура. За ИТ екипи, които основно наблюдават здравето на сървъра, потреблението на ресурси, процесите, пропускателната способност, потребителите и уебсайтовете, фокусирано решение може да предостави необходимата оперативна видимост, без да въвежда ненужна сложност в наблюдението.
TSplus Сървърно наблюдение централизиране на мониторинг в реално време и исторически мониторинг на Windows и Linux сървъри и уебсайтове, с конфигурируеми известия и персонализирани отчети. Администраторите могат да следят CPU, памет, дискова активност, процеси, пропускна способност и свързани потребители от едно място, което го прави практичен вариант за замяна на фрагментирана или прекалено сложна настройка за мониторинг.
Заключение
Изборът на заместител за мониторинг на Windows Server започва с разбирането защо съществуващата настройка вече не работи и определянето на видимостта, от която инфраструктурата ви всъщност се нуждае. Покритие на мониторинга, действия при известия, исторически данни, отчети, администриране и мащабируемост са по-важни от просто избиране на платформата с най-дългия списък от функции.
След като бъде установен правилният обхват, мигрирайте постепенно и валидирайте обхвата на мониторинга, преди да изключите съществуващата система. Целта не е да се възпроизведе всяка наследена конфигурация, а да се запази основната видимост, докато се намалят разходите, сложността или оперативните ограничения, които са довели до замяната в първия случай.