Wprowadzenie
Środowiska zdalnego pulpitu generują kilka warstw danych operacyjnych, od użycia CPU i pamięci po podłączonych użytkowników, jednoczesne sesje i zapotrzebowanie na aplikacje. Wyzwanie polega na określeniu, które sygnały są istotne i jak się one odnoszą do siebie. Ten artykuł wyjaśnia, co śledzi oprogramowanie do monitorowania zdalnego pulpitu, jak widoczność sesji różni się od monitorowania serwera oraz jak zespoły IT mogą wykorzystać dane w czasie rzeczywistym i historyczne do diagnozowania problemów z wydajnością.
Co faktycznie monitoruje oprogramowanie do monitorowania pulpitu zdalnego?
Monitorowanie pulpitu zdalnego obejmuje szereg koncepcji. Niektóre narzędzia koncentrują się na zasobach po stronie serwera, podczas gdy inne inwentaryzują połączenia za pomocą protokołu pulpitu zdalnego (RDP) lub usług pulpitu zdalnego (RDS). Narzędzia, które przyjmują podejście skoncentrowane na bezpieczeństwie, mogą audytować i rejestrować aktywność użytkowników.
Dla IT sensowne jest podzielenie tych narzędzi na 5 kategorii:
| Warstwa monitorująca | Co to odpowiada | Typowe informacje |
|---|---|---|
| Infrastruktura | Czy host jest zdrowy? | CPU, pamięć, dysk, przepustowość, dostępność |
| Połączenie | Kto się połączył i kiedy? | Użytkownik, czas logowania, status połączenia |
| Sesja | Co się dzieje podczas sesji zdalnych? | Użytkownicy połączeni, sesje równoległe, czas trwania, stan sesji |
| Doświadczenie użytkownika | Czy sesja zdalna jest responsywna? | Opóźnienie wejścia, opóźnienie, opóźnienia logowania, responsywność aplikacji |
| Aktywność | Jakie aplikacje lub działania są zaangażowane? | Użycie aplikacji, procesy, zdarzenia audytu lub nagrania sesji |
Te kwestie są ze sobą powiązane, ale niekoniecznie zamienne, ponieważ jedna może zgłaszać nasycenie CPU, ale nie ujawniać, która sesja była pierwsza dotknięta, podczas gdy platforma audytowa może zidentyfikować, kto się połączył, ale nie wyjaśniać, dlaczego wydajność się pogorszyła.
Oprogramowanie do nagrywania sesji idzie o krok dalej, zbierając szczegółowe dowody na to, co miało miejsce w kontekście zdalnego środowiska, wprowadzając dodatkowe kwestie związane z bezpieczeństwem, prywatnością oraz przechowywaniem i retencją danych.
Pierwszym wyzwaniem w porównywaniu oprogramowania do monitorowania pulpitu zdalnego jest zidentyfikowanie widoczności, której IT rzeczywiście potrzebuje.
Dlaczego widoczność na poziomie sesji różni się od monitorowania serwera?
Tradycyjny monitorowanie serwera narzędzia pytają, czy maszyna działa poprawnie. Czy wykorzystanie CPU jest wysokie? Pamięć niska? Czy wykorzystanie dysku rośnie? Czy serwer jest online?
Te metryki są nadal istotne w scenariuszu hostingu RDS, ale należy wziąć pod uwagę jeszcze jeden aspekt. Wspólna infrastruktura RDS oznacza, że na poziomie hosta CPU, pamięć, przechowywanie i pojemność sieci są rozdzielane pomiędzy wielu użytkowników i aplikacje.
Na poziomie sesji aplikacje i procesy każdego użytkownika mają unikalne wymagania. Host sesji RD może być ogólnie zdrowy, podczas gdy aplikacje jednego użytkownika mogą się zawieszać, lub jedna wolna sesja nie oznacza, że cały serwer jest przeciążony.
Różnica ma znaczenie w kontekście rozwiązywania problemów. Jeśli dziesięciu użytkowników na tym samym serwerze zaczyna zwalniać w tym samym czasie, sensowne jest najpierw przyjrzenie się wspólnym zasobom serwera. Jeśli tylko jeden użytkownik ma problemy, problem prawdopodobnie jest ograniczony do tej sesji, jej aplikacji i połączenia.
Narzędzia do monitorowania pulpitu zdalnego są najbardziej skuteczne, gdy umożliwiają administratorom przełączanie się między tymi perspektywami i nawiązywanie powiązań między ogólnym stanem serwera a stanem poszczególnych sesji użytkowników.
Jakie są najważniejsze metryki zdalnego pulpitu?
Żaden wskaźnik nie reguluje zdrowia środowiska pulpitu zdalnego. Administratorzy potrzebują wystarczającego kontekstu, aby zinterpretować bieżące obciążenie, zużycie zasobów i doświadczenie użytkownika.
Ile użytkowników i sesji jest aktywnych?
Liczby sesji stanowią podstawę tej rozmowy.
Relewantne dane obejmują podłączonych użytkowników, aktywne i rozłączone sesje, liczby sesji równoległych , dystrybucja na serwerach, okresy szczytowe i historyczna współbieżność.
Trendy dotyczące współbieżności mają pierwszeństwo przed liczebnością przy ocenie wydajności systemu pulpitu zdalnego, ponieważ pojemność jest zazwyczaj definiowana przez równoczesne obciążenie, a nie przez liczbę zarejestrowanych użytkowników. Maszyna obsługująca 200 użytkowników okazjonalnych może być znacznie bardziej obciążona niż liczba równoczesnych sesji wynosząca 40 użytkowników uruchamiających aplikacje o wysokiej wydajności.
Wartość metryk współbieżności, uzupełniona statystykami infrastruktury, ma na celu ustalenie, czy istnieje korelacja między wzrostem liczby podłączonych użytkowników a wzrostem zużycia zasobów.
Czy zasoby serwera nadążają za zapotrzebowaniem na sesje?
CPU, pamięć, aktywność dysku i dostępna pamięć są nadal kluczowymi wskaźnikami do monitorowania zdalnego pulpitu.
Interesujące pytanie nie brzmi, czy CPU osiągnęło określony procent, ale kiedy było pod presją i co jeszcze działo się w tym samym czasie.
Stały wzrost CPU, na przykład, może korelować z porannym szczytem logowania, zwiększoną liczbą jednoczesnych sesji, zaplanowanym procesem lub intensywnym użyciem konkretnej aplikacji biznesowej.
Połączenie między nimi jest zazwyczaj ważniejsze niż wartość użytkowania.
Które aplikacje i procesy generują obciążenie?
Widoczność aplikacji wnosi dodatkowy kontekst.
Zrozumienie używanych aplikacji, gdy popyt wzrasta i które procesy zużywają najwięcej zasobów, umożliwia administratorom powiązanie aktywności użytkowników z zachowaniem infrastruktury.
Monitorowanie aplikacji może odpowiedzieć na te rodzaje pytań. Czy problem z wydajnością pojawia się, gdy konkretna aplikacja jest intensywnie używana? Czy są hosty sesji uruchamiające bardziej intensywny zestaw aplikacji? Czy aplikacje są utrzymywane lub licencjonowane, które są rzadko używane?
Ta informacja ma wartość, nie tylko dla rozwiązywania problemów, ale także dla ogólnej administracji infrastrukturą i oprogramowaniem.
Czy sieć lub doświadczenie użytkownika przyczyniają się do problemu?
Sesje pulpitu zdalnego są z natury interaktywne, co sprawia, że problemy z siecią lub responsywnością są natychmiast widoczne dla użytkowników końcowych.
Potrzeby dotyczące przepustowości należy ocenić w połączeniu z innymi wskaźnikami wydajności serwera, ponieważ serwer może mieć wolne zasoby CPU i pamięci, podczas gdy połączenia są spowolnione przez wąskie gardło w innym miejscu w łańcuchu komunikacyjnym. Zrozumienie Wydajność RDP w sieciach o wysokiej latencji może pomóc odróżnić problemy z responsywnością sieci od ograniczeń zasobów po stronie hosta.
Niektóre środowiska RDS mogą oferować więcej informacji o doświadczeniach użytkowników końcowych niż inne. Monitor wydajności Microsoftu, na przykład, ma liczniki opóźnienia wejścia użytkownika, które mogą identyfikować opóźnienia na poziomie sesji i procesów. Microsoft dokumentuje tę funkcję jako metodę korelowania numerów sesji, użycia CPU i responsywności na serwerach RD Session Host.
Nie wszystkie narzędzia do monitorowania pulpitu zdalnego zawierają te same metryki opóźnienia lub opóźnienia wejścia. Administratorzy IT powinni dokładnie sprawdzić, co dostawca rzeczywiście oferuje w zakresie informacji o doświadczeniach użytkowników, zamiast zakładać, że będą one dostępne.
Jak monitorowanie pulpitu zdalnego może pomóc Twojemu zespołowi, gdy musisz rozwiązywać problemy z wolnymi sesjami?
Wartość monitorowania pulpitu zdalnego najlepiej widać, gdy administratorzy zbierają wiele sygnałów i korelują je.
Kiedy użytkownik wskazuje, że RDP jest wolny, opisuje efekt, a nie przyczynę. Twoim pierwszym priorytetem jest zrozumienie zakresu problemu.
Czy jeden użytkownik ma problemy? Czy jest kilku użytkowników na tym samym hoście? Czy są użytkownicy na wielu serwerach z tym samym problemem?
Z określonym zakresem problemu, Twoje spostrzeżenia dotyczące monitorowania mogą pomóc w ukierunkowaniu poszukiwań:
| Objaw | Przydatne kontrole |
|---|---|
| Jeden użytkownik jest wolny | Stan sesji, aplikacje, procesy, warunki połączenia |
| Większość użytkowników na jednym serwerze jest wolna | CPU, pamięć, dysk I/O, użycie procesora, sesje równoległe |
| Użytkownicy na kilku serwerach są wolni | Wspólne zależności sieciowe lub infrastrukturalne |
| Wydajność pogarsza się codziennie w tym samym czasie | Współbieżność, zaplanowane zadania, szczyty aplikacji |
| Użytkownicy są często rozłączani | Dostępność serwera, warunki sieciowe, zdarzenia usługi i połączenia |
| Jedna aplikacja wielokrotnie działa źle | Użycie aplikacji, związane procesy i zużycie zasobów |
Celem jest korelacja. Wzrosty CPU mają większe znaczenie w kontekście zwiększonej współbieżności. Wysokie wykorzystanie pasma jest bardziej godne uwagi w obliczu wielu skarg użytkowników. Powtarzający się problem z wydajnością jest łatwiejszy do zidentyfikowania, gdy wiesz, że ta sama aplikacja lub obciążenie występuje za każdym razem.
Monitoring nie zawsze identyfikuje przyczynę, ale rejestruje kontekst operacyjny potrzebny administratorom do zawężenia pola możliwych podejrzanych.
Rozwiązywanie problemów na podstawie pamięci po fakcie nie jest tym samym, co inspekcja środowiska w momencie incydentu.
Monitorowanie w czasie rzeczywistym, powiadomienia i raporty historyczne: dlaczego to wszystko ma znaczenie?
Monitoring przynosi korzyści, gdy umożliwia odpowiedzenie na trzy różne pytania operacyjne: co się obecnie dzieje, kiedy IT powinno podjąć działania i co miało miejsce wcześniej?
Co się teraz dzieje?
Monitorowanie w czasie rzeczywistym może być wykorzystywane przez administratorów do badania bieżącej wydajności serwera, zalogowanych użytkowników, procesów aplikacji i aktywności sieciowej.
Ta informacja może okazać się kluczowa podczas incydentu, ponieważ umożliwia administratorowi ustalenie, czy nadal występuje obciążenie zasobów lub nietypowe obciążenie.
Wartość w czasie rzeczywistym dostarcza aktualnych danych, ale to wszystko. Metryka jest obecnie tylko informacyjna. Coś, co teraz wydaje się normalne, mogło być nienormalne, gdy użytkownik doświadczał problemu.
Kiedy coś wymaga uwagi?
Alerty przekształcają monitorowanie z pasywnego zbierania danych w proaktywny i operacyjny proces.
Administratorzy określają, co zasługuje na uwagę: stałe użycie procesora, presja pamięci, aktywność dysku, nadmierna liczba aktywnych użytkowników lub przestoje serwera.
Progi monitorowania wciąż należy stosować zdrowy rozsądek; krótki wzrost aktywności CPU jest do przewidzenia, ale powtarzające się obciążenie w godzinach szczytu może wskazywać na pojawiający się problem z pojemnością.
Co się wydarzyło przed incydentem?
Raporty historyczne ujawniają wzorce, których nie mogą pokazać metryki na żywo. Microsoft zaleca korzystanie z Zbieranie danych z Monitorowania Wydajności aby rejestrować liczniki wydajności w czasie podczas badania sporadycznych problemów z wydajnością serwera Windows.
Mówi, że CPU osiąga 90 procent przez pięć minut. Jeśli to jest odosobniony przypadek w znanym procesie wsadowym, może to nie wskazywać na problem. Ale jeśli CPU osiąga 90 procent w każdy dzień roboczy o mniej więcej tej samej porze, gdy współbieżność przekracza dany próg, to jest to cenny kawałek informacji do planowania pojemności.
Historyczne punkty odniesienia są często ważniejsze niż poszczególne progi, ponieważ pokazują, co jest normalne dla danego serwera, zestawu aplikacji i populacji użytkowników.
W jakich przypadkach natywne narzędzia monitorowania systemu Windows są wystarczające?
Windows zapewnia dość solidny zestaw narzędzi do rozwiązywania problemów.
Menedżer zadań i Monitor zasobów wyświetlają bieżące wykorzystanie zasobów. Monitor wydajności może zbierać liczniki wydajności systemu Windows, w tym opóźnienie wejścia użytkownika na poziomie sesji i procesu w obsługiwanych wersjach systemu Windows Server. Podgląd zdarzeń przedstawia zdarzenia związane z systemem operacyjnym i RDS, podczas gdy PowerShell może być używany do zapytań i automatyzacji wielu zadań administracyjnych.
Dla rozwiązywania problemów z pojedynczym serwerem lub badania konkretnego problemu, te narzędzia mogą okazać się wystarczające dla doświadczonego administratora.
Jednak potrzeba monitorowania wielu serwerów lub przeglądania sytuacji z perspektywy wcześniejszego zdarzenia może wymagać pozyskania informacji z wielu źródeł.
Centralne monitorowanie jest przydatne w sytuacjach, gdy IT musi monitorować więcej niż jeden host za pomocą jednej konsoli, zapisywać informacje historyczne do późniejszego wykorzystania, porównywać systemy i ramy czasowe, raportować aktywność użytkowników i współbieżność lub ustawiać powiadomienia.
Wartość takiego podejścia niekoniecznie tkwi w metrykach, których Windows nie dostarcza.
Raczej chodzi o zdolność do konsolidacji, przechowywania i korelowania tych informacji, aby uczynić je bardziej użytecznymi dla administratorów.
Czy to oznacza, że nagrywasz użytkowników, jeśli korzystasz z monitorowania sesji pulpitu zdalnego?
Nie. Terminy te są często używane zamiennie, ale monitorowanie sesji i nagrywanie sesji mają znacznie różny zakres i możliwości.
Podczas gdy monitorowanie sesji pulpitu zdalnego może jedynie obserwować podłączonych użytkowników, równoległe sesje, wykorzystanie zasobów, historię sesji lub użycie aplikacji, nagrywanie sesji uchwyci znacznie bardziej szczegółowy zestaw danych dotyczących działań w ramach sesji zdalnej, w zależności od produktu, takich jak zawartość ekranu, działania aplikacji, działania schowka lub inne zdarzenia.
Nagrywanie sesji może mieć sens w przypadku konkretnych scenariuszy związanych z dostępem uprzywilejowanym, dostępem osób trzecich, audytem lub bezpieczeństwem, ale rodzi dodatkowe pytania dotyczące przechowywania, dostępu, przechowywania danych i prywatności.
Dla większości codziennych operacji zdalnego pulpitu możliwość rejestrowania wszystkich szczegółów sesji jest niepotrzebna i niepożądana przez zespół IT, ponieważ potrzebują oni tylko wystarczających informacji o sesji do obserwacji wydajności i celów analizy.
Jak możesz poprawić planowanie pojemności, korzystając z monitorowania pulpitu zdalnego?
Kiedy mowa o infrastrukturze pulpitu zdalnego, gęstość obciążenia jest ważnym czynnikiem.
Liczba skonfigurowanych kont niewiele mówi o liczbie jednoczesnych użytkowników, aplikacjach, które uruchamiają, i ich intensywności.
Monitorowanie historyczne sprawia, że informacje są dostępne.
Analizując jednoczesnych użytkowników i porównując ich z wykorzystaniem CPU, pamięci, dysku i sieci, administratorzy IT zyskują praktyczne informacje o swoim środowisku. Widzą, kiedy obciążenia zaczynają wpływać na infrastrukturę, które obciążenia są odpowiedzialne i czy trend rośnie.
Ta informacja może być wykorzystana do uzasadnienia działań, takich jak równoważenie obciążenia między hostami, dodawanie kolejnych serwerów, dodawanie większej ilości zasobów do istniejących serwerów, planowanie ciężkich aplikacji lub badanie aplikacji, które zużywają nieproporcjonalnie dużą ilość zasobów.
To podejście jest znacznie dokładniejsze niż ogólna rekomendacja oparta na użytkownikach na serwer. Microsofta Wytyczne dotyczące rozmiaru hosta sesji pulpitu zdalnego podobnie zaleca ocenę rodzaju obciążenia, gęstości użytkowników i pomiarów doświadczeń użytkowników, zamiast polegać na jednej ogólnej wartości pojemności. Dwie firmy z tą samą bazą użytkowników mogą mieć znacznie różne wymagania dotyczące aplikacji i infrastruktury.
Jakie wymagania powinieneś brać pod uwagę, gdy szukasz oprogramowania do monitorowania pulpitu zdalnego?
Najlepsze oprogramowanie do monitorowania pulpitu zdalnego niekoniecznie jest produktem, który zbiera najwięcej danych. To ten, który zapewnia poziom widoczności potrzebny do zarządzanego środowiska.
Dla większości zespołów operacji IT kluczowe wymagania są proste:
- c centralizowana widoczność na wielu serwerach
- aktualni użytkownicy i informacje o sesjach równoległych
- monitorowanie CPU, pamięci, dysku i sieci
- widoczność aplikacji i procesów
- raporty historyczne i analiza trendów
- konfigurowalne powiadomienia
- praktyczne opcje raportowania i eksportu
Platforma powinna również ułatwiać korelację. Liczba sesji staje się bardziej wartościowa, gdy administratorzy mogą porównywać je z obciążeniem serwera. Użycie aplikacji staje się bardziej przydatne, gdy można je analizować w czasie.
Wdrożenie i administracja również mają znaczenie. Platforma monitorująca, mająca na celu uproszczenie zdalnej infrastruktury, nie powinna wprowadzać nieproporcjonalnej złożoności infrastruktury lub zarządzania.
Na koniec zweryfikuj dokładnie, co dostawcy mają na myśli przez takie terminy jak monitorowanie sesji, monitorowanie użytkowników i monitorowanie pulpitu zdalnego. Jedna platforma może oznaczać raportowanie użytkowników połączonych, inna może dostarczać metryki responsywności RDP, podczas gdy jeszcze inna może oferować pełne nagrywanie ekranu.
Terminologia może brzmieć podobnie. Dostarczona widoczność może być bardzo różna.
Jak TSplus może uprościć monitorowanie pulpitu zdalnego?
Dla zespołów IT zarządzających infrastrukturą zdalnego pulpitu Windows, wprowadzamy aktywność serwera i użytkowników do scentralizowanego środowiska monitorowania. Administratorzy mogą śledzić użycie CPU, pamięci, dysku i przepustowości, a także monitorować podłączonych użytkowników, jednoczesne sesje i aktywność aplikacji, co pomaga im powiązać wydajność infrastruktury z rzeczywistym zapotrzebowaniem na zdalny pulpit.
TSplus Monitorowanie Serwera również zapewnia raportowanie historyczne i konfigurowalne powiadomienia, dzięki czemu administratorzy mogą identyfikować powtarzające się wzorce obciążenia zamiast polegać tylko na metrykach na żywo. Ułatwia to badanie problemów z wydajnością, ustalanie praktycznych punktów odniesienia i przewidywanie wymagań dotyczących pojemności na wielu serwerach bez wprowadzania pełnego nagrywania sesji użytkowników.
Wniosek
Skuteczne monitorowanie pulpitu zdalnego polega na korelacji, a nie na zbieraniu jak największego zestawu metryk. Wydajność serwera, aktywność sesji, zapotrzebowanie na aplikacje i warunki sieciowe stają się bardziej użyteczne, gdy administratorzy mogą je analizować razem.
Widok ten pomaga działowi IT odróżnić izolowane problemy użytkowników od wąskich gardeł w całym hoście, zrozumieć powtarzające się wzorce wydajności i podejmować lepsze decyzje dotyczące pojemności w miarę rozwoju środowisk pulpitu zdalnego.