Wprowadzenie
Problemy z wydajnością Citrix rzadko zaczynają się od całkowitego awarii. Logowania mogą się wydłużać, jeden VDA może odbiegać od swoich rówieśników, awarie połączeń mogą wzrastać lub opóźnienia sesji mogą rosnąć w przewidywalnych momentach. Skuteczne monitorowanie pomaga zespołom IT wcześnie wykrywać te zmiany i odróżniać izolowane objawy od szerszych problemów z infrastrukturą, siecią lub pojemnością.
Artykuł ten przygląda się narzędziom, metrykom i wczesnym sygnałom ostrzegawczym, które pomagają administratorom skuteczniej diagnozować problemy z Citrix.
Jakie rodzaje warstw powinny być objęte monitoringiem Citrix?
Istnieje wiele ściśle powiązanych komponentów Citrix Virtual Apps i Desktop, które należy wziąć pod uwagę. Sesja użytkownika może obejmować brokerowanie, uwierzytelnianie, VDA, usługi Windows, profile użytkowników, GPO, przechowywanie, aplikacje i połączenia sieciowe, zanim aplikacja lub pulpit będą dostępne do użycia. Dobre monitorowanie Citrix wymaga widoczności czterech subtelności.
Na warstwie sesji administratorzy chcą wiedzieć, czy użytkownicy mogą się połączyć, jak długo trwają logowania i czy sesje nadal odpowiadają.
Na warstwie dostarczania Citrix monitoring może wykryć, że maszyny są uruchomione i zarejestrowane, połączenia nie powiodły się oraz jak obciążenie jest zrównoważone.
Na poziomie infrastruktury można testować CPU, pamięć, przechowywanie i usługi systemu Windows, aby upewnić się, że systemy hostingowe są zdolne.
I na poziomie sieciowym/historycznym musisz zobaczyć, że opóźnienie nie wpływa na odpowiedź sesji oraz że zapotrzebowanie na pamięć masową i inne zasoby nie rośnie z czasem.
Sztuczka polega na tym, aby nie śledzić każdego dostępnego licznika, ale aby podążać za problemem od objawu do prawdopodobnej warstwy infrastruktury.
Jakie narzędzia są przydatne w każdym przypadku użycia?
Żaden rodzaj monitorowania nie daje równie dobrego wglądu we wszystkie Twoje aplikacje i usługi. Najlepszy zestaw narzędzi zależy od tego, co chcesz zobaczyć i rozwiązać.
Citrix Monitor i Director
To jest miejsce, w którym własne narzędzia monitorujące Citrixa są rozsądnie pierwszym miejscem do poszukiwań.
Citrix Monitor dla Citrix DaaS i Director dla Citrix Virtual Apps i Desktops informuje o sesjach, połączeniach i awariach maszyn, czasie logowania, obciążeniu, wykorzystaniu maszyn i stanie maszyn. Możesz przeglądać trendy w czasie, aby porównać aktualną wydajność z danymi historycznymi, a nie porównywać aktualną wydajność z danym punktem w czasie.
To monitorowanie rzuca światło na sam proces monitorowania.
Na przykład, Citrix może ci zapewnić a rozbicie czasu logowania i gdzie występuje opóźnienie: broker, uruchamianie maszyny, HDX, skrypty logowania, zasady grupy, uwierzytelnianie i tak dalej.
To znacznie lepszy sposób, aby przejść od skargi użytkownika "logowanie jest wolne" do bardziej użytecznego pytania dotyczącego rozwiązywania problemów: która część procesu logowania trwa dłużej, niż powinna?
Monitorowanie infrastruktury i serwera
Diagnostyka Citrix nie zastąpi jednak monitorowania podstawowej platformy dostarczania.
Monitorowanie serwera może pokazać stałe wykorzystanie CPU, presję pamięci, aktywność dysku, pojemność pamięci masowej oraz dziwne zachowanie procesów. Te odczyty są szczególnie cenne, jeśli problem występuje w Citrix, ale przyczyna leży głębiej w stosie.
Pomyśl o tym, jak zbadałbyś wzrost czasu logowania. Jeśli opóźnienie w przechowywaniu również jest wysokie, to profile i przechowywanie powinny zostać sprawdzone. Jeśli serwer jest w porządku, ale czasy logowania się wydłużają, to bardziej prawdopodobne jest, że problem leży w uwierzytelnianiu serwera, zasadach grupy lub innym czynniku dostarczania.
Historyczne monitorowanie infrastruktury pomaga również w planowaniu pojemności. Powolne zwiększanie zużycia zasobów w dniach lub tygodniach przed awarią serwera pokazuje, że istnieje limit dla punktu końcowego lub hosta, nie wyłączając faktycznie komponentu.
Monitorowanie sieci
Dostarczanie aplikacji i pulpitów na Citrix opiera się na dobrej łączności sieciowej między urządzeniem użytkownika a hostem.
Monitorowanie sieci może wykazać wzrost opóźnień, zatorów, przepustowości, niestabilności lub problemów związanych z witryną, których monitorowanie serwera nie może wyjaśnić.
Analiza wydajności sesji Citrix może również pokazać metryki takie jak opóźnienie ICA, Czas okrążenia ICA (RTT) , liczba klatek na sekundę, oraz wolny w porównaniu do zużytego pasma.
Te dane są szczególnie ważne, gdy użytkownicy udają się połączyć, ale mówią, że ich aplikacje lub pulpity wydają się wolne.
Doświadczenie cyfrowe i monitorowanie pełnego stosu
W niektórych środowiskach musisz patrzeć dalej niż dostępność infrastruktury.
Monitorowanie doświadczeń cyfrowych i monitorowanie syntetyczne mogą naśladować lub obserwować aktywności użytkowników, takie jak logowanie, uruchamianie aplikacji i finalizowanie transakcji. Zamiast widzieć tylko odpowiadające serwery, celem jest potwierdzenie, że usługa działa dla użytkownika.
To rozróżnienie jest ważne, ponieważ dobra infrastruktura nie zapewnia dobrego doświadczenia użytkownika. Większe środowiska mogą również korzystać z platform do pełnej obserwowalności, które łączą sesję Citrix z VDA, zasobami systemu Windows, Active Directory, pamięcią masową, serwerami aplikacji i ścieżką sieciową.
Ale prawdopodobnie nie chcesz jeszcze więcej pulpitów nawigacyjnych. Platforma monitorująca sprawdza się najlepiej, gdy zawęża możliwe przyczyny i prowadzi administratorów do warstwy, która uległa zmianie.
Jakie są najważniejsze rodzaje metryk?
Istnieją tysiące liczników dostępnych z platformy Citrix. Najbardziej przydatne metryki to te, które odnoszą się do doświadczenia użytkownika, stanu infrastruktury lub jakiejkolwiek zmiany pojemności.
Czas logowania
Czas logowania jest jednym z najsilniejszych wskaźników skoncentrowanych na użytkowniku, ponieważ ujawnia wiele obszarów łańcucha dostaw.
Całkowity czas logowania jest główną miarą, ale może zaciemniać szczegóły podczas diagnozy. Citrix będzie w stanie odróżnić między brokerowaniem, uruchamianiem maszyny, połączeniem HDX, uwierzytelnianiem logowania, ładowaniem profilu, skryptami logowania i przetwarzaniem zasad grupy.
Jeśli czas ładowania profilu jest wydłużony, uwaga przesuwa się na magazyn zarządzania profilami. Długie przetwarzanie zasad grupowych przenosi badanie gdzie indziej. Powolne uruchamianie maszyny pozostawia VDA, system gospodarza lub platformę wirtualizacji w kadrze.
Całkowity czas trwania wskazuje, że coś jest inne, ale podział na fazy ujawnia, gdzie jest to inne.
Responsywność sesji
Ustanowiona sesja nie jest oznaką sesji responsywnej.
Metryki ICA RTT, latencji ICA, liczby klatek na sekundę i przepustowości mogą być używane do określenia, czy podłączony pulpit lub aplikacja działa zgodnie z oczekiwaniami.
Kontekst wciąż jest najważniejszy. Jeśli użytkownicy w jednym biurze są jedynymi, którzy tracą wydajność, prawdopodobnie problem leży w ścieżce sieciowej.
Awaria połączenia i maszyny
Całkowita utrata połączenia powinna być pilnie rozwiązana, ale trend może być bardziej znaczący niż jakiekolwiek pojedyncze zdarzenie.
Wzrost na tle rzadko zawodzących połączeń może być oznaką powoli pojawiającego się problemu, nawet jeśli większość użytkowników pozostaje połączona.
Administratorzy powinni zbadać rozkład awarii. Pojedyncza skrzynka, grupa dostawy, biuro lub okres czasu mogą być znacznie bardziej informacyjne niż lista wszystkich awarii.
Sesje równoległe i obciążenie
Liczba jednoczesnych sesji jest tłem dla większości metryk infrastruktury.
Wielki wzrost CPU podczas bardzo dużego skoku logowania to po prostu większe zapotrzebowanie. Ten sam wzrost zapotrzebowania na procesor bez zmiany liczby użytkowników ma inny powód.
Planowanie powinno uwzględniać trzy czynniki:
objętość sesji → obciążenie hosta → responsywność
Jeśli liczba sesji wzrasta bez odpowiadającego wzrostu obciążenia hosta lub czasu reakcji, system może nadal być w stanie to obsłużyć.
Jeśli ta sama liczba sesji powoduje większe obciążenie procesora, kontestację pamięci lub opóźnienia, to znaczy, że coś innego zmieniło się w obciążeniu.
CPU, pamięć i przechowywanie
Myśl o wykorzystaniu CPU, pamięci i pamięci masowej w kategoriach wzorców, a nie pojedynczych procentów.
Z krótkim skokiem CPU nie ma się czym martwić. Utrzymujące się użycie, powtarzająca się saturacja, rosnąca linia bazowa lub jeden host zużywający czas procesora w porównaniu do swoich kolegów jest znacznie bardziej istotne.
Pamięć można również postrzegać w perspektywie. Wysokie zużycie RAM-u samo w sobie jest problemem tylko wtedy, gdy występuje ciągły wzrost, nagłe skoki zużycia, nietypowe różnice między hostami lub RAM nie jest w stanie wrócić do swojego normalnego stanu po skoku.
Przechowywanie wymaga zarówno monitorowania pojemności, jak i wydajności. Spadająca ilość wolnego miejsca stanowi oczywiste ryzyko wydajności, podczas gdy wysoka latencja dysku lub kontencja pamięci spowolni profile, uruchamianie aplikacji i rozpoczynanie sesji w obecności dostępnej pojemności.
Jakie są wczesne oznaki ostrzegawcze przed napotkaniem problemów z Citrix?
Problemy z wydajnością w Citrix mają tendencję do pojawiania się jako odchylenia, zanim przerodzą się w awarie. Najlepszymi wczesnymi wskaźnikami są zatem zmiany w korelacjach między kilkoma licznikami, a nie pojedynczym licznikiem przekraczającym próg.
| Wczesny znak ostrzegawczy | Co zbadać następnie |
|---|---|
| Logowania stopniowo stają się wolniejsze | Fazy logowania, profile, Zasady grupy, uwierzytelnianie i przechowywanie |
| Awaria połączeń rośnie z niskiego poziomu podstawowego. | Maszyny, grupy dostawy, ostatnie zmiany i zachowanie sieci |
| Szczyty zasobów występują o tej samej porze każdego dnia | Logowanie burz, zaplanowane zadania, aplikacje i dostępna pojemność |
| Jeden host wielokrotnie zachowuje się inaczej niż jego rówieśnicy. | Procesy, usługi, konfiguracja i rozkład obciążenia |
| Opóźnienie sesji wzrasta, podczas gdy zasoby hosta pozostają normalne. | Ścieżka sieciowa, lokalizacja punktu końcowego i przepustowość |
| CPU lub pamięć wzrasta bez dodatkowych użytkowników | Aplikacje, procesy, poprawki i zmiany w konfiguracji |
| Dostępna przestrzeń dyskowa maleje w sposób przewidywalny | Profile, dzienniki, dane tymczasowe i przechowywanie aplikacji |
| Zmiany wydajności następują natychmiast po aktualizacji | Niedawne poprawki, zmiany w polityce, aplikacji lub konfiguracji |
Wspólnym elementem jest odchylenie od oczekiwanej normy. Monitorowanie staje się znacznie bardziej efektywne, gdy profesjonaliści IT zadają pytanie "czy ta wartość jest wysoka?" obok "dlaczego różni się od normy?"
Dlaczego powinieneś skupić się bardziej na bazach niż na stałych progach?
Wciąż wymagane są ustalone progi. Administratorzy potrzebują powiadomień, aby wiedzieć, zanim dyski się wyczerpią, zanim CPU osiągnie nasycenie i zanim usługa zawiedzie i wpłynie na dostępność.
Ale jedna, wszechstronna granica nie będzie pasować do wszystkich środowisk Citrix.
Załóżmy, że środowisko zazwyczaj zajmuje 15 sekund na zakończenie logowania użytkowników, a ten wskaźnik zaczyna wzrastać w kierunku 25 sekund i więcej. To obszar wart zbadania, nawet jeśli organizacja definiuje 30 sekund jako próg alarmowy.
W innym środowisku, gdzie prędkości logowania mogą zazwyczaj wynosić około 30 sekund, ta sama liczba byłaby mało istotna - kolejny przykład na to, jak różne wartości absolutne mogą mieć bardzo różne znaczenia w różnych okolicznościach.
W swojej zwykłej funkcji, punkty odniesienia mogą ostrzegać o:
- zmiany w wolnej wydajności
- aktualizacja postu skacze
- zmiany w szczytowych godzinach użytkowania
- rosnące obciążenia
- różnice między serwerami typu like
- ograniczenia pojemności budynku
Benchmark z powiadomieniami jest prosty: Powiadomienie o nienormalnej zmianie i absolutnych limitach.
Jak może Twój zespół IT skorelować Twoje metryki Citrix?
Indywidualne metryki Citrix naprawdę pokazują swoją wartość, gdy są skorelowane z zachowaniem infrastruktury i sieci. Pomyśl o tych powszechnych parowaniach:
| objaw Citrix | Dowody skorelowane | Kierunek dochodzenia |
|---|---|---|
| Logowania stają się wolniejsze | Opóźnienie dysku również wzrasta | Profile, przechowywanie i I/O dysku |
| Logowania stają się wolniejsze | CPU, pamięć i przechowywanie pozostają normalne | Uwierzytelnianie, GPO, profile, pośrednictwo lub inne etapy logowania |
| Odpowiedź sesji pogarsza się | Stan zdrowia hosta pozostaje stabilny | Ścieżka sieciowa, przepustowość lub lokalizacja punktu końcowego |
| Wzrost użycia CPU | Liczba jednoczesnych sesji pozostaje bez zmian | Procesy, zmiany aplikacji, poprawki lub zaplanowane obciążenia |
| Jeden VDA działa słabo | Porównywalne VDA pozostają normalne | Usługi lokalne, konfiguracja lub obciążenie na tej maszynie |
| Wzrost awarii po zmianie | Poprzednia linia bazowa była stabilna | Niedawna aktualizacja, regresja polityki lub konfiguracji |
To zatrzymuje administratorów IT przed zajmowaniem się każdym powiadomieniem w izolacji. Zamiast tego staje się to następnym etapem analizy przyczyn źródłowych.
objaw → metryki związane → warstwa dotknięta → prawdopodobna przyczyna
To jest różnica między posiadaniem danych monitorujących a skutecznym ich wykorzystaniem.
Jak skonfigurować powiadomienia Citrix?
Dobry alert może powiadomić administratora na tyle wcześnie, aby podjął działania, zanim poziomy usług ucierpią. Ustal podstawowe poziomy dla czasów logowania, równoległych sesji, awarii, zasobów serwera, efektywności przechowywania i responsywności sesji. Wykorzystaj te informacje do zdefiniowania stanów ostrzegawczych i krytycznych.
Alerty powinny pokazywać znaczną zmianę od normy, która nadal pozwala na czas administracyjny, podczas gdy zdarzenia krytyczne nie mogą czekać na działanie.
Citrix wspiera polityki ostrzegawcze i krytyczne alerty dla wielu miar i danych, jednak statyczne progi są najbardziej skuteczne, gdy są używane z wcześniejszymi informacjami na temat trendów i dokładności reakcji.
Najlepsza wartość w zakresie powiadamiania polega na dostarczaniu informacji bez generowania nadmiarowych alertów, które obciążają administratorów i prowadzą do pominięcia ważnych przekroczeń progów. Skoncentruj się na tym, czy jest to szybko powtarzane, konsekwentnie powyżej normy, czy jest to anomalia.
Jaki jest najlepszy proces monitorowania Citrix?
Użytkownik skarży się, że "Citrix jest wolny" - izolowanie problemów, gdy wiele ustawień jest zmienianych jednocześnie, może być czasochłonne. Dobrze zdefiniowany proces roboczy pomaga skupić się na zawężeniu problemu przed próbą jego naprawy.
1. Jaki jest zakres?
Czy dotyczy to tylko jednego użytkownika, wielu użytkowników, jednej aplikacji, jednego VDA, jednej grupy dostarczania, jednej lokalizacji, czy każdego środowiska?
Zakres natychmiast wyklucza wiele potencjalnych przyczyn.
2. Jaki jest etap?
3. Czy opóźnienie występuje przed połączeniem, podczas logowania/autoryzacji, podczas uruchamiania aplikacji, czy po wejściu do sesji? Powolne logowanie i powolna sesja to dwie różne rzeczy.
3. Wskazówki specyficzne dla Citrixa
Szukaj informacji o sesji, awariach połączenia, awariach maszyny, awaria VDA faza logowania i inne liczniki wydajności sesji.
To pokazuje, czy Citrix już wskazuje, na którym etapie występuje spowolnienie lub degradacja.
4. Przeprowadź krzyżową weryfikację swoich danych infrastruktury i sieci
Skrzyżuj dane Citrix z licznikami CPU, pamięci, przechowywania i sieci dla tego samego okresu. Skrzyżuj z dobrymi maszynami, a nie ze sobą nawzajem, aby uniknąć stronniczości, gdy to możliwe.
5. Spojrzenie w przeszłość
Jak długo to zachowanie trwa? Czy zaczęło się po aktualizacji systemu Windows, aktualizacji aplikacji, zmianie zasad grupy, zmianie profilu lub zmianie infrastruktury?
Porównaj obecną sytuację z wynikami z przeszłości; to, co wygląda na nagły spadek, może okazać się przedłużeniem długoterminowego trendu.
To dostarcza powtarzalną procedurę:
symptom → zakres → etap → skorelowane metryki → ostatnia zmiana → prawdopodobna przyczyna
Monitoring Citrix: Kiedy staje się to pytaniem architektonicznym?
Monitoring złożoności nie oznacza, że powinieneś zastąpić Citrix.
Niektóre duże lub złożone wdrożenia nadal będą potrzebować wirtualizacji, dostarczania aplikacji, HDX i funkcji zarządzania Citrix. W tych środowiskach monitorowanie wielowarstwowe jest tylko częścią paradygmatu sprawiającego, że architektura działa jako całość.
Gdzie monitorowanie ujawnia inny problem, to architektura jest bardziej rozbudowana, niż to konieczne dla dostarczania tej aplikacji.
To zaczyna być prawdą, gdy wydajesz duże kwoty na infrastrukturę i wysiłek administracyjny na dostarczanie, które jest bardzo proste do opublikowania w systemie Windows.
Wskaźniki mogą być:
- wysiłek operacyjny jest rozłożony na zbyt wiele podmiotów dostarczających
- nie musisz tego tak intensywnie monitorować w odniesieniu do wdrożenia
- jest po prostu zbyt wiele infrastruktury wokół prostej publikacji aplikacji i remote access
- użytkownicy potrzebują tylko przeglądarki lub dostępu RDP do aplikacji
- koszty administracyjne i ślad infrastruktury stają się poważnymi problemami
Krótko mówiąc, to już nie jest pytanie dotyczące rozwiązywania problemów. To pytanie architektoniczne. Pytanie mogło się zmienić z "Jak lepiej monitorujemy to środowisko Citrix?" na "Czy ten przypadek użycia nadal potrzebuje architektury?"
Jak TSplus może być alternatywą dla Citrix?
Monitorowanie Citrix może ujawnić, kiedy infrastruktura i wysiłek administracyjny stają się nieproporcjonalne do stosunkowo prostego wymogu publikacji aplikacji Windows lub pulpitów dla użytkowników zdalnych.
W tej sytuacji problem może dotyczyć mniej poprawy monitorowania, a bardziej tego, czy architektura dostarczania nadal odpowiada rzeczywistemu przypadkowi użycia.
TSplus Zdalny Dostęp oferuje prostszą architekturę dla dostarczania aplikacji i pulpitu dla wielu użytkowników za pośrednictwem połączeń zgodnych z RDP lub portalu internetowego HTML5. Może odpowiadać organizacjom, które potrzebują prostego dostępu do aplikacji i pulpitów systemu Windows bez szerszych warstw wirtualizacji i zarządzania pełnym środowiskiem Citrix.
Wniosek
Skuteczne monitorowanie Citrix polega mniej na zbieraniu każdego dostępnego wskaźnika, a bardziej na zrozumieniu, jak te ważne wskaźniki się ze sobą odnoszą. Czas logowania, responsywność sesji, awarie, zasoby hosta, zachowanie pamięci masowej i sieci stają się najbardziej użyteczne, gdy są porównywane z historycznymi wartościami bazowymi i ze sobą nawzajem.
Ta korelacja pomaga zespołom IT przejść od niejasnego objawu do dotkniętej warstwy i prawdopodobnej przyczyny. Może również ujawnić, czy problem leży w wydajności, która wymaga poprawy, czy w architekturze, której złożoność operacyjna zasługuje na szerszą analizę.
TSplus Darmowy okres próbny dostępu zdalnego
Ostateczna alternatywa dla Citrix/RDS w zakresie dostępu do pulpitu/aplikacji. Bezpieczne, opłacalne, lokalne/chmurowe