Obsah

Úvod

Problémy s výkonem Citrixu zřídka začínají úplným výpadkem. Přihlašování může pomalu prodlužovat, jeden VDA se může od svých vrstevníků odchýlit, selhání připojení se může zvýšit nebo latence relace může v předvídatelných časech vzrůst. Efektivní monitorování pomáhá IT týmům tyto změny včas odhalit a rozlišit izolované příznaky od širších problémů s infrastrukturou, sítí nebo kapacitou.

Tento článek se zaměřuje na nástroje, metriky a varovné signály, které pomáhají administrátorům efektivněji diagnostikovat problémy s Citrixem.

Jaké typy vrstev by měly být pokryty monitorováním Citrix?

Existuje několik úzce propojených komponentů Citrix Virtual Apps a Desktop, které je třeba zvážit. Uživatelova relace může zahrnovat zprostředkování, autentizaci, VDA, služby Windows, uživatelské profily, GPO, úložiště, aplikace a síťová připojení, než je aplikace nebo desktop vůbec k dispozici pro použití. Dobré monitorování Citrix vyžaduje přehled o čtyřech nuancích.

Na úrovni relace chtějí administrátoři vědět, zda se uživatelé mohou připojit, jak dlouho trvá přihlášení a že relace nadále reagují.

Na vrstvě doručení Citrix může monitoring zjistit, že stroje jsou zapnuté a registrované, připojení selhávají a jak je zátěž vyvážena.

Na úrovni infrastruktury lze testovat CPU, paměť, úložiště a služby Windows, aby se zajistilo, že hostitelské systémy jsou schopny.

A na síťové/historické úrovni musíte vidět, že latence neovlivňuje odezvu relace a že poptávka po úložišti a dalších zdrojích v průběhu času neklesá.

Trik spočívá v tom, nesledovat každý dostupný ukazatel, ale sledovat problém od symptomu k pravděpodobné základní infrastrukturní vrstvě.

Jaké nástroje jsou užitečné pro každý případ použití?

Žádná kategorie monitorování vám neposkytuje stejně dobrý přehled o všech vašich aplikacích a službách. Nejlepší sada nástrojů závisí na tom, co chcete vidět a řešit.

Citrix Monitor a Director

Toto je místo, kde jsou vlastní monitorovací nástroje Citrixu rozumným prvním místem, na které se podívat.

Citrix Monitor pro Citrix DaaS a Director pro Citrix Virtual Apps a Desktops vám poskytuje informace o relacích, připojení a selháních strojů, čase přihlášení, zatížení, využití strojů a zdraví strojů. Můžete sledovat trendy v průběhu času, abyste mohli porovnat aktuální výkon s historickými daty, místo abyste porovnávali aktuální výkon s daným časovým bodem.

Toto monitorování vrhá světlo na samotný proces monitorování.

Například, Citrix vám může získat a rozpis, jak dlouho trvá přihlášení a kde dochází k zpoždění: broker, spuštění stroje, HDX, přihlašovací skripty, skupinová politika, autentizace a tak dále.

To je mnohem lepší způsob, jak přejít od uživatelské stížnosti "přihlašování je pomalé" k užitečnější otázce pro odstraňování problémů: která část procesu přihlašování trvá déle, než by měla?

Infrastruktura a monitorování serveru

Citrix diagnostika však nenahradí monitorování základní dodávkové platformy.

Server monitoring může ukázat trvalé využití CPU, tlak na paměť, aktivitu disku, kapacitu úložiště a podivné chování procesů. Tyto údaje jsou obzvlášť cenné, pokud je problém vidět v Citrixu, ale příčina leží hlouběji ve stacku.

Zvažte, jak byste vyšetřovali zvýšení doby přihlášení. Pokud je latence úložiště také vysoká, měly by být zkontrolovány profily a úložiště. Pokud je server v pořádku, ale doby přihlášení se prodlužují, je pravděpodobnější, že problém spočívá v autentizaci serveru, skupinové politice nebo jiném faktoru dodání.

Historické monitorování infrastruktury také pomáhá při plánování kapacity. Pomalu se zvyšující spotřeba zdrojů v dnech nebo týdnech před kolapsem serveru ukazuje, že existuje limit pro koncový bod nebo hostitele, aniž by se komponenta skutečně vyřadila.

Sledování sítě

Dodávka aplikací a desktopů na Citrixu závisí na dobrém síťovém připojení mezi uživatelským zařízením a hostitelem.

Sledování sítě může ukázat nárůst latence, přetížení, šířky pásma, nespolehlivosti nebo problémů souvisejících se stránkami, které sledování serveru nemůže vysvětlit.

Analýza výkonu relace Citrix může také ukázat metriky jako latence ICA, Doba oběhu ICA (RTT) , snímková frekvence a volná versus spotřebovaná šířka pásma.

Tato data jsou obzvlášť důležitá, když se uživatelům podaří připojit, ale říkají, že jejich aplikace nebo pracovní plochy se zdají být pomalé.

Digitální zkušenost a monitorování plného zásobníku

V některých prostředích je potřeba vidět dál než jen dostupnost infrastruktury.

Digitální monitorování zkušeností a syntetické monitorování mohou napodobovat nebo sledovat uživatelské aktivity, jako je přihlášení, spouštění aplikací a dokončování transakcí. Místo toho, abychom viděli pouze servery, které reagují, cílem je potvrdit, že služba funguje pro uživatele.

Toto rozlišení je důležité, protože dobrá infrastruktura nevytváří dobrou uživatelskou zkušenost. Větší prostředí mohou také využívat platformy pro plnou observabilitu, které propojují relaci Citrix s VDA, Windows zdroji, Active Directory, úložištěm, aplikačními servery a síťovou cestou.

Ale pravděpodobně nechcete ještě více panelů. Monitorovací platforma se osvědčuje, když zúží možné příčiny a navede administrátory na vrstvu, která se změnila.

Jaké jsou nejdůležitější typy metrik?

Existuje tisíce čítačů dostupných z platformy Citrix. Nejužitečnější metriky jsou ty, které se vztahují k uživatelské zkušenosti, zdraví infrastruktury nebo jakékoli změně kapacity.

Doba přihlášení

Čas přihlášení je jednou z nejsilnějších metrik zaměřených na uživatele, protože odhaluje více oblastí dodavatelského řetězce.

Celková doba přihlášení je hlavní metrikou, ale může zakrýt detaily během diagnostiky. Citrix bude schopen rozlišit mezi zprostředkováním, spuštěním stroje, připojením HDX, autentizací přihlášení, načítáním profilu, skripty přihlášení a zpracováním skupinových politik.

Pokud se doba načítání profilu prodlouží, zaměření se přesune na správu profilu. Dlouhé zpracování skupinových politik přenáší zkoumání jinam. Pomalé spuštění stroje ponechává VDA, hostitelský systém nebo virtualizační platformu v záběru.

Celková doba naznačuje, že je něco jinak, ale rozdělení fází odhaluje, kde je to jinak.

Odezva relace

Zavedená relace není indikací reagující relace.

Metriky ICA RTT, latence ICA, snímková frekvence a šířka pásma mohou být použity k určení, zda připojená plocha nebo aplikace funguje tak, jak má.

Kontext je stále králem. Pokud uživatelé v jedné kanceláři jsou jediní, kdo ztrácí výkon, pravděpodobně je na vině síťová cesta.

Připojení a selhání strojů

Celková ztráta připojení by měla být urgentně řešena, ale trend může být významnější než jakákoliv jednotlivá událost.

Nárůst na pozadí zřídka selhávajících připojení může být ukazatelem pomalu se objevujícího problému, i když většina uživatelů zůstává připojena.

Administrátoři by měli prozkoumat rozložení selhání. Jednotlivé boxy, dodací skupiny, kanceláře nebo časová období mohou být mnohem informativnější než seznam všech selhání.

Současné relace a zatížení

Počet současných relací je základem většiny metrik infrastruktury.

Velký nárůst CPU při velmi velkém nárůstu přihlášení je jen větší poptávka. Stejný nárůst poptávky po procesoru bez změny uživatelů má jinou příčinu.

Plánování by mělo zohlednit tři faktory:

objem relace → zatížení hostitele → odezva

Pokud se počet relací zvýší bez odpovídajícího nárůstu zatížení hostitele nebo doby odezvy, systém to může stále zvládnout.

Pokud stejný počet relací způsobuje větší zátěž procesoru, soutěž o paměť nebo latenci, pak se v pracovní zátěži něco jiného změnilo.

CPU, paměť a úložiště

Zvažte využití vašeho CPU, paměti a úložiště z hlediska vzorců, nikoli jednotlivých procent.

S CPU může být krátký výpadek bez obav. Udržované používání, opakované saturace, zvyšující se základní úroveň nebo jeden hostitel, který spotřebovává procesorový čas ve srovnání se svými kolegy, je mnohem významnější.

Paměť lze také vidět v perspektivě. Vysoké využití RAM samo o sobě je problémem pouze v případě, že dochází k trvalému růstu, výkyvům v používání, neobvyklým rozdílům mezi hostiteli nebo pokud RAM není schopna vrátit se do svého normálního stavu po výkyvu.

Skladování vyžaduje jak kapacitu, tak monitorování výkonu. Klesající volné místo je zřejším rizikem výkonu, zatímco vysoká latence disku nebo soutěžení o úložiště zpomalí profily, spouštění aplikací a zahajování relací v přítomnosti jinak dostupné kapacity.

Jaké jsou rané varovné signály před problémy s Citrixem?

Problémy s výkonem v Citrixu se obvykle objevují jako odchylky, než se promění v výpadky. Nejlepšími ranými indikátory jsou tedy změny v korelacích mezi několika ukazateli spíše než překročení prahu jediného ukazatele.

Varovný signál Co zkontrolovat dál
Přihlašování se postupně zpomaluje Fáze přihlášení, profily, Skupinová politika, ověřování a úložiště
Zvýšení selhání připojení z nízkého základu Stroje, Skupiny doručení, nedávné změny a chování sítě
Zdroje dosahují vrcholů ve stejnou dobu každý den Přihlášení, naplánované úlohy, aplikace a dostupná kapacita
Jeden host se opakovaně chová jinak než jeho vrstevníci. Procesy, služby, konfigurace a rozdělení zátěže
Latence relace vzrůstá, zatímco zdroje hostitele zůstávají normální. Síťová cesta, umístění koncového bodu a šířka pásma
CPU nebo paměť se zvyšuje bez dalších uživatelů Aplikace, procesy, opravy a změny konfigurace
Volný diskový prostor klesá předvídatelně Profily, protokoly, dočasná data a úložiště aplikací
Výkon se změní okamžitě po aktualizaci Nedávné opravy, politiky, aplikace nebo změny konfigurace

Společným prvkem je odchylka od očekávané normy. Monitorování je mnohem efektivnější, když si IT profesionálové kladou otázku "je tato hodnota vysoká?" vedle "proč se liší od normy?"

Proč by se vaše pozornost měla více zaměřit na základní hodnoty než na pevné prahy?

Pevné prahy jsou stále vyžadovány. Správci potřebují upozornění, aby věděli, než dojde místo na discích, než CPU dosáhne saturace a než služba selže a ovlivní dostupnost.

Ale jediný, všeobsahující práh nebude vyhovovat všem prostředím Citrix.

Řekněme, že prostředí obvykle trvá 15 sekund na dokončení přihlášení uživatelů a tento ukazatel začíná stoupat k 25 sekundám a více. To je oblast, která si zaslouží vyšetření, i když organizace definuje 30 sekund jako prahovou hodnotu upozornění.

V jiném prostředí, kde by se rychlosti přihlášení obvykle pohybovaly kolem 30 sekund, by toto číslo nebylo příliš důležité - další příklad toho, jak mohou mít různé absolutní hodnoty v různých okolnostech velmi odlišné významy.

Ve své obvyklé funkci mohou základní linie upozornit na:

  • změny pomalého výkonu
  • aktualizace příspěvků skáče
  • změny v době špičkové využití
  • rostoucí pracovní zátěže
  • rozdíly mezi servery jako je
  • omezené kapacity budovy

Benchmark s upozorněními je jednoduchý: Upozornění na abnormální změnu a absolutní limity.

Jak může váš IT tým korelovat vaše metriky Citrix?

Jednotlivé metriky Citrix skutečně ukazují svou hodnotu, když jsou korelovány s chováním infrastruktury a sítě. Zamyslete se nad těmito běžnými párováními:

Citrix symptom Korelované důkazy Směr vyšetřování
Přihlašování se stává pomalejším Latence disku také vzrůstá Profily, úložiště a diskový I/O
Přihlašování se stává pomalejším CPU, paměť a úložiště zůstávají normální Autentizace, GPO, profily, zprostředkování nebo jiné fáze přihlášení
Odpověď relace se zhoršuje Zdraví hostitele zůstává stabilní Síťová cesta, šířka pásma nebo umístění koncového bodu
Zvýšení využití CPU Počet současných relací zůstal nezměněn Procesy, změny aplikací, opravy nebo naplánované pracovní zátěže
Jedna VDA funguje špatně Srovnatelné VDA zůstávají normální Místní služby, konfigurace nebo zátěž na tomto stroji
Po změně se zvyšují selhání Předchozí základna byla stabilní Nedávná aktualizace, politika nebo regresní konfigurace

Tohle zastaví IT administrátory od toho, aby se zabývali každým upozorněním izolovaně. Spíše se to stává další fází vaší analýzy příčin.

symptom → související metriky → ovlivněná vrstva → pravděpodobná příčina

To je rozdíl mezi mít monitorovací data a skutečně je efektivně využívat.

Jak byste měli nakonfigurovat své Citrix upozornění?

Dobrý alert může včas upozornit administrátora, aby mohl podniknout kroky, než dojde k poklesu úrovně služeb. Stanovte základní úrovně pro časy přihlášení, současné relace, selhání, serverové zdroje, efektivitu úložiště a reakční dobu relací. Použijte informace k definování varovných a kritických stavů.

Upozornění by měla ukazovat na významnou změnu od normy, která stále umožňuje čas na správu, zatímco kritické události nemohou čekat na akci.

Citrix podporuje varovné a kritické upozorňovací politiky pro více opatření a dat, nicméně statické prahy jsou nejúčinnější, když se používají s předchozími informacemi o trendech a přesnosti reakce.

Nejlepší hodnota pro upozorňování spočívá v poskytování informací bez vytváření nadbytečných upozornění, která podmiňují administrátory a vedou k přehlédnutí důležitých překročení prahových hodnot. Zaměřte se na to, zda se to rychle opakuje, konzistentně překračuje normu, nebo je to anomálie.

Jaký je nejlepší pracovní postup pro monitorování Citrix?

Uživatel si stěžuje, že "Citrix je pomalý" - izolace problémů, když je najednou změněno několik nastavení, může být časově náročná. Dobře definovaný pracovní postup pomáhá soustředit se na zúžení problému před pokusem o jeho opravu.

1. Jaký je rozsah?

Ovlivňuje to pouze jednoho uživatele, více uživatelů, jednu aplikaci, jeden VDA, jednu skupinu doručení, jedno místo, nebo každé prostředí?

Rozsah okamžitě vylučuje mnoho potenciálních příčin.

2. Jaká je fáze?

3. Je zpoždění před připojením, během přihlášení/autentizace, během spuštění aplikace nebo po vstupu do relace? Pomalé přihlášení a pomalá relace jsou dvě různé věci.

3. Nápovědy specifické pro Citrix

Hledejte informace o relaci, selhání připojení, selhání stroje, selhání VDA , fáze přihlášení a další ukazatele výkonu relace.

Tohoto odhaluje, zda Citrix již ukazuje, která fáze je pomalá nebo se zhoršuje.

4. Prozkoumejte svá data o infrastruktuře a síti

Proveďte křížovou kontrolu dat Citrix s CPU, pamětí, úložištěm a síťovými čítači za stejné období. Křížovou kontrolu provádějte s dobrými stroji spíše než navzájem, abyste se vyhnuli zaujatosti, pokud je to možné.

5. Podívejte se do minulosti

Jak dlouho toto chování trvá? Začalo to po aktualizaci Windows, upgradu aplikace, změně skupinové politiky, změně profilu nebo změně infrastruktury?

Porovnejte současnou situaci s minulým výkonem; to, co vypadá jako náhlý pokles, se může ukázat jako prodloužení dlouhodobého trendu.

Toto poskytuje opakovatelný postup:

symptom → rozsah → fáze → korelované metriky → nedávná změna → pravděpodobná příčina

Citrix Monitoring: Kdy se stává otázkou architektury?

Složitost monitorování neznamená, že byste měli nahradit Citrix.

Některé velké nebo složité nasazení stále potřebují virtualizaci, doručování aplikací, HDX a funkce správy od společnosti Citrix. Pro tato prostředí je vícestupňové monitorování pouze součástí paradigmatu, jak zajistit, aby architektura fungovala jako celek.

Kde monitorování odhaluje jiný problém, je to, že architektura je rozsáhlejší, než by měla být pro dodání této aplikace.

To začíná být pravda, když vynakládáte velké množství úsilí na infrastrukturu a administraci pro dodávku, která je velmi jednoduchá k publikaci v systému Windows.

Indikátory mohou být:

  • operační úsilí je rozděleno mezi příliš mnoho dodacích subjektů
  • není nutné to tak intenzivně monitorovat ve vztahu k nasazení
  • je kolem jednoduchého publikování aplikací prostě příliš mnoho infrastruktury a vzdálený přístup
  • uživatelé potřebují pouze prohlížeč nebo RDP přístup k aplikaci
  • náklady na správu a infrastruktura se stávají vážnými problémy

Stručně řečeno, to už není otázka řešení problémů. Je to otázka architektury. Otázka se mohla posunout z "Jak lépe monitorujeme toto prostředí Citrix?" na "Potřebuje tento případ použití stále architekturu?"

Jak může být TSplus alternativou k Citrixu?

Monitoring Citrix může odhalit, kdy se infrastruktura a administrativní úsilí stávají nepřiměřenými vůči relativně jednoduchému požadavku na publikování aplikací Windows nebo desktopů pro vzdálené uživatele.

V této situaci může být problém méně o zlepšení monitorování a více o tom, zda architektura dodávky stále odpovídá skutečnému použití.

TSplus Remote Access nabízí jednodušší architekturu pro doručování aplikací a desktopů pro více uživatelů prostřednictvím připojení kompatibilních s RDP nebo webového portálu HTML5. Může vyhovovat organizacím, které potřebují jednoduchý přístup k aplikacím a desktopům Windows bez širších virtualizačních a správcovských vrstev plného prostředí Citrix.

Závěr

Efektivní monitorování Citrixu se méně zaměřuje na shromažďování každého dostupného ukazatele a více na pochopení, jak spolu souvisejí ty důležité. Doba přihlášení, reakční doba relace, selhání, zdroje hostitele, chování úložiště a sítě se stávají nejvíce užitečnými, když jsou porovnávány s historickými základními hodnotami a navzájem.

Tato korelace pomáhá IT týmům přejít od nejasného symptomu k postižené vrstvě a pravděpodobné příčině. Může také odhalit, zda problém spočívá v výkonu, který je třeba opravit, nebo v architektuře, jejíž provozní složitost si zaslouží širší přehled.

TSplus Bezplatná zkušební verze vzdáleného přístupu

Ultimativní alternativa Citrix/RDS pro přístup k desktopu/aplikacím. Bezpečné, nákladově efektivní, on-premises/cloud

Další čtení

back to top of the page icon