Labor: Überwachung & Fehlerbehebung
Erkunden Sie das VergeOS-Dashboard, konfigurieren Sie Alarme, analysieren Sie Systemprotokolle und üben Sie die Diagnose häufiger Probleme.
Zielsetzung
Üben Sie die Überwachung der Infrastrukturgesundheit von VergeOS, das Konfigurieren von Warnungen, die Analyse von Systemprotokollen und das Diagnostizieren häufiger Probleme. Am Ende dieses Labs werden Sie sich sicher im Navigieren der VergeOS-Überwachungstools und im Befolgen eines strukturierten Fehlerbehebungsablaufs fühlen.
Voraussetzungen
Abgeschlossenes Modul 1: Architekturgrundlagen
Modul 4 abgeschlossen: Netzwerke
Modul 5 abgeschlossen: Speicher
Abgeschlossene Lektüre des Moduls 9 (Dashboard, Warnungen, Diagnose, Eskalation)
Ein laufender VergeOS-Cluster mit Administratorzugriff
Schwierigkeitsgrad
Mittelstufe -- Erfordert Vertrautheit mit der VergeOS-Benutzeroberfläche und grundlegenden Konzepten der Systemadministration
Geschätzte Zeit
1,5 Stunden
Schritte
Teil 1: Erkundung des Dashboards
Machen Sie sich mit dem Überwachungs-Dashboard von VergeOS vertraut.
Melden Sie sich mit Administratoranmeldedaten an der VergeOS-Benutzeroberfläche an
Navigieren Sie zum Haupt-Dashboard und identifizieren Sie:
Statusanzeigen der Knoten (online, offline, Wartung)
Diagramme zur CPU-, Arbeitsspeicher- und Speicherplatznutzung
Status der Netzwerkverbindung
Aktive Warnungen und Benachrichtigungen
Gehen Sie zur Detailseite eines einzelnen Knotens
Überprüfen Sie die Übersicht zum Clusterzustand und identifizieren Sie wichtige Kennzahlen
Untersuchen Sie den Status des Speicherpools und vergewissern Sie sich, dass alle Laufwerke gesund sind
Dokumentieren Sie die aktuelle Basislinie der Ressourcennutzung Ihres Clusters
Teil 2: Konfiguration von Warnungen
Richten Sie Warnungen und Benachrichtigungsregeln ein.
Navigieren Sie zum Abschnitt für die Warnungskonfiguration (System → Abonnements)
Überprüfen Sie die vorhandenen Abonnementregeln und ihre konfigurierten Warnkriterien
Erstellen Sie eine benutzerdefinierte Abonnementwarnung für:
Hohe CPU-Auslastung (>85 % über einen längeren Zeitraum)
Geringe Speicherkapazität (weniger als 20 % freier Speicherplatz)
Verlust der Knotenkonnektivität
Konfigurieren Sie einen Benachrichtigungskanal (E-Mail über SMTP oder ein Webhook für Integrationen wie Slack)
Testen Sie die Warnbenachrichtigung, indem Sie einen Schwellenwert auslösen (falls dies in Ihrer Laborumgebung möglich ist)
Konfigurieren Sie die Protokollweiterleitung an einen externen Syslog-Server (oder einen lokalen Protokollsammler)
Teil 3: Protokollanalyse und Diagnose
Üben Sie die Analyse von Systemprotokollen und die Verwendung von Diagnosewerkzeugen.
Navigieren Sie zum Abschnitt der Systemprotokolle
Filtern Sie Protokolle nach Schweregrad (Kritisch, Fehler, Warnung, Meldung)
Suchen Sie nach bestimmten Ereignissen zu:
VM-Vorgänge (Starten, Stoppen, Migrieren)
Speicherereignisse (Laufwerksfehler, Neuverteilung)
Netzwerkereignisse (Link-Statusänderungen)
Identifizieren Sie häufige Fehlermuster und ihre wahrscheinlichen Ursachen
Verwenden Sie die integrierten Diagnosewerkzeuge, um Folgendes zu prüfen:
Gesundheit des Speicher-Subsystems
Netzwerkkonnektivität zwischen den Knoten
Dienstestatus im gesamten Cluster
Üben Sie das Erstellen eines Diagnosepakets für die Support-Eskalation
Teil 4: Fehlerbehebungsszenarien
Diagnostizieren Sie simulierte Probleme mit den Tools, die Sie gelernt haben.
Szenario A: Langsame VM-Leistung -- Ein Benutzer meldet, dass eine VM langsam läuft. Nutzen Sie Dashboard und Protokolle, um:
Prüfen Sie die Ressourcenzuweisung und -auslastung der VM
Identifizieren Sie, ob der Host-Knoten überbelegt ist
Prüfen Sie die Speicher-I/O-Latenz
Empfehlen Sie eine Lösung
Szenario B: Problem mit der Netzwerkkonnektivität -- Ein Mandant meldet, dass er keine externen Netzwerke erreichen kann. Untersuchen Sie:
Mandantennetzwerkkonfiguration
Konnektivität der virtuellen Netzwerkschicht
Status des physischen Netzwerks auf den Hostknoten
Identifizieren Sie die Ursache und die Lösung
Szenario C: Speicherwarnung -- Das System erzeugt eine Warnung zur Speicherkapazität. Bestimmen Sie:
Welcher Speicherpool betroffen ist
Was den meisten Speicherplatz verbraucht
Empfohlene Maßnahmen (Bereinigung, Erweiterung oder Migration)
Verifizierung
Ihr Lab zur Überwachung und Fehlerbehebung ist abgeschlossen, wenn Sie Folgendes beantworten können ja allen folgenden Punkten antworten kannst:
Zuletzt aktualisiert
War das hilfreich?