For the complete documentation index, see llms.txt. This page is also available as Markdown.

Labor: Überwachung & Fehlerbehebung

Erkunden Sie das VergeOS-Dashboard, konfigurieren Sie Alarme, analysieren Sie Systemprotokolle und üben Sie die Diagnose häufiger Probleme.

Zielsetzung

Üben Sie die Überwachung der Infrastrukturgesundheit von VergeOS, das Konfigurieren von Warnungen, die Analyse von Systemprotokollen und das Diagnostizieren häufiger Probleme. Am Ende dieses Labs werden Sie sich sicher im Navigieren der VergeOS-Überwachungstools und im Befolgen eines strukturierten Fehlerbehebungsablaufs fühlen.

Voraussetzungen

  • Abgeschlossenes Modul 1: Architekturgrundlagen

  • Modul 4 abgeschlossen: Netzwerke

  • Modul 5 abgeschlossen: Speicher

  • Abgeschlossene Lektüre des Moduls 9 (Dashboard, Warnungen, Diagnose, Eskalation)

  • Ein laufender VergeOS-Cluster mit Administratorzugriff

Schwierigkeitsgrad

Mittelstufe -- Erfordert Vertrautheit mit der VergeOS-Benutzeroberfläche und grundlegenden Konzepten der Systemadministration

Geschätzte Zeit

1,5 Stunden

Schritte

Teil 1: Erkundung des Dashboards

Machen Sie sich mit dem Überwachungs-Dashboard von VergeOS vertraut.

  1. Melden Sie sich mit Administratoranmeldedaten an der VergeOS-Benutzeroberfläche an

  2. Navigieren Sie zum Haupt-Dashboard und identifizieren Sie:

    • Statusanzeigen der Knoten (online, offline, Wartung)

    • Diagramme zur CPU-, Arbeitsspeicher- und Speicherplatznutzung

    • Status der Netzwerkverbindung

    • Aktive Warnungen und Benachrichtigungen

  3. Gehen Sie zur Detailseite eines einzelnen Knotens

  4. Überprüfen Sie die Übersicht zum Clusterzustand und identifizieren Sie wichtige Kennzahlen

  5. Untersuchen Sie den Status des Speicherpools und vergewissern Sie sich, dass alle Laufwerke gesund sind

  6. Dokumentieren Sie die aktuelle Basislinie der Ressourcennutzung Ihres Clusters

Teil 2: Konfiguration von Warnungen

Richten Sie Warnungen und Benachrichtigungsregeln ein.

  1. Navigieren Sie zum Abschnitt für die Warnungskonfiguration (System → Abonnements)

  2. Überprüfen Sie die vorhandenen Abonnementregeln und ihre konfigurierten Warnkriterien

  3. Erstellen Sie eine benutzerdefinierte Abonnementwarnung für:

    • Hohe CPU-Auslastung (>85 % über einen längeren Zeitraum)

    • Geringe Speicherkapazität (weniger als 20 % freier Speicherplatz)

    • Verlust der Knotenkonnektivität

  4. Konfigurieren Sie einen Benachrichtigungskanal (E-Mail über SMTP oder ein Webhook für Integrationen wie Slack)

  5. Testen Sie die Warnbenachrichtigung, indem Sie einen Schwellenwert auslösen (falls dies in Ihrer Laborumgebung möglich ist)

  6. Konfigurieren Sie die Protokollweiterleitung an einen externen Syslog-Server (oder einen lokalen Protokollsammler)

Teil 3: Protokollanalyse und Diagnose

Üben Sie die Analyse von Systemprotokollen und die Verwendung von Diagnosewerkzeugen.

  1. Navigieren Sie zum Abschnitt der Systemprotokolle

  2. Filtern Sie Protokolle nach Schweregrad (Kritisch, Fehler, Warnung, Meldung)

  3. Suchen Sie nach bestimmten Ereignissen zu:

    • VM-Vorgänge (Starten, Stoppen, Migrieren)

    • Speicherereignisse (Laufwerksfehler, Neuverteilung)

    • Netzwerkereignisse (Link-Statusänderungen)

  4. Identifizieren Sie häufige Fehlermuster und ihre wahrscheinlichen Ursachen

  5. Verwenden Sie die integrierten Diagnosewerkzeuge, um Folgendes zu prüfen:

    • Gesundheit des Speicher-Subsystems

    • Netzwerkkonnektivität zwischen den Knoten

    • Dienstestatus im gesamten Cluster

  6. Üben Sie das Erstellen eines Diagnosepakets für die Support-Eskalation

Teil 4: Fehlerbehebungsszenarien

Diagnostizieren Sie simulierte Probleme mit den Tools, die Sie gelernt haben.

  1. Szenario A: Langsame VM-Leistung -- Ein Benutzer meldet, dass eine VM langsam läuft. Nutzen Sie Dashboard und Protokolle, um:

    • Prüfen Sie die Ressourcenzuweisung und -auslastung der VM

    • Identifizieren Sie, ob der Host-Knoten überbelegt ist

    • Prüfen Sie die Speicher-I/O-Latenz

    • Empfehlen Sie eine Lösung

  2. Szenario B: Problem mit der Netzwerkkonnektivität -- Ein Mandant meldet, dass er keine externen Netzwerke erreichen kann. Untersuchen Sie:

    • Mandantennetzwerkkonfiguration

    • Konnektivität der virtuellen Netzwerkschicht

    • Status des physischen Netzwerks auf den Hostknoten

    • Identifizieren Sie die Ursache und die Lösung

  3. Szenario C: Speicherwarnung -- Das System erzeugt eine Warnung zur Speicherkapazität. Bestimmen Sie:

    • Welcher Speicherpool betroffen ist

    • Was den meisten Speicherplatz verbraucht

    • Empfohlene Maßnahmen (Bereinigung, Erweiterung oder Migration)

Verifizierung

Ihr Lab zur Überwachung und Fehlerbehebung ist abgeschlossen, wenn Sie Folgendes beantworten können ja allen folgenden Punkten antworten kannst:

Zuletzt aktualisiert

War das hilfreich?