> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/learn-the-platform/de/modul-9-monitoring-und-fehlerbehebung/lab.md).

# Labor: Überwachung & Fehlerbehebung

## Zielsetzung

Üben Sie die Überwachung der Infrastrukturgesundheit von VergeOS, das Konfigurieren von Warnungen, die Analyse von Systemprotokollen und das Diagnostizieren häufiger Probleme. Am Ende dieses Labs werden Sie sich sicher im Navigieren der VergeOS-Überwachungstools und im Befolgen eines strukturierten Fehlerbehebungsablaufs fühlen.

## Voraussetzungen

* Abgeschlossenes Modul 1: Architekturgrundlagen
* Modul 4 abgeschlossen: Netzwerke
* Modul 5 abgeschlossen: Speicher
* Abgeschlossene Lektüre des Moduls 9 (Dashboard, Warnungen, Diagnose, Eskalation)
* Ein laufender VergeOS-Cluster mit Administratorzugriff

## Schwierigkeitsgrad

**Mittelstufe** -- Erfordert Vertrautheit mit der VergeOS-Benutzeroberfläche und grundlegenden Konzepten der Systemadministration

## Geschätzte Zeit

**1,5 Stunden**

## Schritte

### Teil 1: Erkundung des Dashboards

Machen Sie sich mit dem Überwachungs-Dashboard von VergeOS vertraut.

1. Melden Sie sich mit Administratoranmeldedaten an der VergeOS-Benutzeroberfläche an
2. Navigieren Sie zum Haupt-Dashboard und identifizieren Sie:
   * Statusanzeigen der Knoten (online, offline, Wartung)
   * Diagramme zur CPU-, Arbeitsspeicher- und Speicherplatznutzung
   * Status der Netzwerkverbindung
   * Aktive Warnungen und Benachrichtigungen
3. Gehen Sie zur Detailseite eines einzelnen Knotens
4. Überprüfen Sie die Übersicht zum Clusterzustand und identifizieren Sie wichtige Kennzahlen
5. Untersuchen Sie den Status des Speicherpools und vergewissern Sie sich, dass alle Laufwerke gesund sind
6. Dokumentieren Sie die aktuelle Basislinie der Ressourcennutzung Ihres Clusters

### Teil 2: Konfiguration von Warnungen

Richten Sie Warnungen und Benachrichtigungsregeln ein.

1. Navigieren Sie zum Abschnitt für die Warnungskonfiguration (System → Abonnements)
2. Überprüfen Sie die vorhandenen Abonnementregeln und ihre konfigurierten Warnkriterien
3. Erstellen Sie eine benutzerdefinierte Abonnementwarnung für:
   * Hohe CPU-Auslastung (>85 % über einen längeren Zeitraum)
   * Geringe Speicherkapazität (weniger als 20 % freier Speicherplatz)
   * Verlust der Knotenkonnektivität
4. Konfigurieren Sie einen Benachrichtigungskanal (E-Mail über SMTP oder ein Webhook für Integrationen wie Slack)
5. Testen Sie die Warnbenachrichtigung, indem Sie einen Schwellenwert auslösen (falls dies in Ihrer Laborumgebung möglich ist)
6. Konfigurieren Sie die Protokollweiterleitung an einen externen Syslog-Server (oder einen lokalen Protokollsammler)

### Teil 3: Protokollanalyse und Diagnose

Üben Sie die Analyse von Systemprotokollen und die Verwendung von Diagnosewerkzeugen.

1. Navigieren Sie zum Abschnitt der Systemprotokolle
2. Filtern Sie Protokolle nach Schweregrad (Kritisch, Fehler, Warnung, Meldung)
3. Suchen Sie nach bestimmten Ereignissen zu:
   * VM-Vorgänge (Starten, Stoppen, Migrieren)
   * Speicherereignisse (Laufwerksfehler, Neuverteilung)
   * Netzwerkereignisse (Link-Statusänderungen)
4. Identifizieren Sie häufige Fehlermuster und ihre wahrscheinlichen Ursachen
5. Verwenden Sie die integrierten Diagnosewerkzeuge, um Folgendes zu prüfen:
   * Gesundheit des Speicher-Subsystems
   * Netzwerkkonnektivität zwischen den Knoten
   * Dienstestatus im gesamten Cluster
6. Üben Sie das Erstellen eines Diagnosepakets für die Support-Eskalation

### Teil 4: Fehlerbehebungsszenarien

Diagnostizieren Sie simulierte Probleme mit den Tools, die Sie gelernt haben.

1. **Szenario A: Langsame VM-Leistung** -- Ein Benutzer meldet, dass eine VM langsam läuft. Nutzen Sie Dashboard und Protokolle, um:
   * Prüfen Sie die Ressourcenzuweisung und -auslastung der VM
   * Identifizieren Sie, ob der Host-Knoten überbelegt ist
   * Prüfen Sie die Speicher-I/O-Latenz
   * Empfehlen Sie eine Lösung
2. **Szenario B: Problem mit der Netzwerkkonnektivität** -- Ein Mandant meldet, dass er keine externen Netzwerke erreichen kann. Untersuchen Sie:
   * Mandantennetzwerkkonfiguration
   * Konnektivität der virtuellen Netzwerkschicht
   * Status des physischen Netzwerks auf den Hostknoten
   * Identifizieren Sie die Ursache und die Lösung
3. **Szenario C: Speicherwarnung** -- Das System erzeugt eine Warnung zur Speicherkapazität. Bestimmen Sie:
   * Welcher Speicherpool betroffen ist
   * Was den meisten Speicherplatz verbraucht
   * Empfohlene Maßnahmen (Bereinigung, Erweiterung oder Migration)

## Verifizierung

Ihr Lab zur Überwachung und Fehlerbehebung ist abgeschlossen, wenn Sie Folgendes beantworten können **ja** allen folgenden Punkten antworten kannst:

* [ ] Das VergeOS-Dashboard erfolgreich navigiert und wichtige Gesundheitskennzahlen identifiziert
* [ ] Benutzerdefinierte Warnregeln mit passenden Schwellenwerten erstellt
* [ ] Mindestens einen Benachrichtigungskanal konfiguriert (E-Mail oder Webhook)
* [ ] Systemprotokolle gefiltert und durchsucht, um bestimmte Ereignisse zu finden
* [ ] Diagnosewerkzeuge verwendet, um Speicher-, Netzwerk- und Dienstgesundheit zu prüfen
* [ ] Mindestens zwei Fehlerbehebungsszenarien durchgearbeitet und die Ursachen identifiziert
* [ ] Ein für die Support-Eskalation geeignetes Diagnosepaket erstellt


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/learn-the-platform/de/modul-9-monitoring-und-fehlerbehebung/lab.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
