Diagnose-Toolkit
Beherrschen Sie die vier komponentenspezifischen Diagnosewerkzeuge, die in VergeOS integriert sind — Netzwerk-, Knoten-, vSAN- und NAS-Diagnose — und erfahren Sie, wann Sie welches für eine effiziente Fehlerbehebung einsetzen.
Vier Diagnosetoolkits in einer Plattform
VergeOS bettet Diagnosetools direkt in jedes große Teilsystem ein. Anstatt per SSH auf einzelne Knoten zuzugreifen oder Tools von Drittanbietern zu installieren, führen Administratoren Diagnosen über die VergeOS-Benutzeroberfläche — jeweils auf die untersuchte Komponente zugeschnitten.
Jede Diagnoseschnittstelle folgt demselben Muster:
Navigieren Sie zur Komponente (Netzwerk, Knoten, NAS oder vSAN)
Klicken Sie auf Diagnose im linken Menü
Wählen Sie einen Befehl aus dem Abfrage Dropdown
Konfigurieren Sie rechts die Parameter
Klicken Sie auf Senden → auszuführen
Schalter „Befehl anzeigen“
Aktivieren „Befehl anzeigen“ bei jeder Diagnose, um den exakt ausgeführten Befehl zu sehen. Dies ist die maßgebliche Methode, um die zugrunde liegende Syntax für Skripting, Automatisierung oder das Nachvollziehen eines Befehls über SSH anzuzeigen.
Netzwerkdiagnostik
Zugriff: Netzwerke → [Netzwerk auswählen] → Diagnostik
Netzwerkdiagnosen laufen pro Netzwerk — Sie wählen das konkrete Netzwerk aus, das Sie beheben möchten, und alle Befehle werden innerhalb dieses Netzwerk-Kontexts ausgeführt. Das ist entscheidend, weil VergeOS-Netzwerke per Design isoliert sind.
Konnektivität & Erkennung
Ping
Einfacher ICMP-Konnektivitätstest
Traceroute
Den Netzwerkpfad zu einem Ziel verfolgen
ARP-Scan
Aktive Geräte im Netzwerk erkennen
ARP-Tabelle
Aktuelle IP-zu-MAC-Zuordnungen anzeigen
TCP-Verbindungstest
Prüfen, ob ein bestimmter TCP-Port erreichbar ist
Welche IP habe ich
Die externe IP des Netzwerks prüfen (NAT-Verifizierung)
DNS & Namensauflösung
DNS-Abfrage
A-, AAAA-, MX-, NS- und PTR-Einträge abfragen
Firewall & Sicherheit
Firewall-Regeln anzeigen
Das vollständige Firewall-Regelwerk anzeigen
Firewall-Regeln verfolgen/debuggen
Pro-Regel-Logging für Debugging aktivieren
NMAP
Port-Scanning und Diensterkennung
Traffic-Analyse
TCP Dump
Paketmitschnitt mit BPF-Filterung
Top-Netzwerkauslastung
Bandbreitenverbrauch in Echtzeit
Top-CPU-Auslastung
Prozesse mit dem höchsten CPU-Verbrauch
Dienstspezifisch
DHCP freigeben/erneuern
DHCP-Lease-Aktualisierung erzwingen (DHCP-Client-Netzwerke)
IPsec
IPsec-VPN-Tunnel überwachen und steuern
FRRouting BGP/OSPF
Status des dynamischen Routing-Protokolls
Protokolle
Systemprotokolle des Netzwerkcontainers
Knotendiagnostik
Zugriff: Infrastruktur → Knoten → [Knoten auswählen] → Diagnostik
Knotendiagnosen bieten auf Hardware-Ebene Einblick in einzelne physische Server. Diese Tools interagieren direkt mit dem BMC des Servers, den Laufwerken und den physischen Netzwerkschnittstellen.
IPMI-/BMC-Tools
Diese Befehle kommunizieren mit dem Baseboard Management Controller des Servers — der Out-of-Band-Verwaltungsschnittstelle (iDRAC bei Dell, iLO bei HPE usw.).
IPMI BMC-Info
BMC-Firmware und -Konfiguration
IPMI-Chassis-Status
Energiezustand, Eindringungserkennung
IPMI FRU-Info
Identifikation austauschbarer Einheiten
IPMI LAN-Info
BMC-Netzwerkkonfiguration
IPMI MC-Reset
Einen nicht reagierenden BMC zurücksetzen
IPMI-Sensoren
Temperatur-, Spannungs- und Lüfterwerte
IPMI Sensor Data Repository
Vollständiges Sensor-Daten-Repository
IPMI-Systemereignisprotokolle
Hardware-Ereignisverlauf (SEL)
IPMI MC-Reset
Das Zurücksetzen des BMC unterbricht vorübergehend die Out-of-Band-Verwaltung. Das Host-Betriebssystem läuft weiter — betroffen ist nur der Management-Controller.
Laufwerks- und Speicherzustand
S.M.A.R.T.-Informationen
Gesundheitsattribute des Laufwerks, Abnutzung, Temperatur
S.M.A.R.T.-Diagnosetest
Kurze, lange oder Übertragungstests ausführen
Blockgeräte anzeigen
Alle Blockgeräte auf dem Knoten auflisten
LED-Steuerung (Laufwerk)
Die Locate-LED des Laufwerks zur physischen Identifikation aktivieren/deaktivieren
RAS-Abfrage
Meldungen zu Speicher-ECC-Fehlern
Netzwerk & Fabric
Ethernet-Tool
Link-Geschwindigkeit, Duplex, Treiberinformationen
Fabric-Konfiguration
Status der Kern-Fabric für diesen Knoten
Netzwerk-Bonding
Zustand der Bond-Schnittstelle und aktiver Slave
Bridge-Adressen
MAC-Adressentabelle des virtuellen Switches
ARP-Scan / ARP-Tabelle
Netzwerkerkennung auf Knotenebene
Ping / Traceroute
Grundlegende Konnektivität aus dem Knoten-Kontext
System
DMI-Tabelle
Vollständiges Hardware-Inventar (CPU, RAM, Seriennummern)
Protokolle
System- und Kernel-Protokolle
OpenSSL-Geschwindigkeit
Benchmark der kryptografischen CPU-Leistung
Persistenten Speicher leeren
Dateisystem-Caches leeren (nur für den Support)
VMware
SSH/DCUI zum ESXi-Host für esxcli/vsish; vCenter stellt einige S.M.A.R.T.-/Sensor-Daten bereit, aber für tiefgehende Arbeiten verlässt man die vSphere-Benutzeroberfläche
Nutanix
Prism Element Hardware-Seite + ncli vom CVM aus; IPMI/BMC separat für Laufwerks-LED und detaillierte Sensoren aufgerufen
VergeOS
Diagnosepanel für einen einzelnen Knoten: IPMI, S.M.A.R.T., Laufwerks-LED-Steuerung, Fabric-Gesundheit, ohne SSH oder separate BMC-Zugangsdaten. „Befehl anzeigen“ zeigt die zugrunde liegende Syntax.
vSAN-Diagnosen
Zugriff: System → vSAN-Diagnosen
vSAN-Diagnosen arbeiten auf Systemebeneund bieten tiefe Einblicke in die verteilte Speicher-Engine.
Nur auf Root-/Elternebene
vSAN-Diagnosen sind nur auf Root-/Elternebene verfügbar. Mandanten haben keinen Zugriff auf vSAN-Diagnosetools — sie interagieren mit dem Speicher über ihre zugewiesenen virtuellen Festplatten.
Wichtige vSAN-Diagnosebefehle
Tier-Status abrufen
Gesundheit, Redundanz und Kapazität pro Ebene
Cluster-Raten abrufen
Lese-/Schreibdurchsatz im gesamten Cluster
Cluster-Nutzung abrufen
Allgemeine Statistiken zur Speichernutzung
Geräteliste abrufen
Alle Speichergeräte im vSAN-Pool
Gerätestatus abrufen
Zustand einzelner Geräte und Fehlerzähler
Gerätenutzung abrufen
Kapazitäts- und I/O-Metriken pro Gerät
Reparaturstatus abrufen
Aktueller Fortschritt von Wiederaufbau-/Reparaturvorgängen
Journalstatus abrufen
Gesundheit des Write-Ahead-Journals
Status der Integritätsprüfung abrufen
Fortschritt der Datenintegritätsprüfung
Cache-Info abrufen
Cache-Treffer-/Fehlverhältnisse und Speichernutzung
Dateistatus abrufen
Replikation und Integrität für eine bestimmte Datei
Top-Nutzungsraten abrufen
Top-Speicherverbraucher identifizieren
Laufende Konfiguration abrufen
Aktuelle vSAN-Konfigurationsparameter
Sync-Liste abrufen
Aktive Synchronisierungsvorgänge
Knotenliste abrufen
Alle am vSAN teilnehmenden Knoten
Integritätsprüfung
Eine vollständige Integritätsprüfung starten
Festplattennutzung zusammenfassen
Zusammenfassung der Festplattennutzung im gesamten Cluster
vSAN-Gesundheitsprüfungs-Workflow
Ein strukturierter Ansatz zur Untersuchung von Speicherproblemen:
Wichtige zu überwachende Indikatoren
working = falsebei einer beliebigen Ebene → Kritisch — Ebene ist nicht betriebsbereitredundant = false→ Degradierter Zustand, keine Fehlertoleranzbad_drives > 0→ Laufwerksfehler erkannt, automatische Reparatur läuftReparaturstatus überall null → Keine aktiven Reparaturen (gesunder Zustand)
Schreibdrosselung aktiv → Speicherkapazität nähert sich den Grenzen (>91 % löst Drosselung aus)
Schwellenwerte für die Drosselung des Speicherplatzes
< 91%
Normalbetrieb, keine Drosselung
91–95%
Drosselung bei wenig Speicher beginnt (10 ms zusätzliche Latenz)
96%+
Kritische Drosselung (50 ms zusätzliche Latenz)
> 96%
Starke Leistungsverschlechterung
NAS-Diagnosen
Zugriff: NAS → [NAS-Dienst auswählen] → Diagnostik
NAS-Diagnosen sind pro NAS-Dienst — jede NAS-Instanz hat ihre eigene Diagnoseschnittstelle. Diese Tools konzentrieren sich auf Dateifreigabeprotokolle (SMB/CIFS, NFS) und Authentifizierung.
Dateifreigabe & Authentifizierung
Samba
SMB/CIFS-Dienststatus — aktive Verbindungen und gesperrte Dateien, Konfigurationsprüfung und Freigabenauflistung
NFS
NFS-Dienststatus — aktuelle Exporte, RPC-Registrierung und Sichtbarkeit von Client-Mounts
Winbind
Active-Directory-Prüfungen — Vertrauensbeziehung zur Domäne, Domänenbenutzer und Domänengruppen
Standard-Netzwerktools
NAS-Diagnosen enthalten auch die Standard-Konnektivitätstools: Ping, Traceroute, ARP-Scan/Tabelle, TCP Dump, TCP-Verbindungstest, DNS-Abfrage, NTP-Abfrage, Top-CPU-Auslastung, Top-Netzwerkauslastung, und Protokolle.
Benutzer- und Gruppen-Diagnostik
Benutzer
Systembenutzerkonten
Gruppen
Systemgruppen und Mitgliedschaften
Datum/Uhrzeit
Zeitsynchronisation (kritisch für Kerberos/AD)
Dienste
Alle laufenden Dienste
Troubleshooting-Workflow nach Best Practice
Wenn Sie ein Problem untersuchen, folgen Sie einem strukturierten Eskalationspfad von komponentenspezifischer Diagnostik bis zur systemweiten Analyse:
Workflow-Richtlinien
Einfach anfangen — Vor dem Paketmitschnitt pingen. Den Ebenenstatus vor Integritätsprüfungen prüfen.
Den Umfang korrekt festlegen — Wählen Sie vor dem Ausführen von Diagnosen das richtige Netzwerk, den richtigen Knoten oder den richtigen NAS-Dienst aus. Das Ausführen von Befehlen im falschen Kontext liefert irreführende Ergebnisse.
Währenddessen dokumentieren — Verwenden Sie „Befehl anzeigen“, um exakte Befehle zu erfassen. Kopieren Sie die Ausgabe, bevor Sie mit dem nächsten Test fortfahren.
Auswirkungen auf die Leistung berücksichtigen — TCP Dump, NMAP-Scans und Integritätsprüfungen können die Produktionsleistung beeinträchtigen. Planen Sie intensive Diagnosen in Wartungsfenstern ein.
Protokolle zuletzt prüfen — Protokolle liefern Kontext, können aber überwältigend sein. Verwenden Sie zuerst gezielte Diagnosen und gleichen Sie sie anschließend mit den Protokolleinträgen ab.
Systemdiagnosen-Bundle
Für Probleme, die mehrere Komponenten betreffen oder eine Eskalation an den Support erfordern, kann VergeOS ein vollständiges Diagnosepaket:
Zugriff: System → Systemdiagnosen
Ausgabe:
[SYSTEMNAME]_diags_[YYYYMMDD]_[HHMMSS].tar.gzInhalt: vSAN-Statusdateien, S.M.A.R.T.-Berichte, Netzwerkkonfiguration, IPMI-Daten, Systemprotokolle und Kernel-Protokolle — pro Knoten organisiert
Paketablage: Gespeichert als ein
DateiEintrag in vSAN; das Paket bleibt bestehen, bis Sie es löschen
Vor der Eskalation
Erstellen Sie immer ein aktuelles System-Diagnosepaket, bevor Sie den Support kontaktieren. Das liefert einen vollständigen Point-in-Time-Snapshot, den Supporttechniker analysieren können, ohne Live-Systemzugriff zu benötigen.
Schnellreferenz: Welches Toolkit verwenden
Netzwerkdiagnostik
Verwenden bei: VM kann nicht ins Internet, DNS wird nicht aufgelöst, Firewall blockiert Traffic, DHCP vergibt keine IPs, VPN-Tunnel ausgefallen
Zugriff: Netzwerke → [Netzwerk] → Diagnostik
Knotendiagnostik
Verwenden bei: Hardwarewarnungen, Laufwerksausfälle, Temperaturwarnungen, NIC-Link-Probleme, BMC reagiert nicht, Fabric-Konnektivitätsprobleme
Zugriff: Infrastruktur → Knoten → [Knoten] → Diagnostik
vSAN-Diagnosen
Verwenden bei: Speicherleistung verschlechtert, Ebene ungesund, Kapazitätswarnungen, Reparatur hängt, Bedenken hinsichtlich der Datenintegrität
Zugriff: System → vSAN-Diagnosen
NAS-Diagnosen
Verwenden bei: SMB-Freigaben nicht zugänglich, NFS-Mounts schlagen fehl, AD-Authentifizierung defekt, Dateiberechtigung verweigert, langsame CIFS-Leistung
Zugriff: NAS → [NAS-Dienst] → Diagnostik
Zuletzt aktualisiert
War das hilfreich?