For the complete documentation index, see llms.txt. This page is also available as Markdown.

Prometheus- & Grafana-Integration

Stellen Sie den vergeos-exporter bereit, um vSAN-, Cluster- und Knotenmuster im Prometheus-Format zu erfassen, konfigurieren Sie Grafana-Dashboards und integrieren Sie AlertManager für proaktives Monitoring.

Warum externe Metriken wichtig sind

Das VergeOS-Dashboard bietet Echtzeit-Zustand und Analysen, aber Unternehmensüberwachungsstrategien erfordern typischerweise einen zentralen Time-Series-Speicher, der Metriken über mehrere Systeme hinweg aggregieren, Daten über das 45-Tage-Fenster in der UI hinaus aufbewahren und ausgefeilte Alarmierungsregeln auslösen kann. Der vergeos-exporter schließt diese Lücke, indem er VergeOS-Metriken im Prometheus-Format bereitstellt -- dem De-facto-Standard für Cloud-native Überwachung.

Wenn der Exporter läuft, erhalten Sie langfristige Trendanalysen, systemübergreifende Korrelation und Integration in bestehende Alarmierungspipelines -- alles ohne Änderungen am VergeOS-System selbst.

Der vergeos-exporter

Das vergeos-exporter ist ein Open-Source-Tool, das von Verge im verge-io/vergeos-exporter GitHub-Repository gepflegt wird. Es verbindet sich mit der VergeOS-REST-API, sammelt Infrastrukturmetriken und stellt sie an einem HTTP-Endpunkt bereit, den Prometheus in einem konfigurierbaren Intervall abruft.

Verfügbare Metriken

Der Exporter sammelt drei Kategorien von Metriken:

vSAN-Tier-Metriken

Kapazität, Nutzung und Zuweisung pro Tier. Transaktions- und Reparaturzähler. Überwachung des Laufwerkstatus (online, offline, repairing, initializing, verifying, noredundant, outofspace). Laufwerkstemperatur- und Gesundheitsdaten. Lese-/Schreibvorgänge und IOPS.

Cluster-Metriken

Knotenzahl pro Cluster. RAM-, CPU- und Festplattenauslastung. Synchronisierungsstatus und Zustand.

Knotenmetriken

CPU- und Speichernutzung pro Knoten. Netzwerkdurchsatz und Latenz. Servicestatus pro Knoten.

Eine vollständige Metrik-Referenz ist in der metrics.md -Datei im Repository des Exporters verfügbar.

Architektur: Pull-basiertes Abrufen

Der vergeos-exporter folgt dem standardmäßigen Prometheus-Pull-Modell. Prometheus initiiert die Verbindung, indem es den /metrics -Endpunkt am Exporter in einem konfigurierten Intervall abruft (typischerweise 15–60 Sekunden). Dieser Ansatz bedeutet:

  • Keine eingehenden Firewall-Regeln sind auf dem VergeOS-System selbst erforderlich

  • Der Exporter kann auf jedem Host mit Netzwerkzugriff auf die VergeOS-API ausgeführt werden

  • Mehrere Prometheus-Instanzen können denselben Exporter für HA abrufen

  • Der Exporter ist AlertManager-kompatibel -- Prometheus-Alarmierungsregeln funktionieren nativ mit den bereitgestellten Metriken

Konfiguration des Dienstkontos

Bevor Sie den Exporter bereitstellen, erstellen Sie in VergeOS ein dediziertes Dienstkonto mit minimalen Berechtigungen.

Schritt für Schritt: Dienstkonto für den Exporter erstellen

  1. Navigieren Sie zu System → Benutzer in der VergeOS-UI

  2. Klicken Sie auf Neu um einen neuen Benutzer zu erstellen

  3. Füllen Sie das Neuer Benutzer -Formular aus:

    • Benutzername: prometheus-exporter (oder ein ähnlicher beschreibender Name)

    • Typ: API

    • Passwort: einen starken, zufällig generierten Wert

    • Zwei-Faktor-Authentifizierung: lassen Sie deaktiviert -- der Exporter authentifiziert sich per API-Benutzername/-Passwort

  4. Klicken Sie auf Senden um zu speichern

Neue normale/API-Benutzer erhalten standardmäßig Auflisten/Lesen für alles was genau das ist, was der Exporter benötigt. Um den Umfang weiter zu verkleinern, schränken Sie die Berechtigungen unter System → Berechtigungen ein, nachdem der Benutzer erstellt wurde.

Bereitstellungsoptionen

Der vergeos-exporter unterstützt mehrere Bereitstellungsmodelle. Wählen Sie dasjenige, das am besten zu Ihrer Überwachungsinfrastruktur passt.

Option 1: Standalone-Binary

Vorgefertigte Binaries sind für Linux, Windows und macOS (amd64 und arm64) auf der GitHub-Releases -Seite verfügbar.

Der Exporter lauscht standardmäßig auf Port 9888 . Überschreiben Sie ihn bei Bedarf mit dem -web.listen-address -Flag.

Option 2: Linux-Systemd-Dienst

Für produktive Linux-Bereitstellungen führen Sie den Exporter als verwalteten systemd-Dienst aus:

Option 3: Windows-Dienst (NSSM)

Auf Windows-Überwachungs-Hosts verwenden Sie NSSM (Non-Sucking Service Manager) um den Exporter als Windows-Dienst auszuführen:

  1. Laden Sie NSSM herunter und platzieren Sie nssm.exe an einem dauerhaften Speicherort (z. B. C:\Program Files\nssm\)

  2. Registrieren Sie den Dienst:

Option 4: Docker Compose

Das Repository enthält ein vorgefertigtes Docker-Compose-Beispiel unter examples/docker-compose/ das den Exporter, Prometheus und Grafana in einem einzigen Stack bündelt -- ideal für schnelle Evaluierungen oder Laborumgebungen.

Das Docker-Compose-Beispiel lädt automatisch das richtige plattformspezifische Binary für Ihre Architektur herunter.

Prometheus-Konfiguration

Fügen Sie den Exporter in Ihrer prometheus.yml:

Zum Überwachen mehrerer VergeOS-Umgebungen stellen Sie pro Umgebung einen Exporter bereit und fügen Sie jeden als separates Ziel hinzu (oder verwenden Sie Prometheus-Relabeling für dynamische Erkennung).

Grafana-Dashboard

Der vergeos-exporter wird mit einem vorkonfigurierten Grafana-Dashboard ausgeliefert (examples/grafana-dashboard.json), das vSAN-, Cluster- und Knotenmetriken sofort abdeckt.

Enthaltene Dashboard-Bereiche

Kategorie
Bedienfelder

vSAN-Performance

Anzeigen für Tier-Kapazität und -Nutzung, IOPS-Diagramme, Lese-/Schreibdurchsatz

Cluster-Zustand

Knotenzahl, Synchronisierungsstatus, aggregierte CPU- und RAM-Auslastung

Knotendetails

CPU, Speicher, Netzwerkdurchsatz und Temperatur pro Knoten

Speicherzustand

Laufwerkszustände, Reparaturstatus, Fehlerzähler

Importieren des Dashboards

  1. Öffnen Sie Grafana und navigieren Sie zu Dashboards → Import

  2. Klicken Sie auf JSON-Datei hochladen und wählen Sie die grafana-dashboard.json aus dem Exporter-Repository aus

  3. Wählen Sie Ihre Prometheus-Datenquelle aus dem Dropdown-Menü

  4. Klicken Sie auf Importieren

Das Dashboard ist sofort funktionsfähig, sobald Prometheus Exporter-Metriken empfängt.

Verifizierung

Überprüfen Sie nach der Bereitstellung, ob der Exporter Metriken sammelt:

Wenn der Endpunkt Metriken zurückgibt, ruft Prometheus sie automatisch beim nächsten Intervall ab. Prüfen Sie die Prometheus- Ziele -Seite (http://prometheus:9090/targets), um zu bestätigen, dass der vergeos Job den Status UP.

Checkliste zur Fehlerbehebung

Symptom
Prüfen Sie

Keine Metriken zurückgegeben

Vergewissern Sie sich, dass die VergeOS-URL, der Benutzername und das Passwort korrekt sind

Verbindung abgelehnt

Bestätigen Sie, dass der Exporter-Prozess läuft und auf 9888 lauscht

Authentifizierungsfehler

Bestätigen Sie, dass das Dienstkonto Typ = API mit Zwei-Faktor-Authentifizierung deaktiviert

Teilweise Metriken

Vergewissern Sie sich, dass das Dienstkonto Auflisten und Lesen -Berechtigungen

Prometheus-Ziel DOWN

Prüfen Sie die Netzwerkkonnektivität zwischen Prometheus und dem Exporter-Host

Scrape-Timeout

Erhöhen Sie -scrape.timeout (Standard 30 s) für große Umgebungen

Integration mit AlertManager

Da der Exporter Standard-Prometheus-Metriken bereitstellt, können Sie Alarmierungsregeln schreiben, die ausgelöst werden, wenn Schwellenwerte überschritten werden:

AlertManager kann diese Alarme an E-Mail, Slack, PagerDuty, OpsGenie oder einen beliebigen Webhook-Endpunkt weiterleiten -- und so das VergeOS-Monitoring in Ihren bestehenden Vorfallmanagement-Workflow integrieren.

Alternative: Direkte API-Integration mit Zabbix

Wenn Ihre Organisation Zabbix statt Prometheus verwendet, können Sie die VergeOS-REST-API direkt mit Zabbix HTTP-Agent-Elementen abfragen:

  1. Erstellen Sie ein API-Token über System → API-Dokumentation (Swagger UI)

  2. Verwenden Sie Zabbix-HTTP-Agent-Elemente, um Endpunkte abzufragen wie /api/v4/vms, /api/v4/nodes, /api/v4/vnets

  3. Authentifizieren Sie sich per POST an /api/sys/tokens und übergeben Sie das Sitzungstoken im x-yottabyte-token -Header

Der Prometheus-Exporter bleibt für die meisten Umgebungen der empfohlene Ansatz, da er einen umfangreicheren Metriksatz und ein vorgefertigtes Dashboard bietet.

Kommen Sie von VMware oder Nutanix?

VergeOS stellt Plattformmetriken über die vergeos-exporterbereit, die vSAN-, Cluster- und Knotendaten im standardmäßigen Prometheus-Format darstellt. Prometheus ruft den Exporter per Pull-Verfahren auf Port 9888 und Grafana rendert das gebündelte Dashboard -- so fließen VergeOS-Metriken in denselben Prometheus + Grafana-Stack, den viele Teams bereits parallel zu ihren bestehenden Plattformen betreiben.

Wichtige Erkenntnisse

  • Das vergeos-exporter stellt vSAN-, Cluster- und Knotenmetriken auf Port 9888 im standardmäßigen Prometheus-Format bereit

  • Erstellen Sie ein dediziertes API-Dienstkonto -- Auflisten/Lesen für alles ist die Standardeinstellung für neue Normal/API-Benutzer

  • Bereitstellung als Standalone-Binary, systemd-Dienst, Windows-Dienst (NSSM) oder Docker-Compose-Stack

  • Das gebündelte Grafana-Dashboard bietet sofortige Einblicke in Speicher-, Cluster- und Knoten-Zustand

  • Prometheus AlertManager Integration ermöglicht proaktive Alarmierung bei Kapazitäts-, Laufwerkszustands- und Leistungsschwellenwerten

  • Der Exporter verwendet pull-basiertes Abrufen -- keine eingehenden Firewall-Änderungen am VergeOS-System erforderlich

Zuletzt aktualisiert

War das hilfreich?