Vue d'ensemble des nœuds
Vue d'ensemble de la gestion des nœuds VergeOS, y compris l'état du nœud, la configuration matérielle, les métriques de ressources, les disques, les NIC, l'état du fabric, les machines en cours d'exécution et les opérations de gestion.
Un nœud dans VergeOS représente un serveur physique ou virtuel qui fournit des ressources de calcul, de stockage et de réseau à votre environnement. Le tableau de bord des nœuds offre des fonctionnalités complètes de surveillance et de gestion pour chaque nœud de votre système.
Composants clés
Informations sur l’état du nœud
État: Affiche l’état opérationnel actuel (En cours d’exécution/Hors ligne)
En cours d’exécution: Indique que le nœud est actuellement opérationnel
Mode maintenance: Indique si le nœud est en état de maintenance
Dernière mise sous tension: Horodatage du dernier démarrage du nœud
Heure locale: Heure actuelle sur le nœud
État IPMI: Affiche l’état de l’Interface de gestion de plateforme intelligente
Adresse réseau IPMI: Adresse réseau pour l’accès à la gestion à distance
Version du système: Affiche la version actuelle de VergeOS (version de l’OS, version vSAN, version du serveur d’applications, version du noyau)
Configuration matérielle
CPU: Modèle et génération du processeur
Cœurs CPU: Nombre de cœurs physiques du processeur
RAM: Capacité totale de mémoire physique
RAM de basculement: Mémoire réservée aux scénarios de basculement
RAM en surallocation: Mémoire disponible pour la sursouscription
Cluster: Le cluster auquel ce nœud appartient
Réseau PXE: Réseau utilisé pour les opérations de démarrage PXE
Modèle: Informations sur la plateforme matérielle
Série: Désignation de la série du produit
Étiquettes d’inventaire et fonctionnalités
Physique: Indique un actif matériel physique
Capturer les journaux système: État de la journalisation système
LLDP: État du protocole de découverte de couche liaison
Prise en charge de l’iOMMU (VT-d): Prise en charge de la virtualisation matérielle
Redémarrage nécessaire: Indique si un redémarrage est requis
Rechargement du pilote nécessaire: Indique si les mises à jour du pilote nécessitent un rechargement
Métriques des ressources
Le tableau de bord fournit une surveillance en temps réel et historique via :
Graphique d’utilisation du CPU: Affiche l’utilisation actuelle, moyenne et maximale du CPU avec visualisation des tendances historiques
CPU total
Pic du cœur
Utilisation (Utilisateur, Système, attente E/S, utilisation VM, IRQ)
Statistiques du nœud
Le tableau de bord fournit des métriques clés organisées par catégorie :
RAM physique: Pourcentage d’utilisation actuelle de la mémoire et capacité
RAM virtuelle: Mémoire virtuelle allouée (généralement 0 % lorsqu’il n’y a pas de surallocation)
Température: Température actuelle du nœud avec indicateur visuel (vert/jaune/rouge selon les seuils)
Machines en cours d’exécution: Nombre de charges de travail actives sur le nœud
Utilisation des cœurs: Pourcentage de cœurs CPU utilisés
Utilisation de la RAM: Consommation mémoire sur les machines en cours d’exécution
Ressources matérielles
Disques
Affiche tous les disques physiques rattachés au nœud :
État: Indicateur en ligne/hors ligne
Nom: Identifiant du disque (par ex. nvme0n1, nvme1n1)
Modèle: Fabricant et numéro de modèle
Niveau: Affectation du niveau de stockage vSAN
ID du disque vSAN: Identifiant unique dans vSAN
Micrologiciel: Version du micrologiciel du disque
Bus: Connexion au bus matériel
Utilisation: Utilisation de la capacité avec indicateur visuel
En réparation: État de reconstruction du disque
Erreurs de lecture/écriture: Compteurs d’erreurs pour la surveillance de l’état du disque
Cartes d’interface réseau (NIC)
Informations et état complets des NIC :
État: État opérationnel (En ligne/Hors ligne)
État du fabric: État de connectivité du fabric principal (Confirmé/Non confirmé) avec indicateur visuel
L’icône du globe indique les NIC connectées au fabric principal
L’état confirmé signifie que la NIC est correctement intégrée au fabric réseau
Nom: Identifiant de l’interface (par ex. enp2s0f0, enp8s0)
Modèle: Modèle de l’adaptateur réseau
Fournisseur: Fabricant de l’adaptateur réseau
Pilote: Pilote réseau utilisé
port: Numéro de port physique
Vitesse: Vitesse de liaison (par ex. 10000Mb/s, 2500Mb/s)
MAC: Adresse MAC matérielle
Réseau: Réseau VergeOS associé
RX/TX: Volume de données reçues et transmises
Débit RX/TX: Débits de transfert actuels
Actions: Icônes d’accès rapide pour les opérations NIC (console, graphiques, configuration)
Modules mémoire
Affiche la configuration de la RAM installée :
Nombre de modules et capacité
Type de mémoire et spécifications
Voisins LLDP
Affiche les informations du protocole de découverte de couche liaison pour les périphériques réseau connectés :
Informations sur le commutateur connecté
Mappages de ports
Visualisation de la topologie réseau
Périphériques PCI
Liste tous les périphériques PCI/PCIe :
Types et modèles de périphériques
Affectations de bus
Disponibilité du passthrough
PÉRIPHÉRIQUES NVIDIA vGPU
Ressources GPU disponibles pour les attributions de GPU virtuels (le cas échéant) :
Nombre de fonctions virtuelles
État d’affectation
PÉRIPHÉRIQUES NVIDIA vGPU
Ressources GPU disponibles pour les attributions de GPU virtuels (le cas échéant) :
Modèle et capacité du GPU
Profils vGPU disponibles
État d’allocation
Périphériques USB
Périphériques USB connectés :
Identification du périphérique
Capacité de passthrough
Ressources
Allocation et limites des ressources :
Affectations de cœurs
Allocations mémoire
Affectations de stockage
Tâches
Tâches actives et planifiées :
Opérations en cours
Travaux en file d’attente
Historique des tâches
Machines en cours d’exécution
Affiche les charges de travail actives avec une consommation détaillée des ressources :
État: Indicateur d’état en cours d’exécution
Type: Type de charge de travail (machine virtuelle, conteneur vNet)
Nom: Identifiant de la machine
Cœurs CPU: Nombre de cœurs attribués
Utilisation du CPU: Pourcentage d’utilisation actuel du processeur
RAM: Mémoire allouée avec pourcentage d’utilisation et indicateur visuel
Dernier démarrage: Horodatage du démarrage de la machine
Les types de machines courants incluent :
Machines virtuelles (VM)
Conteneurs vNet (services réseau)
Services système (NAS, DMZ, externe, etc.)
Fonctionnalités clés
Opérations de gestion
Disponibles dans le menu de gauche :
Contrôle d’alimentation:
Mise sous tension/hors tension
Redémarrer
Couper l’alimentation (arrêt forcé)
Opérations de maintenance:
Activer/Désactiver le mode maintenance
Augmenter la capacité (ajouter des ressources au cluster)
Console distante: Accès direct à la console du nœud pour le dépannage
Configuration:
Modifier les paramètres du nœud
Attribuer des étiquettes pour l’organisation
Supprimer le nœud (le cas échéant)
Ajouter des notes pour la documentation
Actualiser: Met à jour les données du tableau de bord
Gestion IPMI: Accès à l’interface de gestion à distance
Surveillance
Utilisation des ressources en temps réel: Graphiques en direct pour le CPU, la mémoire et la température
Données historiques de performance: Analyse des tendances via le lien Historique
Journaux d’événements: Journalisation complète des événements du nœud avec :
Niveau: Classification Avertissement/Info/Erreur
Heure: Horodatage de chaque événement
Source: Composant à l’origine (par ex. node1)
Message: Description détaillée de l’événement (par ex. avertissements de température)
Option Voir plus pour un historique de journaux étendu
État de santé matérielle: Erreurs de disque, état des NIC et surveillance des composants
Journaux et diagnostics
La section Journaux fournit des événements système critiques :
Avertissements de température: Alertes de seuil de température des cœurs
Événements matériels: Changements d’état des disques, événements NIC
Événements système: Changements d’état d’alimentation, transitions du mode maintenance
Alertes de performance: Avertissements d’utilisation des ressources
Les entrées de journal courantes incluent des avertissements de température des cœurs avec des valeurs de seuil spécifiques (par ex. "Le cœur a atteint la température d’avertissement '96 / 95").
Bonnes pratiques
Surveiller la santé du nœud: Passez régulièrement en revue les métriques de santé du nœud, en particulier la température et l’état des disques
Mode maintenance: Activez toujours le mode maintenance avant d’effectuer des mises à jour du système ou des changements matériels
Examiner les journaux: Vérifiez périodiquement les journaux pour détecter d’éventuels problèmes, en particulier les avertissements de température et les erreurs de disque
Équilibrage de charge: Maintenez une répartition équilibrée des charges de travail sur les nœuds de votre cluster
Restez à jour: Maintenez à jour le micrologiciel et le logiciel système via le menu Système
Accès à la console à distance: Utilisez la fonctionnalité de console à distance pour un dépannage direct lorsque l’accès à la console physique ou à SSH est nécessaire
Surveillance de l’état du fabric: Surveillez l’état du fabric des NIC principales afin d’assurer une bonne intégration réseau et la redondance
État de santé des disques: Surveillez les compteurs d’erreurs et l’état de réparation des disques pour traiter de manière proactive les problèmes de stockage
Gestion de la température: Traitez les avertissements de température répétés en vérifiant les systèmes de refroidissement et la circulation de l’air
Mis à jour
Ce contenu vous a-t-il été utile ?