> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/run-the-platform/fr/administration-systeme/nodes-overview.md).

# Vue d’ensemble des nœuds

Un nœud dans VergeOS représente un serveur physique ou virtuel qui fournit des ressources de calcul, de stockage et de réseau à votre environnement. Le tableau de bord des nœuds offre des fonctionnalités complètes de surveillance et de gestion pour chaque nœud de votre système.

## Composants clés

### Informations sur l’état du nœud

* **État**: Affiche l’état opérationnel actuel (En cours d’exécution/Hors ligne)
* **En cours d’exécution**: Indique que le nœud est actuellement opérationnel
* **Mode maintenance**: Indique si le nœud est en état de maintenance
* **Dernière mise sous tension**: Horodatage du dernier démarrage du nœud
* **Heure locale**: Heure actuelle sur le nœud
* **État IPMI**: Affiche l’état de l’Interface de gestion de plateforme intelligente
* **Adresse réseau IPMI**: Adresse réseau pour l’accès à la gestion à distance
* **Version du système**: Affiche la version actuelle de VergeOS (version de l’OS, version vSAN, version du serveur d’applications, version du noyau)

### Configuration matérielle

* **CPU**: Modèle et génération du processeur
* **Cœurs CPU**: Nombre de cœurs physiques du processeur
* **RAM**: Capacité totale de mémoire physique
* **RAM de basculement**: Mémoire réservée aux scénarios de basculement
* **RAM en surallocation**: Mémoire disponible pour la sursouscription
* **Cluster**: Le cluster auquel ce nœud appartient
* **Réseau PXE**: Réseau utilisé pour les opérations de démarrage PXE
* **Modèle**: Informations sur la plateforme matérielle
* **Série**: Désignation de la série du produit

### Étiquettes d’inventaire et fonctionnalités

* **Physique**: Indique un actif matériel physique
* **Capturer les journaux système**: État de la journalisation système
* **LLDP**: État du protocole de découverte de couche liaison
* **Prise en charge de l’iOMMU (VT-d)**: Prise en charge de la virtualisation matérielle
* **Redémarrage nécessaire**: Indique si un redémarrage est requis
* **Rechargement du pilote nécessaire**: Indique si les mises à jour du pilote nécessitent un rechargement

### Métriques des ressources

Le tableau de bord fournit une surveillance en temps réel et historique via :

* **Graphique d’utilisation du CPU**: Affiche l’utilisation actuelle, moyenne et maximale du CPU avec visualisation des tendances historiques
  * CPU total
  * Pic du cœur
  * Utilisation (Utilisateur, Système, attente E/S, utilisation VM, IRQ)

### Statistiques du nœud

Le tableau de bord fournit des métriques clés organisées par catégorie :

* **RAM physique**: Pourcentage d’utilisation actuelle de la mémoire et capacité
* **RAM virtuelle**: Mémoire virtuelle allouée (généralement 0 % lorsqu’il n’y a pas de surallocation)
* **Température**: Température actuelle du nœud avec indicateur visuel (vert/jaune/rouge selon les seuils)
* **Machines en cours d’exécution**: Nombre de charges de travail actives sur le nœud
* **Utilisation des cœurs**: Pourcentage de cœurs CPU utilisés
* **Utilisation de la RAM**: Consommation mémoire sur les machines en cours d’exécution

### Ressources matérielles

#### Disques

Affiche tous les disques physiques rattachés au nœud :

* **État**: Indicateur en ligne/hors ligne
* **Nom**: Identifiant du disque (par ex. nvme0n1, nvme1n1)
* **Modèle**: Fabricant et numéro de modèle
* **Niveau**: Affectation du niveau de stockage vSAN
* **ID du disque vSAN**: Identifiant unique dans vSAN
* **Micrologiciel**: Version du micrologiciel du disque
* **Bus**: Connexion au bus matériel
* **Utilisation**: Utilisation de la capacité avec indicateur visuel
* **En réparation**: État de reconstruction du disque
* **Erreurs de lecture/écriture**: Compteurs d’erreurs pour la surveillance de l’état du disque

#### Cartes d’interface réseau (NIC)

Informations et état complets des NIC :

* **État**: État opérationnel (En ligne/Hors ligne)
* **État du fabric**: État de connectivité du fabric principal (Confirmé/Non confirmé) avec indicateur visuel
  * L’icône du globe indique les NIC connectées au fabric principal
  * L’état confirmé signifie que la NIC est correctement intégrée au fabric réseau
* **Nom**: Identifiant de l’interface (par ex. enp2s0f0, enp8s0)
* **Modèle**: Modèle de l’adaptateur réseau
* **Fournisseur**: Fabricant de l’adaptateur réseau
* **Pilote**: Pilote réseau utilisé
* **port**: Numéro de port physique
* **Vitesse**: Vitesse de liaison (par ex. 10000Mb/s, 2500Mb/s)
* **MAC**: Adresse MAC matérielle
* **Réseau**: Réseau VergeOS associé
* **RX/TX**: Volume de données reçues et transmises
* **Débit RX/TX**: Débits de transfert actuels
* **Actions**: Icônes d’accès rapide pour les opérations NIC (console, graphiques, configuration)

#### Modules mémoire

Affiche la configuration de la RAM installée :

* Nombre de modules et capacité
* Type de mémoire et spécifications

#### Voisins LLDP

Affiche les informations du protocole de découverte de couche liaison pour les périphériques réseau connectés :

* Informations sur le commutateur connecté
* Mappages de ports
* Visualisation de la topologie réseau

#### Périphériques PCI

Liste tous les périphériques PCI/PCIe :

* Types et modèles de périphériques
* Affectations de bus
* Disponibilité du passthrough

#### PÉRIPHÉRIQUES NVIDIA vGPU

Ressources GPU disponibles pour les attributions de GPU virtuels (le cas échéant) :

* Nombre de fonctions virtuelles
* État d’affectation

#### PÉRIPHÉRIQUES NVIDIA vGPU

Ressources GPU disponibles pour les attributions de GPU virtuels (le cas échéant) :

* Modèle et capacité du GPU
* Profils vGPU disponibles
* État d’allocation

#### Périphériques USB

Périphériques USB connectés :

* Identification du périphérique
* Capacité de passthrough

#### Ressources

Allocation et limites des ressources :

* Affectations de cœurs
* Allocations mémoire
* Affectations de stockage

#### Tâches

Tâches actives et planifiées :

* Opérations en cours
* Travaux en file d’attente
* Historique des tâches

### Machines en cours d’exécution

Affiche les charges de travail actives avec une consommation détaillée des ressources :

* **État**: Indicateur d’état en cours d’exécution
* **Type**: Type de charge de travail (machine virtuelle, conteneur vNet)
* **Nom**: Identifiant de la machine
* **Cœurs CPU**: Nombre de cœurs attribués
* **Utilisation du CPU**: Pourcentage d’utilisation actuel du processeur
* **RAM**: Mémoire allouée avec pourcentage d’utilisation et indicateur visuel
* **Dernier démarrage**: Horodatage du démarrage de la machine

Les types de machines courants incluent :

* Machines virtuelles (VM)
* Conteneurs vNet (services réseau)
* Services système (NAS, DMZ, externe, etc.)

## Fonctionnalités clés

### Opérations de gestion

Disponibles dans le menu de gauche :

* **Contrôle d’alimentation**:
  * Mise sous tension/hors tension
  * Redémarrer
  * Couper l’alimentation (arrêt forcé)
* **Opérations de maintenance**:
  * Activer/Désactiver le mode maintenance
  * Augmenter la capacité (ajouter des ressources au cluster)
* **Console distante**: Accès direct à la console du nœud pour le dépannage
* **Configuration**:
  * Modifier les paramètres du nœud
  * Attribuer des étiquettes pour l’organisation
  * Supprimer le nœud (le cas échéant)
  * Ajouter des notes pour la documentation
* **Actualiser**: Met à jour les données du tableau de bord
* **Gestion IPMI**: Accès à l’interface de gestion à distance

### Surveillance

* **Utilisation des ressources en temps réel**: Graphiques en direct pour le CPU, la mémoire et la température
* **Données historiques de performance**: Analyse des tendances via le lien Historique
* **Journaux d’événements**: Journalisation complète des événements du nœud avec :
  * **Niveau**: Classification Avertissement/Info/Erreur
  * **Heure**: Horodatage de chaque événement
  * **Source**: Composant à l’origine (par ex. node1)
  * **Message**: Description détaillée de l’événement (par ex. avertissements de température)
  * Option Voir plus pour un historique de journaux étendu
* **État de santé matérielle**: Erreurs de disque, état des NIC et surveillance des composants

### Journaux et diagnostics

La section Journaux fournit des événements système critiques :

* **Avertissements de température**: Alertes de seuil de température des cœurs
* **Événements matériels**: Changements d’état des disques, événements NIC
* **Événements système**: Changements d’état d’alimentation, transitions du mode maintenance
* **Alertes de performance**: Avertissements d’utilisation des ressources

Les entrées de journal courantes incluent des avertissements de température des cœurs avec des valeurs de seuil spécifiques (par ex. "Le cœur a atteint la température d’avertissement '96 / 95").

## Bonnes pratiques

* **Surveiller la santé du nœud**: Passez régulièrement en revue les métriques de santé du nœud, en particulier la température et l’état des disques
* **Mode maintenance**: Activez toujours le mode maintenance avant d’effectuer des mises à jour du système ou des changements matériels
* **Examiner les journaux**: Vérifiez périodiquement les journaux pour détecter d’éventuels problèmes, en particulier les avertissements de température et les erreurs de disque
* **Équilibrage de charge**: Maintenez une répartition équilibrée des charges de travail sur les nœuds de votre cluster
* **Restez à jour**: Maintenez à jour le micrologiciel et le logiciel système via le menu Système
* **Accès à la console à distance**: Utilisez la fonctionnalité de console à distance pour un dépannage direct lorsque l’accès à la console physique ou à SSH est nécessaire
* **Surveillance de l’état du fabric**: Surveillez l’état du fabric des NIC principales afin d’assurer une bonne intégration réseau et la redondance
* **État de santé des disques**: Surveillez les compteurs d’erreurs et l’état de réparation des disques pour traiter de manière proactive les problèmes de stockage
* **Gestion de la température**: Traitez les avertissements de température répétés en vérifiant les systèmes de refroidissement et la circulation de l’air


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/run-the-platform/fr/administration-systeme/nodes-overview.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
