> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/learn-the-platform/fr/module-9-supervision-et-depannage/05-diagnostics-toolkit.md).

# Boîte à outils de diagnostic

## Quatre boîtes à outils de diagnostic en une seule plateforme

VergeOS intègre des outils de diagnostic directement dans chaque sous-système majeur. Plutôt que de se connecter en SSH à des nœuds individuels ou d’installer des utilitaires tiers, les administrateurs exécutent les diagnostics depuis l’ **interface utilisateur VergeOS** — chacun étant limité au composant examiné.

```mermaid
graph LR
    sous-graphe "Diagnostics VergeOS"
        A["Diagnostics<br/>réseau"] --> E["Interface unifiée"]
        B["Diagnostics<br/>du nœud"] --> E
        C["Diagnostics<br/>vSAN"] --> E
        D["Diagnostics<br/>NAS"] --> E
    end
    E --> F["Résultats et<br/>export CLI"]

    style A fill:#4a90d9,color:#fff
    style B fill:#e67e22,color:#fff
    style C fill:#27ae60,color:#fff
    style D fill:#8e44ad,color:#fff
    style E fill:#2c3e50,color:#fff
    style F fill:#34495e,color:#fff
```

Chaque interface de diagnostic suit le même schéma :

1. Accédez au composant (réseau, nœud, NAS ou vSAN)
2. Cliquez sur **Diagnostics** dans le menu de gauche
3. Sélectionnez une commande dans la **Requête** menu déroulant
4. Configurez les paramètres à droite
5. Cliquez sur **Envoyer →** pour exécuter

{% hint style="success" %}
**Bascule "Afficher la commande"**

Activer **"Afficher la commande"** sur n'importe quel diagnostic pour voir la commande exacte exécutée. C'est la méthode de référence pour afficher la syntaxe sous-jacente pour le scripting, l'automatisation ou la reproduction d'une commande via SSH.
{% endhint %}

***

## Diagnostics réseau

**Accès :** Réseaux → \[Sélectionner le réseau] → Diagnostics

Les diagnostics réseau s'exécutent **par réseau** — vous sélectionnez le réseau spécifique à dépanner, et toutes les commandes s'exécutent dans le contexte de ce réseau. C'est essentiel car les réseaux VergeOS sont isolés par conception.

### Connectivité et découverte

| Commande                  | Rôle                                                |
| ------------------------- | --------------------------------------------------- |
| **Ping**                  | Test de connectivité ICMP de base                   |
| **Trace de route**        | Cartographier le chemin réseau vers une destination |
| **ARP Scan**              | Découvrir les périphériques actifs sur le réseau    |
| **Table ARP**             | Afficher les correspondances IP vers MAC actuelles  |
| **Test de connexion TCP** | Vérifier qu'un port TCP spécifique est accessible   |
| **Quelle est mon IP**     | Vérifier l'IP externe du réseau (vérification NAT)  |

### DNS et résolution de noms

| Commande          | Rôle                                                |
| ----------------- | --------------------------------------------------- |
| **Recherche DNS** | Interroger les enregistrements A, AAAA, MX, NS, PTR |

### Pare-feu et sécurité

| Commande                                     | Rôle                                                 |
| -------------------------------------------- | ---------------------------------------------------- |
| **Afficher les règles du pare-feu**          | Afficher l'ensemble complet des règles du pare-feu   |
| **Tracer / déboguer les règles du pare-feu** | Activer la journalisation par règle pour le débogage |
| **NMAP**                                     | Analyse de ports et découverte de services           |

### Analyse du trafic

| Commande                           | Rôle                                          |
| ---------------------------------- | --------------------------------------------- |
| **TCP Dump**                       | Capture de paquets avec filtrage BPF          |
| **Utilisation réseau maximale**    | Consommateurs de bande passante en temps réel |
| **Utilisation CPU la plus élevée** | Processus consommant le plus de CPU           |

### Spécifique au service

| Commande                           | Rôle                                                       |
| ---------------------------------- | ---------------------------------------------------------- |
| **Libération/Renouvellement DHCP** | Forcer l'actualisation du bail DHCP (réseaux clients DHCP) |
| **IPsec**                          | Surveiller et contrôler les tunnels VPN IPsec              |
| **FRRouting BGP/OSPF**             | État du protocole de routage dynamique                     |
| **Journaux**                       | Journaux système du conteneur réseau                       |

{% hint style="info" %}
**Accès des locataires**

Les locataires ont accès à leurs propres diagnostics réseau pour les réseaux spécifiques au locataire. Ces outils opèrent dans le périmètre réseau du locataire — ils ne peuvent pas voir les réseaux du niveau parent.
{% endhint %}

***

## Diagnostics du nœud

**Accès :** Infrastructure → Nœuds → \[Sélectionner le nœud] → Diagnostics

Les diagnostics du nœud offrent une **visibilité au niveau du matériel** sur les serveurs physiques individuels. Ces outils interagissent directement avec le BMC du serveur, les disques et les interfaces réseau physiques.

### Outils IPMI / BMC

Ces commandes communiquent avec le contrôleur de gestion de la carte mère du serveur — l'interface de gestion hors bande (iDRAC sur Dell, iLO sur HPE, etc.).

| Commande                                     | Rôle                                            |
| -------------------------------------------- | ----------------------------------------------- |
| **Infos BMC IPMI**                           | Micrologiciel et configuration du BMC           |
| **État du châssis IPMI**                     | État d'alimentation, détection d'intrusion      |
| **Infos FRU IPMI**                           | Identification des unités remplaçables sur site |
| **Infos LAN IPMI**                           | Configuration réseau du BMC                     |
| **Réinitialisation MC IPMI**                 | Réinitialiser un BMC non réactif                |
| **Capteurs IPMI**                            | Relevés de température, tension, ventilateur    |
| **Référentiel de données des capteurs IPMI** | Référentiel complet des données des capteurs    |
| **Journaux des événements système IPMI**     | Historique des événements matériels (SEL)       |

{% hint style="warning" %}
**Réinitialisation MC IPMI**

La réinitialisation du BMC perturbe temporairement la gestion hors bande. L'OS hôte continue de fonctionner — cela n'affecte que le contrôleur de gestion.
{% endhint %}

### Santé des disques et du stockage

| Commande                            | Rôle                                                                             |
| ----------------------------------- | -------------------------------------------------------------------------------- |
| **Informations S.M.A.R.T.**         | Attributs de santé du disque, usure, température                                 |
| **Test de diagnostic S.M.A.R.T.**   | Exécuter des tests courts, longs ou de transfert                                 |
| **Afficher les périphériques bloc** | Lister tous les périphériques bloc du nœud                                       |
| **Contrôle LED (disque)**           | Activer/désactiver la LED de localisation du disque pour identification physique |
| **Requête RAS**                     | Rapport d'erreurs ECC mémoire                                                    |

### Réseau et fabric

| Commande                    | Rôle                                            |
| --------------------------- | ----------------------------------------------- |
| **Outil Ethernet**          | Vitesse de lien, duplex, infos du pilote        |
| **Configuration de fabric** | État du fabric principal pour ce nœud           |
| **Agrégation réseau**       | Santé de l'interface agrégée et esclave actif   |
| **Adresses de pont**        | Table des adresses MAC du commutateur virtuel   |
| **Scan ARP / table ARP**    | Découverte réseau au niveau du nœud             |
| **Ping / traceroute**       | Connectivité de base depuis le contexte du nœud |

### Système

| Commande                           | Rôle                                                               |
| ---------------------------------- | ------------------------------------------------------------------ |
| **Table DMI**                      | Inventaire matériel complet (CPU, RAM, numéros de série)           |
| **Journaux**                       | Journaux système et du noyau                                       |
| **Vitesse OpenSSL**                | Benchmark des performances cryptographiques du CPU                 |
| **Effacer le stockage persistant** | Vider les caches du système de fichiers (usage réservé au support) |

{% hint style="info" %}
**Vous venez de VMware ou de Nutanix ?**
{% endhint %}

| Plateforme | Où l'inspection matérielle approfondie a lieu                                                                                                                                                     |
| ---------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| VMware     | SSH/DCUI vers l'hôte ESXi pour `esxcli`/`vsish`; vCenter expose certains SMART/capteurs, mais le travail approfondi quitte l'interface vSphere                                                    |
| Nutanix    | Page matériel de Prism Element + `ncli` depuis le CVM ; IPMI/BMC accessible séparément pour la LED des disques et les capteurs détaillés                                                          |
| VergeOS    | Panneau de diagnostic d'un seul nœud : IPMI, SMART, contrôle de la LED des disques, santé du fabric, sans SSH ni identifiants BMC séparés. "Afficher la commande" révèle la syntaxe sous-jacente. |

***

## Diagnostics vSAN

**Accès :** Système → Diagnostics vSAN

Les diagnostics vSAN fonctionnent au **niveau système**, offrant une visibilité approfondie sur le moteur de stockage distribué.

{% hint style="warning" %}
**Au niveau racine / parent uniquement**

Les diagnostics vSAN ne sont disponibles qu'au niveau racine/parent. **Les locataires n'ont pas accès** aux outils de diagnostic vSAN — ils interagissent avec le stockage via leurs disques virtuels alloués.
{% endhint %}

### Commandes de diagnostic vSAN clés

| Commande                                          | Rôle                                                        |
| ------------------------------------------------- | ----------------------------------------------------------- |
| **Obtenir l'état du niveau**                      | Santé, redondance et capacité par niveau                    |
| **Obtenir les taux du cluster**                   | Débit de lecture/écriture sur l'ensemble du cluster         |
| **Obtenir l'utilisation du cluster**              | Statistiques globales d'utilisation du stockage             |
| **Obtenir la liste des périphériques**            | Tous les périphériques de stockage du pool vSAN             |
| **Obtenir l'état du périphérique**                | Santé individuelle des périphériques et compteurs d'erreurs |
| **Obtenir l'utilisation du périphérique**         | Capacité et métriques I/O par périphérique                  |
| **Obtenir l'état des réparations**                | Progression de la reconstruction/réparation en cours        |
| **Obtenir l'état du journal**                     | Santé du journal de pré-écriture                            |
| **Obtenir l'état de la vérification d'intégrité** | Progression de la vérification de l'intégrité des données   |
| **Obtenir les informations du cache**             | Ratios cache hit/miss et utilisation de la mémoire          |
| **Obtenir l'état du fichier**                     | Réplication et intégrité d'un fichier spécifique            |
| **Obtenir les principaux taux d'utilisation**     | Identifier les principaux consommateurs de stockage         |
| **Obtenir la configuration en cours**             | Paramètres de configuration vSAN actuels                    |
| **Obtenir la liste de synchronisation**           | Opérations de synchronisation actives                       |
| **Obtenir la liste des nœuds**                    | Tous les nœuds participant au vSAN                          |
| **Vérification d'intégrité**                      | Lancer une vérification complète de l'intégrité             |
| **Résumer l'utilisation des disques**             | Résumé de l'utilisation des disques à l'échelle du cluster  |

### Flux de travail de vérification de santé vSAN

Une approche structurée pour enquêter sur les problèmes de stockage :

```mermaid
flowchart TD
    A["Vérifier l'état des niveaux"] --> B{Tous les niveaux<br/>fonctionnent = true ?}
    B -->|Oui| C["Vérifier les débits du cluster"]
    B -->|Non| D["Vérifier l'état de réparation"]
    D --> E["Vérifier l'état des périphériques<br/>pour les disques défaillants"]
    C --> F{Performance<br/>acceptable ?}
    F -->|Oui| G["Système sain"]
    F -->|Non| H["Vérifier les informations du cache"]
    H --> I["Vérifier les taux d'utilisation élevés"]
    I --> J["Identifier le goulet d'étranglement"]
    E --> K["Vérifier les données SMART<br/>via les diagnostics du nœud"]

    style A fill:#27ae60,color:#fff
    style G fill:#27ae60,color:#fff
    style D fill:#e74c3c,color:#fff
    style E fill:#e74c3c,color:#fff
```

### Indicateurs clés à surveiller

* **`working = false`** sur n'importe quel niveau → Critique — le niveau n'est pas opérationnel
* **`redundant = false`** → État dégradé, aucune tolérance aux pannes
* **`bad_drives > 0`** → Défaillance de disque détectée, réparation automatique en cours
* **État de réparation à zéro partout** → Aucune réparation active (état sain)
* **Limitation d'écriture active** → La capacité de stockage approche des limites (>91 % déclenche la limitation)

### Seuils de limitation de l'espace de stockage

| Utilisation | Comportement                                                              |
| ----------- | ------------------------------------------------------------------------- |
| **< 91%**   | Fonctionnement normal, aucune limitation                                  |
| **91–95 %** | La limitation en cas de faible espace commence (10 ms de latence ajoutée) |
| **96%+**    | Limitation critique (50 ms de latence ajoutée)                            |
| **> 96%**   | Dégradation sévère des performances                                       |

***

## Diagnostics NAS

**Accès :** NAS → \[Sélectionner le service NAS] → Diagnostics

Les diagnostics NAS sont **par service NAS** — chaque instance NAS dispose de sa propre interface de diagnostic. Ces outils se concentrent sur les protocoles de partage de fichiers (SMB/CIFS, NFS) et l'authentification.

### Partage de fichiers et authentification

| Commande    | Rôle                                                                                                                        |
| ----------- | --------------------------------------------------------------------------------------------------------------------------- |
| **Samba**   | État du service SMB/CIFS — connexions actives et fichiers verrouillés, validation de la configuration et liste des partages |
| **NFS**     | État du service NFS — exports actuels, enregistrement RPC et visibilité des montages clients                                |
| **Winbind** | Vérifications Active Directory — relation de confiance du domaine, utilisateurs du domaine et groupes du domaine            |

### Outils réseau standards

Les diagnostics NAS incluent également les outils de connectivité standard : **Ping**, **Trace de route**, **Scan/Table ARP**, **TCP Dump**, **Test de connexion TCP**, **Recherche DNS**, **Requête NTP**, **Utilisation CPU la plus élevée**, **Utilisation réseau maximale**, et **Journaux**.

### Diagnostics utilisateurs et groupes

| Commande         | Rôle                                                   |
| ---------------- | ------------------------------------------------------ |
| **Utilisateurs** | Comptes utilisateurs système                           |
| **Groupes**      | Groupes système et appartenance                        |
| **Date/Heure**   | Synchronisation de l'heure (critique pour Kerberos/AD) |
| **Services**     | Tous les services en cours d'exécution                 |

***

## Flux de résolution des problèmes - meilleures pratiques

Lors de l'enquête sur un problème, suivez un chemin d'escalade structuré, des diagnostics spécifiques au composant à l'analyse à l'échelle du système :

```mermaid
flowchart TD
    A["1. Définir le périmètre"] --> B["Quel composant est affecté ?<br/>Réseau ? Stockage ? Matériel ? NAS ?"]
    B --> C["2. Diagnostics du composant"]
    C --> D["Utiliser la boîte à outils correspondante :<br/>Réseau → Diagnostics réseau<br/>Stockage → Diagnostics vSAN<br/>Matériel → Diagnostics du nœud<br/>Partages de fichiers → Diagnostics NAS"]
    D --> E{"Problème<br/>résolu ?"}
    E -->|Oui| F["Documenter les constatations"]
    E -->|Non| G["3. Diagnostics système"]
    G --> H["Système → Diagnostics système<br/>Génère un bundle de diagnostic complet"]
    H --> I{"Problème<br/>résolu ?"}
    I -->|Oui| F
    I -->|Non| J["4. Escalader vers le support"]
    J --> K["Joindre le bundle de diagnostic<br/>Inclure la chronologie et les symptômes"]

    style A fill:#3498db,color:#fff
    style C fill:#2ecc71,color:#fff
    style G fill:#f39c12,color:#fff
    style J fill:#e74c3c,color:#fff
```

### Consignes de flux de travail

1. **Commencez simplement** — Ping avant la capture de paquets. Vérifiez l'état des niveaux avant les vérifications d'intégrité.
2. **Définir correctement le périmètre** — Sélectionnez le bon réseau, nœud ou service NAS avant d'exécuter les diagnostics. Exécuter des commandes dans le mauvais contexte produit des résultats trompeurs.
3. **Documentez au fur et à mesure** — Utilisez « Afficher la commande » pour capturer les commandes exactes. Copiez la sortie avant de passer au test suivant.
4. **Tenir compte de l'impact sur les performances** — TCP Dump, les scans NMAP et les vérifications d'intégrité peuvent affecter les performances de production. Planifiez les diagnostics intensifs pendant les fenêtres de maintenance.
5. **Vérifier les journaux en dernier** — Les journaux fournissent du contexte mais peuvent être écrasants. Utilisez d'abord des diagnostics ciblés, puis recoupez avec les entrées de journal.

### Paquet de diagnostics système

Pour les problèmes qui concernent plusieurs composants ou nécessitent une escalade au support, VergeOS peut générer un **bundle de diagnostic complet**:

* **Accès :** Système → Diagnostics système
* **Sortie :** `[SYSTEMNAME]_diags_[YYYYMMDD]_[HHMMSS].tar.gz`
* **Contenu :** fichiers d'état vSAN, rapports SMART, configuration réseau, données IPMI, journaux système et journaux du noyau — organisés par nœud
* **Stockage du bundle :** Enregistré comme un `fichier` enregistrement dans vSAN ; le bundle persiste jusqu'à ce que vous le supprimiez

{% hint style="info" %}
**Rétention des journaux de l'interface utilisateur vs. rétention du bundle**

Le bundle de diagnostic lui-même n'a pas d'expiration automatique. Par ailleurs, VergeOS conserve les journaux système en direct de l'interface utilisateur **pendant 45 jours** avant suppression automatique — configurez la redirection vers un syslog distant si vous avez besoin d'un historique de journaux plus long.
{% endhint %}

{% hint style="success" %}
**Avant l'escalade**

Générez toujours un nouveau bundle Diagnostics système avant de contacter le support. Cela fournit un instantané complet à un moment donné que les ingénieurs du support peuvent analyser sans avoir besoin d'un accès système en direct.
{% endhint %}

***

## Référence rapide : quel outil utiliser

### Diagnostics réseau

**À utiliser lorsque :** La VM ne peut pas atteindre Internet, le DNS ne résout pas, le pare-feu bloque le trafic, le DHCP n'attribue pas d'IP, tunnel VPN hors ligne

**Accès :** Réseaux → \[Réseau] → Diagnostics

### Diagnostics du nœud

**À utiliser lorsque :** Alertes matérielles, pannes de disque, avertissements de température, problèmes de lien NIC, IPMI non réactif, problèmes de connectivité fabric

**Accès :** Infrastructure → Nœuds → \[Nœud] → Diagnostics

### Diagnostics vSAN

**À utiliser lorsque :** Performances de stockage dégradées, niveau en mauvais état, avertissements de capacité, réparation bloquée, problèmes d'intégrité des données

**Accès :** Système → Diagnostics vSAN

### Diagnostics NAS

**À utiliser lorsque :** Partages SMB inaccessibles, échecs de montage NFS, authentification AD défaillante, refus d'autorisation de fichier, performances CIFS lentes

**Accès :** NAS → \[Service NAS] → Diagnostics


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/learn-the-platform/fr/module-9-supervision-et-depannage/05-diagnostics-toolkit.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
