> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/learn-the-platform/es/modulo-9-supervision-y-resolucion-de-problemas/05-diagnostics-toolkit.md).

# Kit de herramientas de diagnóstico

## Cuatro kits de herramientas de diagnóstico en una sola plataforma

VergeOS integra herramientas de diagnóstico directamente en cada subsistema principal. En lugar de usar SSH en nodos individuales o instalar utilidades de terceros, los administradores ejecutan diagnósticos desde la **interfaz de usuario de VergeOS** — cada una limitada al componente que se investiga.

```mermaid
graph LR
    subgraph "Diagnósticos de VergeOS"
        A["Diagnósticos<br/>de red"] --> E["Interfaz unificada"]
        B["Diagnósticos<br/>del nodo"] --> E
        C["Diagnósticos<br/>de vSAN"] --> E
        D["Diagnósticos<br/>de NAS"] --> E
    end
    E --> F["Resultados y<br/>exportación CLI"]

    style A fill:#4a90d9,color:#fff
    style B fill:#e67e22,color:#fff
    style C fill:#27ae60,color:#fff
    style D fill:#8e44ad,color:#fff
    style E fill:#2c3e50,color:#fff
    style F fill:#34495e,color:#fff
```

Cada interfaz de diagnóstico sigue el mismo patrón:

1. Vaya al componente (red, nodo, NAS o vSAN)
2. Haga clic en **Diagnósticos** en el menú izquierdo
3. Selecciona un comando del **Consulta** desplegable
4. Configure los parámetros a la derecha
5. Haga clic en **Enviar →** para ejecutar

{% hint style="success" %}
**Alternar mostrar comando**

Activar **"Mostrar comando"** en cualquier diagnóstico para ver el comando exacto que se está ejecutando. Esta es la forma autoritativa de ver la sintaxis subyacente para scripts, automatización o reproducir un comando por SSH.
{% endhint %}

***

## Diagnósticos de red

**Acceso:** Redes → \[Seleccionar red] → Diagnósticos

Los diagnósticos de red se ejecutan **por red** — usted selecciona la red específica que desea solucionar, y todos los comandos se ejecutan dentro del contexto de esa red. Esto es fundamental porque las redes de VergeOS están aisladas por diseño.

### Conectividad y descubrimiento

| Comando                    | Propósito                                               |
| -------------------------- | ------------------------------------------------------- |
| **Ping**                   | Prueba básica de conectividad ICMP                      |
| **Traceroute**             | Mapear la ruta de red a un destino                      |
| **Escaneo ARP**            | Descubrir dispositivos activos en la red                |
| **Tabla ARP**              | Ver las asignaciones actuales de IP a MAC               |
| **Prueba de conexión TCP** | Verificar que un puerto TCP específico sea accesible    |
| **¿Cuál es mi IP?**        | Comprobar la IP externa de la red (verificación de NAT) |

### DNS y resolución de nombres

| Comando          | Propósito                                |
| ---------------- | ---------------------------------------- |
| **Búsqueda DNS** | Consultar registros A, AAAA, MX, NS, PTR |

### Firewall y seguridad

| Comando                                  | Propósito                                           |
| ---------------------------------------- | --------------------------------------------------- |
| **Mostrar reglas del firewall**          | Mostrar el conjunto completo de reglas del firewall |
| **Rastrear/depurar reglas del firewall** | Habilitar el registro por regla para depuración     |
| **NMAP**                                 | Escaneo de puertos y descubrimiento de servicios    |

### Análisis de tráfico

| Comando               | Propósito                                     |
| --------------------- | --------------------------------------------- |
| **TCP Dump**          | Captura de paquetes con filtrado BPF          |
| **Mayor uso de red**  | Consumidores de ancho de banda en tiempo real |
| **Uso máximo de CPU** | Procesos que consumen más CPU                 |

### Específico del servicio

| Comando                        | Propósito                                                        |
| ------------------------------ | ---------------------------------------------------------------- |
| **Liberación/Renovación DHCP** | Forzar la renovación del arrendamiento DHCP (redes cliente DHCP) |
| **IPsec**                      | Supervisar y controlar túneles VPN IPsec                         |
| **FRRouting BGP/OSPF**         | Estado del protocolo de enrutamiento dinámico                    |
| **Registros**                  | Registros del sistema del contenedor de red                      |

{% hint style="info" %}
**Acceso de inquilinos**

Los inquilinos tienen acceso a sus propios diagnósticos de red para redes específicas del inquilino. Estas herramientas operan dentro del alcance de la red del inquilino — no pueden ver las redes de nivel superior.
{% endhint %}

***

## Diagnósticos del nodo

**Acceso:** Infraestructura → Nodos → \[Seleccionar nodo] → Diagnósticos

Los diagnósticos del nodo proporcionan **a nivel de hardware** visibilidad en servidores físicos individuales. Estas herramientas interactúan directamente con el BMC del servidor, las unidades y las interfaces físicas de red.

### Herramientas IPMI / BMC

Estos comandos se comunican con el Baseboard Management Controller del servidor — la interfaz de gestión fuera de banda (iDRAC en Dell, iLO en HPE, etc.).

| Comando                                   | Propósito                                       |
| ----------------------------------------- | ----------------------------------------------- |
| **Información de IPMI BMC**               | Firmware y configuración del BMC                |
| **Estado del chasis IPMI**                | Estado de energía, detección de intrusión       |
| **Información IPMI FRU**                  | Identificación de unidad reemplazable en campo  |
| **Información LAN de IPMI**               | Configuración de red del BMC                    |
| **Reiniciar MC de IPMI**                  | Reiniciar un BMC que no responde                |
| **Sensores IPMI**                         | Lecturas de temperatura, voltaje y ventiladores |
| **Repositorio de datos de sensores IPMI** | Repositorio completo de datos de sensores       |
| **Registros de eventos del sistema IPMI** | Historial de eventos de hardware (SEL)          |

{% hint style="warning" %}
**Reiniciar MC de IPMI**

Reiniciar el BMC interrumpe temporalmente la gestión fuera de banda. El sistema operativo del host sigue ejecutándose — esto solo afecta al controlador de gestión.
{% endhint %}

### Estado de las unidades y del almacenamiento

| Comando                              | Propósito                                                                         |
| ------------------------------------ | --------------------------------------------------------------------------------- |
| **Información S.M.A.R.T.**           | Atributos de salud de la unidad, desgaste, temperatura                            |
| **Prueba de diagnóstico S.M.A.R.T.** | Ejecutar pruebas cortas, largas o de transporte                                   |
| **Mostrar dispositivos de bloques**  | Listar todos los dispositivos de bloques en el nodo                               |
| **Control de LED (unidad)**          | Activar/desactivar el LED de localización de la unidad para identificación física |
| **Consulta RAS**                     | Informe de errores ECC de memoria                                                 |

### Red y fabric

| Comando                     | Propósito                                                 |
| --------------------------- | --------------------------------------------------------- |
| **Herramienta Ethernet**    | Velocidad del enlace, dúplex, información del controlador |
| **Configuración de fabric** | Estado del fabric principal de este nodo                  |
| **Bonding de red**          | Estado de salud de la interfaz bond y esclavo activo      |
| **Direcciones del puente**  | Tabla de direcciones MAC del switch virtual               |
| **Escaneo ARP / Tabla ARP** | Descubrimiento de red a nivel de nodo                     |
| **Ping / traceroute**       | Conectividad básica desde el contexto del nodo            |

### Sistema

| Comando                               | Propósito                                                        |
| ------------------------------------- | ---------------------------------------------------------------- |
| **Tabla DMI**                         | Inventario completo de hardware (CPU, RAM, números de serie)     |
| **Registros**                         | Registros del sistema y del kernel                               |
| **Velocidad de OpenSSL**              | Benchmark de rendimiento criptográfico de la CPU                 |
| **Borrar almacenamiento persistente** | Borrar cachés del sistema de archivos (solo para uso de soporte) |

{% hint style="info" %}
**¿Vienes de VMware o Nutanix?**
{% endhint %}

| Plataforma | Donde ocurre la inspección profunda de hardware                                                                                                                                             |
| ---------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| VMware     | SSH/DCUI al host ESXi para `esxcli`/`vsish`; vCenter expone algunos datos SMART/sensores, pero el trabajo profundo sale de la interfaz de vSphere                                           |
| Nutanix    | Página de hardware de Prism Element + `ncli` desde la CVM; IPMI/BMC se accede por separado para el LED de la unidad y los sensores detallados                                               |
| VergeOS    | Panel de diagnósticos de un solo nodo: IPMI, SMART, control del LED de la unidad, estado de fabric, sin SSH ni credenciales BMC separadas. "Mostrar comando" revela la sintaxis subyacente. |

***

## Diagnósticos de vSAN

**Acceso:** Sistema → Diagnósticos vSAN

Los diagnósticos de vSAN operan a nivel de **del sistema** , proporcionando una visibilidad profunda del motor de almacenamiento distribuido.

{% hint style="warning" %}
**Solo a nivel raíz/padre**

Los diagnósticos de vSAN solo están disponibles a nivel raíz/padre. **Los inquilinos no tienen acceso** a las herramientas de diagnóstico de vSAN — interactúan con el almacenamiento a través de sus discos virtuales asignados.
{% endhint %}

### Comandos clave de diagnóstico de vSAN

| Comando                                             | Propósito                                                   |
| --------------------------------------------------- | ----------------------------------------------------------- |
| **Obtener estado del nivel**                        | Salud, redundancia y capacidad por nivel                    |
| **Obtener tasas del clúster**                       | Rendimiento de lectura/escritura en todo el clúster         |
| **Obtener uso del clúster**                         | Estadísticas generales de utilización del almacenamiento    |
| **Obtener lista de dispositivos**                   | Todos los dispositivos de almacenamiento en el pool de vSAN |
| **Obtener estado del dispositivo**                  | Estado de salud y conteos de errores de cada dispositivo    |
| **Obtener uso del dispositivo**                     | Capacidad por dispositivo y métricas de E/S                 |
| **Obtener estado de reparación**                    | Progreso activo de reconstrucción/reparación                |
| **Obtener estado del registro**                     | Estado de salud del diario de escritura anticipada          |
| **Obtener estado de la comprobación de integridad** | Progreso de verificación de integridad de datos             |
| **Obtener información de caché**                    | Ratios de aciertos/fallos de caché y uso de memoria         |
| **Obtener estado del archivo**                      | Replicación e integridad para un archivo específico         |
| **Obtener tasas de uso máximas**                    | Identificar los principales consumidores de almacenamiento  |
| **Obtener configuración en ejecución**              | Parámetros actuales de configuración de vSAN                |
| **Obtener lista de sincronización**                 | Operaciones de sincronización activas                       |
| **Obtener lista de nodos**                          | Todos los nodos que participan en vSAN                      |
| **Comprobar integridad**                            | Iniciar una comprobación de integridad completa             |
| **Resumir uso de disco**                            | Resumen del uso de disco en todo el clúster                 |

### Flujo de trabajo de comprobación de salud de vSAN

Un enfoque estructurado para investigar problemas de almacenamiento:

```mermaid
flowchart TD
    A["Comprobar estado del nivel"] --> B{"Todos los niveles<br/>working = true?"}
    B -->|Sí| C["Comprobar tasas del clúster"]
    B -->|No| D["Comprobar estado de reparación"]
    D --> E["Comprobar el estado de los dispositivos<br/>en busca de unidades fallidas"]
    C --> F{"¿El rendimiento<br/>es aceptable?"}
    F -->|Sí| G["Sistema saludable"]
    F -->|No| H["Comprobar información de la caché"]
    H --> I["Comprobar las tasas de uso más altas"]
    I --> J["Identificar el cuello de botella"]
    E --> K["Comprobar datos SMART<br/>mediante Diagnósticos del nodo"]

    style A fill:#27ae60,color:#fff
    style G fill:#27ae60,color:#fff
    style D fill:#e74c3c,color:#fff
    style E fill:#e74c3c,color:#fff
```

### Indicadores clave que supervisar

* **`working = false`** en cualquier nivel → Crítico — el nivel no está operativo
* **`redundant = false`** → Estado degradado, sin tolerancia a fallos
* **`bad_drives > 0`** → Se detectó una falla de unidad, reparación automática en curso
* **Estado de reparación todo ceros** → Sin reparaciones activas (estado saludable)
* **Limitación de escritura activa** → La capacidad de almacenamiento se acerca al límite (>91% activa la limitación)

### Umbrales de limitación del espacio de almacenamiento

| Utilización | Comportamiento                                                        |
| ----------- | --------------------------------------------------------------------- |
| **< 91%**   | Funcionamiento normal, sin limitación                                 |
| **91–95%**  | Comienza la limitación por poco espacio (se añaden 10 ms de latencia) |
| **96%+**    | Limitación crítica (se añaden 50 ms de latencia)                      |
| **> 96%**   | Degradación severa del rendimiento                                    |

***

## Diagnósticos NAS

**Acceso:** NAS → \[Seleccionar servicio NAS] → Diagnósticos

Los diagnósticos de NAS son **por servicio NAS** — cada instancia de NAS tiene su propia interfaz de diagnóstico. Estas herramientas se centran en los protocolos de compartición de archivos (SMB/CIFS, NFS) y la autenticación.

### Compartición de archivos y autenticación

| Comando     | Propósito                                                                                                                              |
| ----------- | -------------------------------------------------------------------------------------------------------------------------------------- |
| **Samba**   | Estado del servicio SMB/CIFS — conexiones activas y archivos bloqueados, validación de configuración y listado de recursos compartidos |
| **NFS**     | Estado del servicio NFS — exportaciones actuales, registro RPC y visibilidad de montajes de clientes                                   |
| **Winbind** | Comprobaciones de Active Directory — relación de confianza con el dominio, usuarios del dominio y grupos del dominio                   |

### Herramientas de red estándar

Los diagnósticos de NAS también incluyen las herramientas de conectividad estándar: **Ping**, **Traceroute**, **Escaneo/tabla ARP**, **TCP Dump**, **Prueba de conexión TCP**, **Búsqueda DNS**, **Consulta NTP**, **Uso máximo de CPU**, **Mayor uso de red**, y **Registros**.

### Diagnósticos de usuarios y grupos

| Comando        | Propósito                                         |
| -------------- | ------------------------------------------------- |
| **Usuarios**   | Cuentas de usuario del sistema                    |
| **Grupos**     | Grupos del sistema y membresía                    |
| **Fecha/Hora** | Sincronización horaria (crítica para Kerberos/AD) |
| **Servicios**  | Todos los servicios en ejecución                  |

***

## Flujo de trabajo de resolución de problemas recomendado

Al investigar un problema, siga una ruta de escalado estructurada desde diagnósticos específicos del componente hasta un análisis de todo el sistema:

```mermaid
flowchart TD
    A["1. Definir alcance"] --> B["¿Qué componente está afectado?<br/>¿Red? ¿Almacenamiento? ¿Hardware? ¿NAS?"]
    B --> C["2. Diagnósticos del componente"]
    C --> D["Use el kit de herramientas correspondiente:<br/>Red → Diagnósticos de red<br/>Almacenamiento → Diagnósticos de vSAN<br/>Hardware → Diagnósticos del nodo<br/>Comparticiones de archivos → Diagnósticos de NAS"]
    D --> E{"¿El problema<br/>se resolvió?"}
    E -->|Sí| F["Documentar hallazgos"]
    E -->|No| G["3. Diagnósticos del sistema"]
    G --> H["Sistema → Diagnósticos del sistema<br/>Genera un paquete de diagnóstico completo"]
    H --> I{"¿El problema<br/>se resolvió?"}
    I -->|Sí| F
    I -->|No| J["4. Escalar a soporte"]
    J --> K["Adjuntar paquete de diagnóstico<br/>Incluir cronología y síntomas"]

    style A fill:#3498db,color:#fff
    style C fill:#2ecc71,color:#fff
    style G fill:#f39c12,color:#fff
    style J fill:#e74c3c,color:#fff
```

### Directrices del flujo de trabajo

1. **Empiece simple** — Haga ping antes de capturar paquetes. Verifique el estado del nivel antes de las comprobaciones de integridad.
2. **Delimite correctamente el alcance** — Seleccione la red, el nodo o el servicio NAS correctos antes de ejecutar diagnósticos. Ejecutar comandos en el contexto incorrecto produce resultados engañosos.
3. **Documente mientras avanza** — Use "Mostrar comando" para capturar los comandos exactos. Copie la salida antes de pasar a la siguiente prueba.
4. **Considere el impacto en el rendimiento** — TCP Dump, los escaneos NMAP y las comprobaciones de integridad pueden afectar al rendimiento de producción. Programe los diagnósticos intensivos durante ventanas de mantenimiento.
5. **Revise los registros al final** — Los registros proporcionan contexto, pero pueden resultar abrumadores. Primero use diagnósticos específicos y luego correlaciónelos con las entradas del registro.

### Paquete de diagnósticos del sistema

Para problemas que abarcan varios componentes o requieren escalado al soporte, VergeOS puede generar un **paquete completo de diagnóstico**:

* **Acceso:** Sistema → Diagnósticos del sistema
* **Salida:** `[SYSTEMNAME]_diags_[YYYYMMDD]_[HHMMSS].tar.gz`
* **Contenido:** archivos de estado de vSAN, informes SMART, configuración de red, datos IPMI, registros del sistema y registros del kernel — organizados por nodo
* **Almacenamiento del paquete:** Guardado como un `registros de archivos` en vSAN; el paquete persiste hasta que lo elimine

{% hint style="info" %}
**Retención de registros de la UI frente a retención del paquete**

El paquete de diagnóstico en sí no tiene caducidad automática. Por separado, VergeOS conserva los **registros del sistema de la UI en vivo durante 45 días** antes de eliminarlos automáticamente — configure el reenvío remoto de syslog si necesita un historial de registros más largo.
{% endhint %}

{% hint style="success" %}
**Antes de escalar**

Genere siempre un paquete nuevo de Diagnósticos del sistema antes de contactar con soporte. Esto proporciona una instantánea completa del momento que los ingenieros de soporte pueden analizar sin necesitar acceso en vivo al sistema.
{% endhint %}

***

## Referencia rápida: qué kit de herramientas usar

### Diagnósticos de red

**Úselo cuando:** la VM no puede الوصول a internet, DNS no resuelve, el firewall bloquea el tráfico, DHCP no asigna IP, el túnel VPN está caído

**Acceso:** Redes → \[Red] → Diagnósticos

### Diagnósticos del nodo

**Úselo cuando:** Alertas de hardware, fallos de unidades, advertencias de temperatura, problemas de enlace NIC, IPMI no responde, problemas de conectividad de fabric

**Acceso:** Infraestructura → Nodos → \[Nodo] → Diagnósticos

### Diagnósticos de vSAN

**Úselo cuando:** Rendimiento de almacenamiento degradado, nivel en mal estado, advertencias de capacidad, reparación atascada, problemas de integridad de datos

**Acceso:** Sistema → Diagnósticos vSAN

### Diagnósticos NAS

**Úselo cuando:** Comparticiones SMB inaccesibles, fallos de montaje NFS, autenticación AD rota, permiso de archivo denegado, rendimiento CIFS lento

**Acceso:** NAS → \[Servicio NAS] → Diagnósticos


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/learn-the-platform/es/modulo-9-supervision-y-resolucion-de-problemas/05-diagnostics-toolkit.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
