> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/learn-the-platform/es/modulo-5-almacenamiento/05-storage-monitoring.md).

# Supervisión y solución de problemas del almacenamiento

## Por qué importa la supervisión del almacenamiento

El almacenamiento es la base de todas las cargas de trabajo en VergeOS. Una unidad degradada, un nivel lleno o un error de integridad desapercibido pueden desencadenar problemas de rendimiento de las VM, instantáneas fallidas y quejas de los inquilinos. VergeOS proporciona **herramientas de diagnóstico integradas en dos niveles** -- diagnósticos vSAN para el motor de almacenamiento distribuido a nivel de bloque, y diagnósticos NAS para cada instancia del servicio de compartición de archivos -- para que puedas detectar, diagnosticar y resolver problemas antes de que afecten a producción.

```mermaid
graph LR
    subgraph diagnostics["Diagnósticos de almacenamiento de VergeOS"]
        direction TB
        VSAN["Diagnósticos vSAN<br/>Sistema → Diagnósticos vSAN<br/>(solo nivel raíz)"]
        NAS["Diagnósticos NAS<br/>NAS → Servicio → Diagnósticos<br/>(por instancia NAS)"]
        SYSDIAG["Diagnósticos del sistema<br/>Exportaciones de diagnóstico incluidas<br/>para escalado a soporte"]
    end

    subgraph areas["Áreas de enfoque del diagnóstico"]
        PERF["Rendimiento<br/>Tasas del clúster, caché, IOPS"]
        CAP["Capacidad<br/>Uso del nivel, crecimiento del volumen"]
        HEALTH["Salud<br/>Estado del dispositivo, reparaciones"]
        SHARES["Compartición de archivos<br/>SMB/CIFS, NFS, AD"]
    end

    VSAN --> PERF
    VSAN --> CAP
    VSAN --> HEALTH
    NAS --> SHARES

    style diagnostics fill:#e8edf4,stroke:#2d4a7a
    style areas fill:#e8f4e8,stroke:#2d7a2d
```

## Diagnósticos de vSAN

La interfaz de Diagnósticos vSAN proporciona acceso en tiempo real al estado interno del motor de almacenamiento VergeFS. Cada diagnóstico se ejecuta desde el **Consulta** desplegable en la interfaz de usuario de Diagnósticos vSAN.

### Acceso a Diagnósticos vSAN

1. Vaya a **Sistema → Diagnósticos vSAN** desde el menú superior
2. Alternativamente: desde el Panel principal, haz clic en el **cuadro de conteo de niveles vSAN** → **Diagnósticos de vSAN** en el menú izquierdo
3. Selecciona un comando del **Consulta** desplegable, configura los parámetros a la derecha y haz clic en **Enviar →**

{% hint style="warning" %}
**Solo a nivel raíz**

Los Diagnósticos vSAN solo están disponibles en el nivel raíz/principal. Los inquilinos no tienen acceso a las herramientas de diagnóstico vSAN; deben solicitar diagnósticos a través del proveedor.
{% endhint %}

### Referencia de comandos de diagnóstico

Los siguientes diagnósticos están disponibles en el **Consulta** desplegable de la interfaz de usuario de Diagnósticos vSAN, agrupados por área de enfoque.

#### Clúster y rendimiento

| Comando                          | Propósito                                                         |
| -------------------------------- | ----------------------------------------------------------------- |
| **Obtener tasas del clúster**    | Métricas de rendimiento y IOPS de todo el clúster                 |
| **Obtener uso del clúster**      | Utilización y capacidad de almacenamiento general                 |
| **Obtener tasas de uso máximas** | Identificar los principales consumidores de E/S de almacenamiento |
| **Obtener uso**                  | Estadísticas completas de uso de vSAN                             |
| **Obtener información de caché** | Ratios de aciertos/fallos de caché y uso de memoria               |
| **Obtener lectura anticipada**   | Configuración y estadísticas de caché de lectura anticipada       |
| **Obtener maestro actual**       | Identificar el nodo maestro actual de vSAN                        |

#### Dispositivo y nodo

| Comando                                    | Propósito                                        |
| ------------------------------------------ | ------------------------------------------------ |
| **Obtener lista de dispositivos**          | Todos los dispositivos de almacenamiento en vSAN |
| **Obtener estado del dispositivo**         | Salud y estado de un dispositivo específico      |
| **Obtener uso del dispositivo**            | Datos de utilización y desgaste por dispositivo  |
| **Obtener lista de nodos**                 | Todos los nodos que participan en vSAN           |
| **Obtener información del nodo**           | Información detallada de un nodo específico      |
| **Obtener lista de dispositivos del nodo** | Dispositivos conectados a un nodo específico     |

#### Nivel y volumen

| Comando                                     | Propósito                                      |
| ------------------------------------------- | ---------------------------------------------- |
| **Obtener estado del nivel**                | Salud y capacidad por nivel de almacenamiento  |
| **Obtener mapas de dispositivos del nivel** | Cómo se asignan los dispositivos entre niveles |
| **Obtener mapas de nodos del nivel**        | Cómo se distribuyen los niveles entre nodos    |
| **Obtener uso del volumen**                 | Consumo de almacenamiento por volumen          |
| **Resumir uso de disco**                    | Resumen del uso de disco en todo el clúster    |

#### Integridad y reparación

| Comando                                             | Propósito                                                       |
| --------------------------------------------------- | --------------------------------------------------------------- |
| **Comprobar integridad**                            | Iniciar una comprobación completa de integridad                 |
| **Comprobar integridad del dispositivo**            | Comprobación de integridad en un dispositivo específico         |
| **Obtener estado de la comprobación de integridad** | Progreso/resultados de las comprobaciones de integridad         |
| **Obtener estado de reparación**                    | Operaciones activas de reparación y reconstrucción              |
| **Obtener lista de sincronización**                 | Conexiones activas de sincronización entre sitios (replicación) |

#### Sistema de archivos y configuración

| Comando                                | Propósito                                      |
| -------------------------------------- | ---------------------------------------------- |
| **Buscar inode**                       | Localizar un inode específico para su análisis |
| **Obtener ruta desde inode**           | Resolver un número de inode a una ruta         |
| **Obtener estado del archivo**         | Replicación e integridad de un archivo         |
| **Obtener información de FUSE**        | Detalles del montaje y funcionamiento de FUSE  |
| **Obtener estado del registro**        | Estado del registro de escritura anticipada    |
| **Obtener configuración en ejecución** | Configuración actual en ejecución de vSAN      |
| **Obtener clientes**                   | Conexiones activas de clientes vSAN            |

## Flujo de trabajo de supervisión de salud

Sigue este enfoque sistemático al investigar la salud del almacenamiento: empieza de forma amplia y profundiza en componentes específicos.

```mermaid
graph TD
    A["1. Visión general del sistema<br/>Uso del clúster + Tasas del clúster"] --> B["2. Análisis de rendimiento<br/>Tasas de uso máximas + Información de caché"]
    B --> C["3. Evaluación de salud<br/>Estado de reparación + Estado de comprobación de integridad"]
    C --> D["4. Planificación de capacidad<br/>Resumir uso de disco + Estado del nivel"]
    D --> E["5. Solución de problemas dirigida<br/>Comandos específicos por dispositivo + por nodo"]

    style A fill:#e8f4e8,stroke:#2d7a2d
    style B fill:#e8edf4,stroke:#2d4a7a
    style C fill:#fce8e8,stroke:#7a2d2d
    style D fill:#f4f0e8,stroke:#7a6a2d
    style E fill:#e8e8f4,stroke:#4a2d7a
```

### Flujo de trabajo paso a paso

1. **Visión general del sistema** -- Ejecuta `Obtener uso del clúster` y `Obtener tasas del clúster` para entender la salud general, la capacidad y el rendimiento
2. **Análisis de rendimiento** -- Comprueba `Obtener tasas de uso máximas` para encontrar volúmenes intensivos, luego `Obtener información de caché` para ratios de aciertos de caché
3. **Evaluación de salud** -- Verifica `Obtener estado de reparación` muestra todo en cero (sin reparaciones activas) y `Obtener estado de la comprobación de integridad` para resultados recientes
4. **Planificación de capacidad** -- Usa `Resumir uso de disco` para una vista de todo el clúster y `Obtener estado del nivel` para capacidad por nivel
5. **Solución de problemas dirigida** -- Profundiza en dispositivos específicos (`Obtener estado del dispositivo`) o nodos (`Obtener información del nodo`) según los hallazgos

## Patrones de solución de problemas

### Problemas de rendimiento

**Síntomas:** Alta latencia de VM, operaciones de instantáneas lentas, quejas de los inquilinos sobre la velocidad del disco.

1. Compruebe **Obtener tasas del clúster** para el rendimiento agregado; ¿las tasas están por debajo de la referencia?
2. Revisa **Obtener información de caché** -- ratios de aciertos bajos indican que el conjunto de trabajo supera la caché disponible
3. Examina **Obtener tasas de uso máximas** para identificar qué volúmenes están consumiendo más E/S
4. Compruebe **Obtener uso del dispositivo** en unidades individuales para detectar una distribución desigual de la carga
5. Verifica **Obtener estado del registro** -- un registro respaldado indica una presión de escritura sostenida

{% hint style="info" %}
**Limitación del almacenamiento**

VergeOS aplica una limitación gradual de E/S según el uso de capacidad: funcionamiento normal por debajo del 91 %, limitación leve (10 ms añadidos) entre 91 y 95 %, y limitación crítica (50 ms añadidos) por encima del 96 %. Comprueba el uso del nivel si el rendimiento se degrada de repente.
{% endhint %}

### Problemas de capacidad

**Síntomas:** Alertas de "poco espacio", imposibilidad de crear instantáneas, escrituras lentas debido a la limitación.

1. Ejecuta **Obtener uso del clúster** y **Resumir uso de disco** para el análisis general del espacio
2. Compruebe **Obtener estado del nivel** para capacidad por nivel; un solo nivel lleno puede causar problemas aunque otros tengan espacio
3. Usa **Obtener uso del volumen** en los volúmenes más grandes para identificar candidatos de crecimiento
4. Revisa las políticas de retención de instantáneas: las instantáneas antiguas que hacen referencia a bloques modificados consumen mucho espacio

### Problemas de integridad de datos

**Síntomas:** Advertencias de checksum en los registros, posible corrupción después de eventos de hardware.

1. Compruebe **Obtener estado de la comprobación de integridad** para resultados recientes de comprobación de integridad
2. Revisa **Obtener estado de reparación** para cualquier reconstrucción de datos activa
3. Usa **Obtener estado del archivo** en archivos específicos para verificar su estado de replicación
4. Si es necesario, ejecuta **Comprobar integridad** para iniciar un análisis completo (programa durante ventanas de mantenimiento)

{% hint style="warning" %}
**Impacto de la comprobación de integridad**

Las comprobaciones completas de integridad pueden afectar significativamente al rendimiento del sistema. Programa siempre estas tareas durante ventanas de mantenimiento y supervisa la carga del sistema durante su ejecución.
{% endhint %}

### Problemas de salud del clúster

**Síntomas:** Alertas de nodo fuera de línea, conmutación por error inesperada del maestro, preocupaciones de split-brain.

1. Verifica **Obtener maestro actual** para confirmar qué nodo lidera vSAN
2. Compruebe **Obtener lista de nodos** y **Obtener información del nodo** para el estado de cada nodo
3. Revisa **Obtener estado de reparación** para la re-replicación activa de bloques que indica que un nodo se desconectó temporalmente
4. Examina **Obtener clientes** para patrones de conexión inesperados

{% hint style="info" %}
**Obtener lista de sincronización vs. Obtener estado de reparación**

**Obtener lista de sincronización** informa de **sincronización entre sitios** (replicación) con sitios remotos -- no de resincronización dentro del clúster tras la desconexión de un nodo. Usa **Obtener estado de reparación** para el progreso de reconstrucción y re-replicación dentro del clúster.
{% endhint %}

### Problemas con dispositivos

**Síntomas:** Advertencias SMART, errores en unidades individuales, rendimiento desigual entre nodos.

1. Ejecuta **Obtener lista de dispositivos** y **Obtener estado del dispositivo** para identificar dispositivos degradados o fallidos
2. Compruebe **Obtener lista de dispositivos del nodo** para el inventario completo de dispositivos del nodo afectado
3. Ejecuta **Comprobar integridad del dispositivo** en las unidades sospechosas
4. Contrasta con los datos SMART capturados en el paquete de Diagnósticos del sistema (recopilados por nodo mediante la herramienta de diagnósticos)

## Mantenimiento preventivo

La supervisión proactiva evita sorpresas. Establece una cadencia regular para estas comprobaciones:

### Diario

* Revisa el uso del clúster y la capacidad del nivel - Comprueba si hay reparaciones activas (debería ser cero en estado estable) - Verifica que no haya alertas relacionadas con el almacenamiento en el panel

### Semanal

* Ejecuta las tasas del clúster para establecer referencias de rendimiento - Revisa las tasas de uso máximas para detectar tendencias de crecimiento - Comprueba los ratios de aciertos de caché y ajústalos si es necesario

### Mensual

* Programa comprobaciones de integridad durante ventanas de mantenimiento - Revisa la salud de los dispositivos y los datos SMART - Analiza las tendencias de capacidad para la planificación de adquisiciones

## Integración de Fibre Channel

El vSAN de VergeOS admite **LUN de Fibre Channel (FC) como dispositivos de almacenamiento** dentro de su arquitectura por niveles, lo que permite la integración con la infraestructura SAN existente.

### Principios clave

* **Las LUN de FC se tratan igual que los discos físicos** -- VergeOS no hace distinción una vez que se asignan a un nivel
* **Cada nodo debe recibir sus propias LUN únicas** -- no presentes la misma LUN en varios nodos (a diferencia de la agrupación tradicional con almacenamiento compartido)
* **El nivel 0 sigue requiriendo unidades físicas NVMe/SSD** en los nodos para almacenamiento de metadatos
* **Desactiva RAID y el nivelado automático** en la SAN para las LUN usadas por VergeOS -- vSAN gestiona la redundancia de forma nativa
* **Multipath activo/pasivo** con tiempo de espera de conmutación por error de 7 segundos; VergeOS selecciona automáticamente la ruta óptima

### Cuándo usar FC frente a discos físicos

Verge recomienda **discos físicos conectados directamente a los nodos** para la mayoría de los despliegues. La integración FC es apropiada cuando ya tienes inversiones SAN existentes o requisitos de cumplimiento específicos. Los discos físicos ofrecen una configuración más sencilla, mejor rendimiento (sin sobrecarga SAN), menos puntos de fallo y menor costo.

{% hint style="info" %}
**Ancho de banda principal de red**

vSAN usa la red principal para la replicación de datos. Si tu SAN FC admite 32 Gb pero tu red principal es de 25 Gb, el rendimiento de escritura estará limitado por la red principal. Asegúrate de que el ancho de banda de la red principal iguale o supere el ancho de banda de la SAN para cargas de trabajo intensivas en escritura.
{% endhint %}

## Diagnósticos NAS

Cada instancia del servicio NAS tiene su propia interfaz de diagnóstico, separada de los diagnósticos vSAN. Los diagnósticos NAS se centran en los protocolos de compartición de archivos, la conectividad de red y la autenticación.

### Acceso a Diagnósticos NAS

1. Vaya a **NAS → Lista** desde el menú superior
2. Haz doble clic en el servicio NAS deseado
3. Haga clic en **Diagnósticos** en el menú izquierdo
4. Selecciona un comando del **Consulta de diagnóstico** desplegable y haz clic en **Enviar →**

### Comandos de diagnóstico NAS clave

| Categoría            | Comandos                                          | Propósito                                                                        |
| -------------------- | ------------------------------------------------- | -------------------------------------------------------------------------------- |
| **SMB/CIFS**         | `smbstatus`, `testparm`, `smbclient -L localhost` | Conexiones activas, validación de configuración, listado de recursos compartidos |
| **NFS**              | `exportfs -v`, `rpcinfo -p`, `showmount -e`       | Lista de exportaciones, servicios RPC, verificación de montaje                   |
| **Active Directory** | `wbinfo -t`, `wbinfo -u`, `wbinfo -g`             | Comprobación de confianza, usuarios del dominio, grupos del dominio              |
| **Red**              | Ping, Trace Route, ARP Scan, DNS Lookup           | Conectividad, enrutamiento, descubrimiento de vecinos                            |
| **Rendimiento**      | Uso máximo de CPU, uso máximo de red, TCP Dump    | Utilización de recursos y análisis de tráfico                                    |
| **Registro**         | Registros (journalctl, registros de samba)        | Análisis de errores y supervisión de eventos                                     |

### Flujo de trabajo de supervisión de salud de NAS

1. **Estado del servicio** -- Comprueba los servicios y el estado específico del protocolo (Samba/NFS)
2. **Conectividad de red** -- Verifica con Ping y la configuración de la interfaz
3. **Autenticación** -- Prueba Usuarios, Grupos y Winbind (para entornos AD)
4. **Rendimiento** -- Supervisa el uso máximo de CPU y el uso máximo de red
5. **Registros** -- Revisa los registros del servicio en busca de errores o advertencias

## Problemas comunes de NAS y soluciones

### Windows: no puede conectarse a recursos compartidos CIFS

**Causa:** Windows 10/11 y Server 2016+ deshabilitan de forma predeterminada los inicios de sesión como invitado inseguros, bloqueando el acceso a recursos compartidos que permiten acceso anónimo.

**Solución:** Habilita los inicios de sesión como invitado inseguros mediante la directiva de grupo:

1. Abre `gpedit.msc` → **Configuración del equipo → Plantillas administrativas → Red → Lanman Workstation**
2. Establece **Habilitar inicios de sesión como invitado inseguros** a **Habilitado**
3. Reinicia el dispositivo Windows

### macOS: fallos de conexión SMB

**Causa:** Las opciones predeterminadas de macOS pueden entrar en conflicto con la versión del protocolo SMB del servidor o carecer de extensiones específicas de Apple.

**Solución (lado del cliente):** Forzar SMB3 en `/etc/nsmb.conf`:

```ini
[default]
smb_neg=smb3_only
```

Borra la caché SMB (`sudo rm -rf /var/db/samba/* /var/db/smb/*`) y reinicia.

**Solución (lado del servidor):** Añade la configuración del módulo Apple/Samba fruit en **NAS → CIFS → Opciones de configuración avanzadas**:

```ini
ea support = yes
vfs objects = fruit streams_xattr
fruit:metadata = stream
fruit:model = MacSamba
fruit:veto_appledouble = no
fruit:nfs_aces = no
fruit:posix_rename = yes
fruit:zero_file_id = yes
fruit:wipe_intentionally_left_blank_rfork = yes
fruit:delete_empty_adfiles = yes
```

### Permiso denegado en recursos compartidos CIFS

**Causa:** Permisos de usuario/grupo incorrectos o configuración incorrecta del recurso compartido.

**Solución:**

1. Verifica que el usuario tenga acceso en la lista de usuarios del servicio NAS
2. Comprueba la configuración del recurso compartido: asegúrate de que **Explorable** esté habilitado y de que el usuario esté en la lista de **Usuarios válidos** list
3. Si usas **Usuario forzado** o **Grupo forzado** opciones, confirma que la identidad forzada tenga los permisos correctos del sistema de archivos

### Rendimiento lento de CIFS

**Causa:** Desajuste de la versión del protocolo SMB, problemas de red o configuración subóptima.

**Solución:**

1. Verifica la estabilidad de la red con los Diagnósticos de NAS **Ping** y **Traceroute** comandos
2. Comprueba la versión del protocolo SMB en **NAS → Volúmenes → Opciones de configuración avanzada** -- asegúrate de que se esté usando SMB2 o SMB3
3. Supervisa con **Mayor uso de red** en Diagnósticos de NAS para detectar saturación del ancho de banda
4. Contacta con el soporte de VergeOS para parámetros avanzados de ajuste de Samba si las optimizaciones estándar no son suficientes

{% hint style="info" %}
**Puente con VMware**

¿Vienes de VMware? VergeOS expone los mismos datos de diagnóstico a través de la **Sistema → Diagnósticos vSAN** interfaz de usuario en cualquier nodo controlador; no se requiere un dispositivo de gestión separado, un complemento ni una capa de scripting. Los diagnósticos de NAS residen dentro de la VM del servicio NAS en lugar de en una consola centralizada.
{% endhint %}

{% hint style="info" %}
**Puente con Nutanix**

¿Vienes de Nutanix? VergeOS te ofrece el mismo tipo de cobertura de diagnóstico de almacenamiento y limpieza de integridad a través de la **Diagnósticos de vSAN** interfaz de usuario en cualquier nodo controlador, con las comprobaciones de estado del servicio NAS residiendo dentro de la propia VM del servicio NAS en lugar de una consola separada de servicios de archivos.
{% endhint %}

## Primeros pasos

### Explora los diagnósticos de vSAN

Vaya a **Sistema → Diagnósticos vSAN**, ejecuta **Obtener uso del clúster** y **Obtener tasas del clúster** para establecer tu línea base.

### Comprueba la salud de NAS

Abre la página de Diagnósticos de cada servicio NAS. Ejecuta **Samba** para ver las conexiones activas y **NFS** para verificar las exportaciones. Revisa **Registros** para detectar errores recientes.

### Revisa la guía de diagnósticos

Lee la completa [Guía de diagnósticos de vSAN](https://docs.verge.io/product-guide/storage/vsan-diagnostics/) y [Guía de diagnósticos de NAS](https://docs.verge.io/product-guide/nas/nas-diagnostics/) en la documentación oficial.


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/learn-the-platform/es/modulo-5-almacenamiento/05-storage-monitoring.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
