> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/learn-the-platform/es/modulo-9-supervision-y-resolucion-de-problemas/lab.md).

# Laboratorio: Monitoreo y solución de problemas

## Objetivo

Practica la supervisión del estado de la infraestructura de VergeOS, configurando alertas, analizando registros del sistema y diagnosticando problemas comunes. Al final de este laboratorio, te sentirás cómodo navegando por las herramientas de supervisión de VergeOS y siguiendo un flujo de trabajo estructurado de resolución de problemas.

## Requisitos previos

* Módulo 1 completado: Fundamentos de la arquitectura
* Módulo 4 completado: Redes
* Módulo 5 completado: Almacenamiento
* Lectura completada del Módulo 9 (Panel, Alertas, Diagnósticos, Escalamiento)
* Un clúster de VergeOS en ejecución con acceso de administrador

## Dificultad

**Intermedio** -- Requiere familiaridad con la interfaz de VergeOS y conceptos básicos de administración de sistemas

## Tiempo estimado

**1,5 horas**

## Pasos

### Parte 1: Exploración del panel

Familiarízate con el panel de supervisión de VergeOS.

1. Inicia sesión en la interfaz de VergeOS con credenciales de administrador
2. Navega al panel principal e identifica:
   * Indicadores de estado de los nodos (en línea, sin conexión, mantenimiento)
   * Gráficas de uso de CPU, memoria y almacenamiento
   * Estado de conectividad de red
   * Alertas y notificaciones activas
3. Profundiza en la página de detalles de un nodo individual
4. Revisa la vista general del estado del clúster e identifica las métricas clave
5. Explora el estado del grupo de almacenamiento y verifica que todas las unidades estén sanas
6. Documenta la línea base actual de uso de recursos de tu clúster

### Parte 2: Configuración de alertas

Configura alertas y reglas de notificación.

1. Navega a la sección de configuración de alertas (Sistema → Suscripciones)
2. Revisa las reglas de suscripción existentes y sus criterios de alerta configurados
3. Crea una alerta de suscripción personalizada para:
   * Uso elevado de CPU (>85% sostenido)
   * Baja capacidad de almacenamiento (menos del 20% de espacio libre)
   * Pérdida de conectividad del nodo
4. Configura un canal de notificación (correo electrónico mediante SMTP, o un webhook para integraciones como Slack)
5. Prueba la notificación de alerta activando un umbral (si es posible en tu entorno de laboratorio)
6. Configura el reenvío de registros a un servidor syslog externo (o a un recopilador de registros local)

### Parte 3: Análisis de registros y diagnósticos

Practica el análisis de registros del sistema y el uso de herramientas de diagnóstico.

1. Navega a la sección de registros del sistema
2. Filtra los registros por nivel de severidad (Crítico, Error, Advertencia, Mensaje)
3. Busca eventos específicos relacionados con:
   * Operaciones de VM (iniciar, detener, migrar)
   * Eventos de almacenamiento (errores de unidad, redistribución)
   * Eventos de red (cambios en el estado del enlace)
4. Identifica patrones de error comunes y sus causas probables
5. Usa las herramientas de diagnóstico integradas para comprobar:
   * Salud del subsistema de almacenamiento
   * Conectividad de red entre nodos
   * Estado de los servicios en todo el clúster
6. Practica la generación de un paquete de diagnóstico para escalamiento al soporte

### Parte 4: Escenarios de resolución de problemas

Diagnostica problemas simulados usando las herramientas que has aprendido.

1. **Escenario A: Rendimiento lento de la VM** -- Un usuario informa que una VM se ejecuta lentamente. Usa el panel y los registros para:
   * Comprobar la asignación y el uso de recursos de la VM
   * Identificar si el nodo anfitrión está sobreasignado
   * Comprobar la latencia de E/S del almacenamiento
   * Recomendar una solución
2. **Escenario B: Problema de conectividad de red** -- Un tenant informa que no puede الوصول a redes externas. Investiga:
   * Configuración de red del tenant
   * Conectividad de la capa de red virtual
   * Estado de la red física en los nodos anfitriones
   * Identifica la causa raíz y la solución
3. **Escenario C: Alerta de almacenamiento** -- El sistema genera una advertencia de capacidad de almacenamiento. Determina:
   * Qué grupo de almacenamiento está afectado
   * Qué está consumiendo más espacio
   * Acciones recomendadas (limpieza, expansión o migración)

## Verificación

Tu laboratorio de supervisión y resolución de problemas estará completo cuando puedas responder **sí** a todo lo siguiente:

* [ ] Navegaste con éxito por el panel de VergeOS e identificaste las métricas clave de estado
* [ ] Creaste reglas de alerta personalizadas con umbrales adecuados
* [ ] Configuraste al menos un canal de notificación (correo electrónico o webhook)
* [ ] Filtraste y buscaste registros del sistema para encontrar eventos específicos
* [ ] Usaste herramientas de diagnóstico para comprobar el estado de almacenamiento, red y servicios
* [ ] Trabajaste en al menos dos escenarios de resolución de problemas e identificaste las causas raíz
* [ ] Generaste un paquete de diagnóstico adecuado para el escalamiento al soporte


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/learn-the-platform/es/modulo-9-supervision-y-resolucion-de-problemas/lab.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
