Resumen de nodos
Resumen de la administración de nodos de VergeOS, incluido el estado del nodo, la configuración de hardware, métricas de recursos, discos, NIC, estado del fabric, máquinas en ejecución y operaciones de administración.
Un nodo en VergeOS representa un servidor físico o virtual que aporta recursos de cómputo, almacenamiento y red a tu entorno. El panel de Nodos ofrece capacidades completas de supervisión y gestión para cada nodo de tu sistema.
Componentes clave
Información del estado del nodo
Estado: Muestra el estado operativo actual (En ejecución/Desconectado)
En ejecución: Indica que el nodo está operando activamente
Modo de mantenimiento: Indica si el nodo está en estado de mantenimiento
Última vez encendido: Marca de tiempo de cuándo se inició el nodo por última vez
Hora local: Hora actual en el nodo
Estado de IPMI: Muestra el estado de la Intelligent Platform Management Interface
Dirección de red IPMI: Dirección de red para acceso de gestión remota
Versión del sistema: Muestra la versión actual de VergeOS (versión del SO, versión de vSAN, versión de Appserver, versión del kernel)
Configuración de hardware
CPU: Modelo y generación del procesador
Núcleos de CPU: Número de núcleos físicos del procesador
RAM: Capacidad total de memoria física
RAM de failover: Memoria reservada para escenarios de failover
RAM sobreasignada: Memoria disponible para sobredimensionamiento
clúster: El clúster al que pertenece este nodo
Red PXE: Red utilizada para operaciones de arranque PXE
Modelo: Información de la plataforma de hardware
Serie: Designación de la serie del producto
Etiquetas de activos y características
Físico: Indica un activo de hardware físico
Capturar registros del sistema: Estado del registro del sistema
LLDP: Estado del protocolo Link Layer Discovery Protocol
Compatibilidad con iOMMU (VT-d): Compatibilidad con virtualización de hardware
Necesita reinicio: Indica si se requiere un reinicio
Necesita recargar el controlador: Indica si las actualizaciones del controlador requieren recarga
Métricas de recursos
El panel proporciona supervisión en tiempo real e histórica mediante:
Gráfico de uso de CPU: Muestra la utilización actual, promedio y máxima de la CPU con visualización de tendencias históricas
CPU total
Pico del núcleo
Uso (Usuario, Sistema, Espera de E/S, Uso de VM, IRQ)
Estadísticas del nodo
El panel proporciona métricas clave organizadas por categoría:
RAM física: Porcentaje y capacidad de uso actual de la memoria
RAM virtual: Memoria virtual asignada (normalmente 0% cuando no hay sobreasignación)
Temperatura: Temperatura actual del nodo con indicador visual (verde/amarillo/rojo según los umbrales)
Máquinas en ejecución: Cantidad de cargas de trabajo activas en el nodo
Uso de núcleos: Porcentaje de núcleos de CPU en uso
Uso de RAM: Consumo de memoria en las máquinas en ejecución
Recursos de hardware
Unidades
Muestra todas las unidades físicas conectadas al nodo:
Estado: Indicador en línea/desconectado
Nombre: Identificador de la unidad (por ejemplo, nvme0n1, nvme1n1)
Modelo: Fabricante y número de modelo
Nivel: Asignación del nivel de almacenamiento vSAN
ID de unidad vSAN: Identificador único dentro de vSAN
Firmware: Versión del firmware de la unidad
Bus: Conexión de bus de hardware
Uso: Utilización de la capacidad con indicador visual
Reparando: Estado de reconstrucción de la unidad
Errores de lectura/escritura: Contadores de errores para supervisión del estado de la unidad
Tarjetas de interfaz de red (NIC)
Información y estado completos de las NIC:
Estado: Estado operativo (Arriba/Abajo)
Estado de la red troncal: Estado de conectividad de la red troncal principal (Confirmado/No confirmado) con indicador visual
El icono del globo indica NIC conectadas a la red troncal principal
El estado Confirmado significa que la NIC está correctamente integrada en la infraestructura de red
Nombre: Identificador de la interfaz (por ejemplo, enp2s0f0, enp8s0)
Modelo: Modelo del adaptador de red
Proveedor: Fabricante del adaptador de red
Controlador: Controlador de red en uso
Puerto: Número de puerto físico
Velocidad: Velocidad del enlace (por ejemplo, 10000Mb/s, 2500Mb/s)
MAC: Dirección MAC de hardware
Red: Red VergeOS asociada
RX/TX: Volumen de datos recibidos y transmitidos
Tasa RX/TX: Tasas de transferencia actuales
Acciones: Iconos de acceso rápido para operaciones de NIC (consola, gráficos, configuración)
Módulos de memoria
Muestra la configuración de la RAM instalada:
Cantidad de módulos y capacidad
Tipo de memoria y especificaciones
Vecinos LLDP
Muestra información del Link Layer Discovery Protocol para los dispositivos de red conectados:
Información del switch conectado
Mapeos de puertos
Visualización de la topología de red
Dispositivos PCI
Enumera todos los dispositivos PCI/PCIe:
Tipos y modelos de dispositivos
Asignaciones de bus
Disponibilidad de passthrough
DISPOSITIVOS NVIDIA vGPU
Recursos de GPU disponibles para asignaciones de GPU virtual (si aplica):
Cantidad de funciones virtuales
Estado de asignación
DISPOSITIVOS NVIDIA vGPU
Recursos de GPU disponibles para asignaciones de GPU virtual (si aplica):
Modelo y capacidad de la GPU
Perfiles de vGPU disponibles
Estado de asignación
Dispositivos USB
Dispositivos USB conectados:
Identificación del dispositivo
Capacidad de passthrough
Recursos
Asignación y límites de recursos:
Asignaciones de núcleos
Asignaciones de memoria
Asignaciones de almacenamiento
Tareas
Tareas activas y programadas:
Operaciones en ejecución
Trabajos en cola
Historial de tareas
Máquinas en ejecución
Muestra las cargas de trabajo activas con consumo de recursos detallado:
Estado: Indicador de estado en ejecución
Tipo: Tipo de carga de trabajo (Máquina virtual, contenedor vNet)
Nombre: Identificador de la máquina
Núcleos de CPU: Número de núcleos asignados
Uso de CPU: Porcentaje actual de utilización del procesador
RAM: Memoria asignada con porcentaje de utilización e indicador visual
Último inicio: Marca de tiempo de cuándo se inició la máquina
Los tipos de máquina comunes incluyen:
Máquinas virtuales (VM)
Contenedores vNet (servicios de red)
Servicios del sistema (NAS, DMZ, Externo, etc.)
Características clave
Operaciones de gestión
Disponible en el menú de la izquierda:
Control de energía:
Encender/Apagar
Reiniciar
Cortar energía (apagado forzado)
Operaciones de mantenimiento:
Habilitar/Deshabilitar el modo de mantenimiento
Escalar hacia arriba (añadir recursos al clúster)
Consola remota: Acceso directo a la consola del nodo para solución de problemas
Configuración:
Editar la configuración del nodo
Asignar etiquetas para organización
Eliminar el nodo (cuando corresponda)
Agregar notas para documentación
Actualizar: Actualizar los datos del panel
Gestión IPMI: Acceso a la interfaz de gestión remota
Supervisión
Utilización de recursos en tiempo real: Gráficos en vivo de CPU, memoria y temperatura
Datos históricos de rendimiento: Análisis de tendencias a través del enlace Historial
Registros de eventos: Registro completo de eventos del nodo con:
Nivel: Clasificación de Advertencia/Información/Error
Hora: Marca de tiempo de cada evento
Origen: Componente de origen (por ejemplo, node1)
Mensaje: Descripción detallada del evento (por ejemplo, advertencias de temperatura)
Opción Ver más para un historial de registros ampliado
Estado de salud del hardware: Errores de disco, estado de la NIC y supervisión de componentes
Registros y diagnósticos
La sección de Registros proporciona eventos críticos del sistema:
Advertencias de temperatura: Alertas de umbral de temperatura del núcleo
Eventos de hardware: Cambios de estado de discos, eventos de NIC
Eventos del sistema: Cambios de estado de energía, transiciones del modo de mantenimiento
Alertas de rendimiento: Advertencias de utilización de recursos
Las entradas de registro comunes incluyen advertencias de temperatura del núcleo con valores de umbral específicos (por ejemplo, "El núcleo ha alcanzado la temperatura de advertencia '96 / 95'" ).
Mejores prácticas
Supervisar la salud del nodo: Revisa regularmente las métricas de salud del nodo, especialmente la temperatura y el estado de los discos
Modo de mantenimiento: Activa siempre el modo de mantenimiento antes de realizar actualizaciones del sistema o cambios de hardware
Revisar registros: Comprueba periódicamente los registros en busca de posibles problemas, especialmente advertencias de temperatura y errores de disco
Balanceo de carga: Mantén una distribución equilibrada de la carga de trabajo entre los nodos de tu clúster
Mantente actualizado: Mantén el firmware y el software del sistema actualizados a través del menú Sistema
Acceso a la consola remota: Usa la función de consola remota para solución de problemas directa cuando necesites acceso físico a la consola o por SSH
Monitoreo del estado de la red troncal: Supervisa el estado de la red troncal de las NIC principales para garantizar una integración y redundancia de red adecuadas
Estado de los discos: Supervisa los contadores de errores de los discos y el estado de reparación para abordar proactivamente los problemas de almacenamiento
Gestión de la temperatura: Aborda las advertencias repetidas de temperatura comprobando los sistemas de refrigeración y el flujo de aire
Última actualización
¿Te fue útil?