> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/run-the-platform/zh/xi-tong-guan-li/cluster-settings.md).

# 集群设置

该 *集群设置* 表单使您能够配置与性能、安全性、分配、温度监控和交换相关的关键参数。虽然大多数默认设置适用于大多数环境，但建议在创建新集群时以及之后定期检查这些设置，以确保与您组织的策略和运维要求保持一致。

{% hint style="success" %}
**大多数集群设置更改都需要重启集群中的每个节点。必要时，集群仪表板顶部会显示一条消息。请选择&#x20;*****需要重启*****&#x20;选项（位于集群仪表板顶部的重启/重新启动消息中，或左侧菜单选项中）来管理集群节点的重启。重启节点时，请始终遵循正确的** [**维护模式流程**](/run-the-platform/zh/yun-wei/maintenance-mode.md) **以避免工作负载中断。**
{% endhint %}

## 访问集群设置

* 从顶部菜单中导航到 **基础架构** > **集群** > **双击所需的集群**
* 单击 **编辑** 左侧菜单中的。

## 集群

本节定义了集群的基本属性。

1. **已启用：** 默认情况下，集群将处于启用状态。通常没有理由禁用它；不过，在某些情况下这样做可能很有用，例如在进行完整的集群重新配置期间。
2. **名称：** 集群通常在安装时命名，但可以随时重命名而不会有问题。
3. **描述：** 可选文本区域，用于提供集群用途或特性的简要说明。
4. **默认 CPU 类型：** 定义此集群所指定虚拟机的默认/推荐 CPU 类型。此设置会在集群安装期间根据检测到的 CPU 硬件自动选择。在初始配置期间，请检查该设置以确认已检测到正确的 CPU 类型。

{% hint style="success" %}
**为了适应将虚拟机迁移/故障切换到使用更低等级 CPU 芯片的其他集群，&#x20;*****默认 CPU 类型*****&#x20;可以更改为较低等级的类型，以便虚拟机能够顺利迁移到较旧的芯片硬件上。**
{% endhint %}

{% hint style="warning" %}
**集群中的所有节点都应包含相同的 CPU 硬件；同一集群中混合 CPU 类型可能会导致性能和工作负载迁移问题。**
{% endhint %}

5. **每节点存储缓冲区（默认 2 GB）：** 为每个节点额外分配的 RAM 数量，用于 vSAN 性能缓存。

{% hint style="info" %}
**注意事项**

* 当在系统和虚拟工作负载需求之外还有可用 RAM 时，请考虑增加此设置
* 增加 *每节点存储缓冲区* 可显著提升读写性能
* 作为一般经验法则，在正常运行期间，RAM 利用率尽量不要超过 80%
  {% endhint %}

### 集群安全/性能

本小节允许您为集群中的所有节点启用/禁用各种与性能和安全相关的功能及缓解措施。

1. **为存储分配 Hugepages（默认启用）：** 在大多数情况下，强烈建议启用 hugepages，因为它可提升工作负载的内存存储性能。通常不建议禁用此设置，除非是少数特殊场景，例如仅运行非常小的虚拟机或对 hugepage 支持有限的旧版客户机操作系统。
2. **禁用 CPU 安全缓解措施：** 如果选中，将为集群禁用内核级 CPU 安全缓解措施。

{% hint style="warning" %}
**重要：虽然禁用 CPU 安全缓解措施可以提升性能，但这可能存在风险。只有在您完全信任此集群中运行的所有客户机，并且能够确保工作负载不存在外部漏洞时才应选择此选项（例如隔离网络系统）。**
{% endhint %}

3. **禁用推测存储旁路：** 如果选中，将在运行时禁用推测存储旁路（SSB）。禁用 SSB 可能会导致性能轻微到中度下降，具体取决于系统工作负载。
4. **禁用 SMT：** 如果选中，将在运行时禁用同时多线程（SMT）。

{% hint style="info" %}

* 禁用 SMT 会显著降低性能，因为它会禁用超线程
* 虽然现代软件和微码更新通常能缓解与 SMT 相关的许多漏洞，但某些高度敏感的环境仍可能选择禁用它，即使这会带来性能损失
* 禁用 SMT 的推荐方式是在 BIOS 中进行。该设置的确切名称可能因制造商而异；如有疑问，请查阅硬件文档
  {% endhint %}

5. **禁用 CPU 休眠状态：** 如果选中，VergeOS 会自动禁用低级休眠状态。这可以消除因短暂空闲突发而导致的不必要休眠状态切换，否则这些切换可能在几乎没有功耗效率收益的情况下造成明显的性能下降。

{% hint style="info" %}

* 禁用 CPU 休眠状态在新部署的系统上尤其有益，因为工作负载会逐步增加。在这些情况下，空闲节点必须在需求增加时快速响应
* 选择此选项可能会导致更高的温度和功耗，具体取决于系统工作负载
  {% endhint %}

6. **启用拆分锁检测：** 检测工作负载中的拆分锁事件并将其报告到系统日志中。启用此选项可能会对触发拆分锁的虚拟机造成性能影响。
7. **能效策略（默认=*****性能*****):** 引导处理器内部逻辑在性能与功耗效率之间取得平衡的策略设置。通常最好保持此设置为默认值，让系统在运行时动态优化性能。也提供其他能效与性能选项，用于支持非企业环境，例如消费级系统、家庭实验室或概念验证（POC）部署。
8. **CPU 调速策略（默认=*****性能*****):** 基于系统负载进行内核级动态 CPU 频率调整的策略。通常最好保持此设置为默认值，让系统在运行时动态优化性能。也提供其他能效与性能选项，用于支持非企业环境，例如消费级系统、家庭实验室或概念验证（POC）部署。

### 系统日志过滤器

1. **系统日志过滤器（默认 `*:3,ipmievd:5,rasdaemon,!ntpd,!postfix`):** 以 rsyslog 语法编写的、逗号分隔的过滤器列表，用于确定在用户界面中显示哪些日志条目。符合这些过滤器的条目会被显示；其余条目会从 UI 视图中排除。该语法支持 facility 和 priority 过滤器，以及特定程序的包含或排除。

{% hint style="success" %}
**未过滤的日志仍可通过&#x20;*****节点诊断*****&#x20;（导航到&#x20;*****节点*****&#x20;> 双击所需的节点 > 选择&#x20;*****诊断*****&#x20;从左侧菜单。）**
{% endhint %}

## 计算

本节为您的集群配置计算资源策略。这些设置不适用于仅存储集群。

1. **每台机器最大 RAM：** 指定可分配给单个工作负载（例如虚拟机、租户节点或 NAS 服务）的最大 RAM 数量。

{% hint style="success" %}
**注意事项**

* 如果任何正在运行的工作负载（例如 VM）使用的 RAM 超过此限制，那么在降低该设置后它们将无法迁移。
* 该限制会影响工作负载启动和迁移（即在新节点上启动）。它不会禁止您创建使用更多 RAM 的工作负载，而只会在超过限制时阻止其启动。
* 通常应选择尽可能低、但仍能满足您预期最大工作负载需求的 RAM 值。为单个工作负载分配更低的 RAM 将最大化迁移、故障切换和工作负载可移植性的灵活性，并实现更快的故障切换时间。
* **将此限制设置得接近节点物理 RAM 容量时要谨慎**。如果您将此限制设置为与节点总 RAM 相同（例如 128GB），然后创建一个使用全部该内存的 VM，那么该 VM 将无法启动或迁移，因为：
  * VergeOS 会为系统操作和 vSAN 功能预留 RAM
  * 在维护或故障切换期间，工作负载必须迁移到其他可用节点
  * 消耗几乎所有可用 RAM 的 VM 无法成功迁移到其他节点
* **推荐做法：** 将此限制设置为不超过最小节点物理 RAM 的 70-80%，以确保 VM 在维护或故障切换场景中始终能够迁移。
  {% endhint %}

2. **每台机器最大核心数：** 指定可分配给单个工作负载（例如虚拟机、租户节点或 NAS 服务）的最大 CPU 核心数

{% hint style="success" %}
**注意事项**

* 如果任何正在运行的工作负载（例如 VM）使用的核心数超过此限制，那么在降低该设置后它们将无法迁移。
* 在几乎所有情况下，此值 **不应超过** 一个 **单个 CPU 插槽中的核心数**.
* **此值绝不应超过单个节点中的物理核心总数**
  {% endhint %}

3. **目标最大 RAM 百分比（默认 80）：** 指定集群节点在正常情况下应使用的物理 RAM 最大百分比。该阈值有助于防止新工作负载导致过度分配。不过，在特殊情况下，例如故障切换或工作负载迁移，为保持服务连续性，可能会超出此阈值。

{% hint style="info" %}
**示例&#x20;*****目标最大 RAM 百分比***

* 某集群节点有 **252GB 可用物理 RAM** （256GB 中扣除 BIOS/显卡开销后为 252GB）
* ***目标最大 RAM 百分比*** 被设置为默认值 **80**
* 252G \* 80% = **约 200G** 在正常情况下可用
* **系统/vSAN RAM 开销 16G** （注意：vSAN 开销会因集群存储量而异）
* **可供新工作负载使用：** 184GB（可用量减去开销），保持在 80% 的使用目标以内
* **在故障切换或迁移期间：** 工作负载 RAM 使用量 **可能会暂时超过 184GB** 以支持迁移后的工作负载
  {% endhint %}

4. **用于机器的保留 RAM 百分比：** 定义一部分交换空间（按百分比计算），专门用于在物理 RAM 耗尽时模拟额外的工作负载 RAM。此虚拟 RAM 可配置为 RAM 超额分配的后备方案。

{% hint style="warning" %}
**RAM 超额分配注意事项**

* 使用此保留 RAM 功能通常仅适合作为 RAM 超额分配的后备方案
* 避免在工作负载内存利用率高或存在关键工作负载的集群上进行超额分配
* 考虑通过降低持续低利用率虚拟机的 RAM 分配来进行合理化调整
* 如果过多虚拟机同时请求其全部内存分配，工作负载性能可能会下降，因为虚拟 RAM 的速度远慢于物理 RAM（毫秒级 vs. 纳秒级）
  {% endhint %}

5. **嵌套虚拟化：** 允许在另一台虚拟机内使用主机提供的硬件加速来运行虚拟机。

{% hint style="info" %}
**嵌套虚拟化可能涉及安全影响以及公平排队/计量方面的问题。**
{% endhint %}

6. *允许嵌套虚拟化实时迁移：*\* 允许具有嵌套虚拟化的虚拟机进行实时迁移。
7. *允许 VGPU 实时迁移：*\* 允许带有 vGPU 设备的虚拟机进行实时迁移（实验性）。虽然测试中尚未完全验证，但在主机和客户机都使用最新 NVIDIA 驱动程序时，vGPU 工作负载的实时迁移通常被证明可以可靠运行。

{% hint style="info" %}
**如果可用的 vGPU 设备不足，工作负载在维护期间可能会暂时关闭。**
{% endhint %}

{% hint style="success" %}
\***实时迁移**

虚拟机设置： *迁移方式* 允许定义每台 VM 的迁移行为（例如需要手动关机、尝试实时迁移）
{% endhint %}

## 存储（交换设置）

{% hint style="warning" %}
**交换设置在集群安装期间指定。交换设置更改只会应用于新格式化的磁盘。**
{% endhint %}

1. **用于交换的层级：** 用于交换空间的存储层级。当值为 0 时，交换被禁用
2. **每驱动器交换量：** 每个驱动器分配的交换空间量

## 节点温度

本节允许您为 VergeOS 设置与集群节点较高 CPU 热读数相关的告警行为。及早通知，在达到 CPU 最高温度之前发出预警，可帮助采取措施避免宕机和对物理设备的损害；让 CPU 硬件达到其最高温度限制可能会导致 CPU 自动关机或引发死锁，并可能造成硬件损坏。

1. **最高核心温度（摄氏度）** 设定用于 VergeOS 温度监控的峰值温度（与下一项设置一起使用： *最高核心温度警告阈值 %*).

   * ***从硬件查询*****&#x20;（默认）** - 从 CPU 读取硬件定义的最高温度

   <div data-gb-custom-block data-tag="hint" data-style="info" class="hint hint-info"><p><strong>非服务器硬件和某些旧式服务器可能不支持此查询；在这种情况下，可选择 </strong><em><strong>自定义</strong></em><strong> 设置来建立一个用于 VergeOS 警告的最高温度。</strong></p></div>

   * ***自定义*** - 允许手动定义特定的峰值温度。请参阅您的硬件文档以确认 CPU 的最高温度。
   * ***禁用*** - 当您不希望在 VergeOS 中监控温度时可选择此项（例如您不负责监控硬件、是裸金属服务提供商，或者 VergeOS 运行在虚拟环境中）
2. **最高核心温度警告阈值 %** 设置相对于上述最高核心温度的百分比边界，以触发警告状态。警告状态会使节点状态变为黄色，并在系统日志中创建一条警告记录。通常建议阈值至少为 10% 或更高，以便在应对热问题时有时间采取适当措施。

{% hint style="info" %}
**示例**

如果 *最高核心温度（摄氏度）* 设置为 80 度，且 *最高核心温度警告阈值 %* 设置为 10，那么当 CPU 硬件报告 72 度时将触发警告状态。
{% endhint %}

3. **关键核心温度（摄氏度）：** 定义在 VergeOS 中触发错误状态的温度。当报告的硬件温度达到该温度时，节点状态将变为红色，并且系统日志中会出现一条错误记录。

   * ***从硬件查询*****&#x20;（默认）** - 从 CPU 读取硬件定义的临界温度

   <div data-gb-custom-block data-tag="hint" data-style="info" class="hint hint-info"><p><strong>非服务器硬件和某些旧式服务器可能不支持此查询；在这种情况下，可选择 </strong><em><strong>自定义</strong></em><strong> 设置来建立一个用于 VergeOS 警告的最高温度。</strong></p></div>

   * ***自定义*** - 允许手动定义临界温度。请参阅您的硬件文档以确认 CPU 的最高温度。
   * ***禁用*** - 当您不希望在 VergeOS 中监控温度时可选择此项（例如您不负责监控硬件、是裸金属服务提供商，或者 VergeOS 运行在虚拟环境中）


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/run-the-platform/zh/xi-tong-guan-li/cluster-settings.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
