利用 iGPU 加速 AI
关于在 VergeOS 中为 AI 加速配置 iGPU(集成显卡)的说明,包括资源组设置和模型分配。
前提条件
服务器 CPU 必须具有集成 GPU(iGPU)
确认在 BIOS 设置中已启用 iGPU
直通可能需要启用 IOMMU/VT-d(Intel)或 AMD-Vi(AMD)
高级步骤
要将 iGPU 用于私有 AI 模型,需要执行以下高级步骤:
创建资源组:类型 = "Host GPU"
将物理节点中的 iGPU 设备添加到资源组
将资源组分配给一个或多个 AI 模型
使用 iGPU 配置资源组
导航到 基础架构 > 节点 以及 双击 包含 iGPU 的节点。
选择 PCI 设备 卡片或左侧菜单选项。
在设备列表中,将 类型 筛选器(Type 列顶部)设置为 显示控制器 以仅显示显示设备。
从筛选后的列表中选择 iGPU 设备。⚠️ 为资源组选择设备时要小心。选错设备可能会导致问题。
点击 创建资源 在左侧菜单中。
创建一个 新的资源组:
如果不存在任何组,输入表单将自动显示。
否则,选择 附加到: --新组-- 然后点击 下一步
配置资源组字段:
名称: 提供一个描述性名称,例如“iGPU”
类型:选择 主机 GPU
最大 vRAM: 限制可供 iGPU 使用的系统 RAM 数量(默认 = 0;不限制)。
在运行其他工作负载的系统上,设置最大 vRAM 以防止工作负载与 iGPU 使用之间发生争用。
如果最大 vRAM 设置得过低,模型可能无法加载并产生错误。
点击 提交 以使用所选 iGPU 保存新的资源组。
按照仪表板顶部的提示进行操作,以 查看节点,将节点置于 维护模式 (参见节点仪表板顶部的消息),并 重新加载驱动程序 (当节点进入维护模式后,仪表板顶部会提示)。
在节点上退出维护模式 ,待驱动程序重新加载完成后。
导航到 基础架构 > 资源 > 组 并确认你的新资源组显示为 已启用 已勾选。双击该组以确认 节点资源 部分列出了你的 iGPU 设备。
将额外的节点 iGPU 添加到同一资源组
跨节点池化 iGPU
通过将多个节点中的 iGPU 添加到同一个资源组,你可以创建一个共享的加速资源池,供 AI 模型调用。更多详情请参见 资源组
要添加更多 iGPU:
重复上述步骤 1–5。
当系统提示选择一个资源组时 附加到, 选择现有的 Host GPU 资源组.
按照仪表板提示将节点置于 维护模式 以及 重新加载驱动程序.
在重新加载完成后退出维护模式 。
将 iGPU 资源组分配给模型
配置完成后,将 Host GPU 资源组分配给你的 AI 模型:
导航到 私有 AI > 模型.
选择你想加速的 AI 模型。
点击 编辑 在左侧菜单中。
在 GPU 资源组分配 字段中,选择你的 iGPU 资源组。
点击 提交 以保存。
该模型现在将从资源组中的任何可用 iGPU 获取资源。有关私有 AI 配置的更多信息,请参见 私有 AI 配置.
最后更新于
这有帮助吗?