> For the complete documentation index, see [llms.txt](https://docs.verge.io/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.verge.io/run-the-platform/vi/van-hanh/sop-scale-out.md).

# Hướng dẫn mở rộng quy mô VergeOS vSAN theo chiều ngang

Hướng dẫn này cung cấp các phương pháp tốt nhất để mở rộng an toàn một hệ thống VergeOS bằng cách thêm một node mới. Hướng dẫn tập trung vào bảo mật dữ liệu và độ bền của hệ thống thông qua một cách tiếp cận có phương pháp.

{% hint style="info" %}
**Tổng quan**

Mở rộng một hệ thống VergeOS đòi hỏi phải lập kế hoạch và thực hiện cẩn thận để đảm bảo gián đoạn dịch vụ ở mức tối thiểu. Hướng dẫn này chia quá trình thành các giai đoạn chính:

1. **Chuẩn bị** - Các bước cần thực hiện trước cửa sổ bảo trì đã lên lịch của bạn
2. **Xác minh trước khi mở rộng** - Các kiểm tra cuối cùng ngay trước khi bắt đầu mở rộng
3. **Thực hiện mở rộng** - Quá trình thêm một node mới
4. **Xác minh sau khi mở rộng** - Đảm bảo việc mở rộng đã thành công
   {% endhint %}

{% hint style="info" %}
**Yêu cầu cụ thể theo môi trường**

Hướng dẫn này bao gồm các phương pháp hay nhất chung. Bạn có thể cần điều chỉnh các bước này cho phù hợp với môi trường và yêu cầu cụ thể của mình.
{% endhint %}

## Điều kiện tiên quyết

* Quyền truy cập quản trị vào hệ thống VergeOS
* Quyền truy cập IPMI vào tất cả các node trong cụm
* Phần cứng của node mới được lắp rack và kết nối đúng cách
* Đã xác minh kết nối mạng cho node mới
* Ổ USB có phiên bản trình cài đặt VergeOS phù hợp
* **Thời gian ước tính:** 2-4 giờ tùy thuộc vào việc tái tạo dữ liệu và kích thước cụm

{% hint style="warning" %}
**Quan trọng**

Hãy đảm bảo bạn có một khoảng thời gian bảo trì tính cả thời gian tái tạo có thể xảy ra. Việc phân phối lại dữ liệu vSAN có thể mất vài giờ tùy thuộc vào lượng dữ liệu và hiệu năng lưu trữ.
{% endhint %}

## Giai đoạn chuẩn bị

Hoàn thành các bước này từ sớm, trước cửa sổ bảo trì đã lên lịch của bạn:

### Sẵn sàng của hệ thống

* [ ] Đảm bảo thời gian lưu giữ snapshot của hệ thống đủ cho khả năng khôi phục lại
* [ ] Thiết lập các tiêu chí thành công và xác minh cụ thể cho khối lượng công việc của bạn
* [ ] Xác định các nhóm VM, dịch vụ, v.v. cần thiết cho trường hợp sử dụng cụ thể của bạn

{% hint style="info" %}
**Ví dụ về trường hợp sử dụng**

VDI có thể có nhiều hình ảnh hoặc nhóm tài nguyên riêng biệt. VPS có thể tập trung nhiều hơn vào chức năng mạng và khả năng kết nối.
{% endhint %}

* [ ] Lập bản đồ các sự kiện hệ thống và guest nhạy cảm với thời gian phải tiếp tục hoạt động

### Chuẩn bị phần cứng

* [ ] Xác nhận quyền truy cập IPMI đến tất cả các host hiện có
  * Thông qua một phương thức có thể cho phép truy cập console trong trường hợp khẩn cấp
* [ ] Bao gồm node mới sẽ được thêm vào trong kế hoạch bảo trì này
* [ ] Xác minh VergeOS đang ở phiên bản được hỗ trợ hiện tại
  * VergeOS đang chạy bản phát hành mới nhất
* [ ] Ổ USB đã được chuẩn bị với phiên bản trình cài đặt phù hợp

### Tài liệu và lập kế hoạch

* [ ] Cập nhật tài liệu nền tảng (cổng, IP, VLAN, v.v.)
* [ ] Ghi lại cấu hình cụm hiện tại để làm tham chiếu khi khôi phục
* [ ] Lên kế hoạch thời gian truyền thông cho người dùng bị ảnh hưởng

### Xác minh tài nguyên

* [ ] Kiểm tra mức sử dụng tài nguyên của cụm
  * Đảm bảo hệ thống của bạn có đủ tài nguyên dự phòng để mất nút lớn nhất của bạn
* [ ] Xác nhận các đường dẫn mạng giữa các host
  * Từ Node1: Chẩn đoán Node -> 'Fabric Configuration' báo cáo các đường dẫn Core1 và Core2 là 'confirmed:true' cho tất cả các node hiện có

## Xác minh trước khi mở rộng

Thực hiện các kiểm tra này vào ngày bảo trì đã lên lịch, trước khi bắt đầu mở rộng:

### Xác minh trạng thái hiện tại

* [ ] Khả dụng tài nguyên - Hệ thống là N+1
  * Xác minh mức sử dụng RAM đủ để chạy workload khi một node ngoại tuyến
* [ ] Snapshot hệ thống gần đây và sẵn sàng
  * Đặt Snapshot mới nhất hết hạn vào vài ngày tới để giữ lại thêm
* [ ] Xác nhận đồng bộ đa site hoạt động bình thường và được cập nhật
* [ ] Xác minh tất cả các tầng vSAN ở trạng thái tốt
* [ ] Xác nhận không có node nào đang chờ khởi động lại
* [ ] Bộ cài USB đã được cắm và được phát hiện trên node mới
* [ ] Xác minh báo cáo chẩn đoán 'Fabric Configuration' của Node1 cho thấy các đường dẫn Core1 và Core2 là 'confirmed:true' cho tất cả các node hiện có

## Giai đoạn thực hiện

### Thêm node mới

Để biết hướng dẫn chi tiết từng bước về việc thực hiện mở rộng vSAN, vui lòng tham khảo:

[Hướng dẫn cài đặt node mở rộng](/plan-and-deploy/vi/huong-dan-trien-khai/scale-out-nodes.md)

### Tổng quan quy trình chính

1. **Khởi động node mới** từ trình cài đặt USB
2. **Cấu hình mạng** trên node mới
3. **Tham gia node vào cụm** thông qua giao diện VergeOS
4. **Theo dõi phân phối lại vSAN** - đây là giai đoạn dài nhất
5. **Chờ hoàn tất** - các tầng vSAN phải trở lại trạng thái xanh

{% hint style="warning" %}
**Thời gian chờ quan trọng**

Trong quá trình mở rộng, các tầng vSAN sẽ hiển thị trạng thái vàng trong giai đoạn tái tạo. Điều quan trọng là phải chờ tầng vSAN trở lại trạng thái khỏe mạnh "xanh" trước khi tiếp tục bất kỳ thao tác nào khác hoặc coi việc mở rộng là hoàn tất.
{% endhint %}

{% hint style="success" %}
**Theo dõi tiến trình**

Bạn có thể theo dõi tiến độ tái tạo vSAN trong giao diện VergeOS tại System -> vSAN. Quá trình tái tạo sẽ hiển thị phần trăm hoàn thành và thời gian còn lại ước tính.
{% endhint %}

## Xác minh sau khi mở rộng

Sau khi quá trình mở rộng hoàn tất, hãy xác minh hệ thống đang hoạt động đúng cách:

### Kiểm tra tình trạng hệ thống

* [ ] Xác nhận node mới xuất hiện trong WebUI của VergeOS
  * Không có cảnh báo cụ thể cho node trong nhật ký của nó
* [ ] Xác minh việc sửa chữa vSAN đã hoàn tất và tất cả các tầng hiển thị trạng thái xanh
* [ ] Kiểm tra/xác nhận các hệ thống khách theo yêu cầu trong tiêu chí thành công của bạn
* [ ] Kiểm tra nhật ký để tìm bất kỳ sự kiện mới hoặc bất ngờ nào
* [ ] Xác minh tất cả các tiêu chí thành công đã nêu trong các bước chuẩn bị của bạn
* [ ] Xác nhận phân bổ tài nguyên của cụm được cân bằng
* [ ] Kiểm tra di chuyển VM đến/từ node mới

### Xác thực hiệu năng

* [ ] Theo dõi hiệu năng hệ thống trong 24-48 giờ sau khi mở rộng
* [ ] Xác minh hiệu năng lưu trữ đáp ứng kỳ vọng
* [ ] Xác nhận thông lượng mạng đến node mới là tối ưu

## Khắc phục sự cố

### Các sự cố thường gặp

**Tầng vSAN vẫn màu vàng sau một thời gian dài**

* Kiểm tra kết nối mạng giữa các node
* Xác minh tình trạng của tầng lưu trữ trong System -> vSAN
* Đảm bảo băng thông giữa các node đủ
* Liên hệ bộ phận hỗ trợ nếu quá trình tái tạo bị kẹt lâu hơn khung thời gian dự kiến

**Node mới không xuất hiện trong WebUI**

* Xác minh cấu hình mạng và kết nối
* Kiểm tra việc gán DHCP/IP tĩnh
* Xác nhận phiên bản bộ cài USB khớp với phiên bản cụm
* Xem lại nhật ký cài đặt node

**Suy giảm hiệu năng trong quá trình tái tạo**

* Điều này là bình thường trong quá trình phân phối lại vSAN
* Hãy cân nhắc lên lịch vào các thời điểm ít sử dụng
* Theo dõi và điều chỉnh workload nếu cần

**Sự cố fabric mạng**

* Xác minh các đường dẫn mạng Core1 và Core2
* Kiểm tra các kết nối mạng vật lý
* Xác nhận cấu hình VLAN khớp với các node hiện có

## Quy trình khôi phục

{% hint style="warning" %}
**Các cân nhắc về khôi phục**

Nếu có sự cố, cách an toàn nhất là tạm dừng, điều tra hành vi bất thường, rồi tiếp tục lại với sự hiểu biết rõ ràng về vấn đề. Việc gỡ bỏ hoàn toàn node có thể yêu cầu phân phối lại dữ liệu vSAN.
{% endhint %}

### Nếu cần khôi phục

1. **Dừng quá trình cài đặt** nếu vẫn đang diễn ra
2. **Tắt nguồn node mới** để ngăn ngừa hỏng dữ liệu
3. **Cho phép vSAN ổn định** nếu dữ liệu đã được di chuyển một phần
4. **Xóa node khỏi cụm** thông qua giao diện VergeOS nếu nó đã được thêm thành công
5. **Theo dõi độ ổn định của hệ thống** trước khi lên lịch lại việc mở rộng

## Các bước tiếp theo

Sau khi hoàn tất mở rộng thành công:

* [ ] Cập nhật các hệ thống giám sát để bao gồm node mới
* [ ] Cập nhật tài liệu với thông tin chi tiết của node mới
* [ ] Lên lịch bảo trì định kỳ cho node mới
* [ ] Cân nhắc cập nhật các quy trình sao lưu và DR để tính đến dung lượng tăng thêm
* [ ] Lập kế hoạch cho bất kỳ nhu cầu mở rộng bổ sung nào dựa trên dự báo tăng trưởng

{% hint style="danger" %}
**Hỗ trợ khẩn cấp**

Nếu bạn gặp bất kỳ vấn đề nào với việc mở rộng VergeOS của mình, vui lòng liên hệ [đội ngũ hỗ trợ của chúng tôi](/overview/vi/support-and-services.md) để được trợ giúp ngay lập tức.
{% endhint %}


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.verge.io/run-the-platform/vi/van-hanh/sop-scale-out.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
