Đã đến lúc mong đợi sự phục hồi thảm họa linh hoạt

Khôi phục sau thảm họa (DR) phức tạp và cứng nhắc sẽ không còn là vấn đề nữa với Dell EMC Integrated System dành cho Microsoft Azure Stack HCI.

Khi dữ liệu là tiền tệ, DR là không thể thương lượng

Nếu tổ chức của bạn giống như nhiều tổ chức khác—bất kể quy mô nào—thì tổ chức đó ngày càng phụ thuộc vào dữ liệu để phát triển. Điều này đặc biệt đúng đối với các doanh nghiệp đang trên đường hiện đại hóa cơ sở hạ tầng và kiến ​​trúc ứng dụng của mình. Đối với những tổ chức đó, dữ liệu và khối lượng công việc xử lý dữ liệu thực sự là mạch máu của doanh nghiệp.

Khi doanh nghiệp dựa vào dữ liệu để hoạt động, mục tiêu điểm khôi phục (RPO) và mục tiêu thời gian khôi phục (RTO) phải càng thấp càng tốt. Tuy nhiên, các giải pháp khôi phục sau thảm họa (DR) cũ rất phức tạp để thiết kế và duy trì, và chúng có thể yêu cầu can thiệp thủ công trong một kịch bản DR. Các giải pháp này cũng có thể tốn kém, đặc biệt là nếu bạn phải duy trì một trang web DR chuyên dụng. Đó là lý do tại sao một giải pháp DR linh hoạt và hiệu quả là một phần quan trọng của quá trình hiện đại hóa cơ sở hạ tầng.

Phân cụm kéo dài có thể là câu trả lời

Ngày nay, các tổ chức doanh nghiệp đang hợp nhất, làm mới và hiện đại hóa các nền tảng ảo hóa cũ của họ bằng cơ sở hạ tầng siêu hội tụ (HCI). Kiến trúc HCI giúp khách hàng đạt được trải nghiệm vận hành đám mây được tự động hóa và phối hợp cao. Các kiến ​​trúc được thiết kế để cung cấp hiệu suất và khả năng mở rộng ở mức cao với tính toán, lưu trữ và mạng được xác định bằng phần mềm. Các giải pháp HCI cũng được thiết kế để đơn giản hóa việc triển khai tính khả dụng cao và DR cho các khối lượng công việc chạy trong máy ảo (VM) và vùng chứa.

Sẽ thế nào nếu bạn có thể kéo dài một cụm HCI duy nhất trên hai địa điểm như một giải pháp DR? Điều đó sẽ đơn giản hóa và đẩy nhanh DR. Một giải pháp như vậy hiện đã nằm trong tầm tay khi sử dụng Microsoft Azure Stack HCI, phiên bản 20H2 trở lên. Azure Stack HCI bao gồm các khả năng phân cụm kéo dài tích hợp, sử dụng Storage Replica để sao chép khối lượng. Phân cụm kéo dài cho phép các tổ chức chia một cụm HCI duy nhất trên hai địa điểm, cho dù đó là phòng, tòa nhà, thành phố hay khu vực. Nó cung cấp khả năng chuyển đổi dự phòng tự động của Microsoft Hyper-V VM nếu xảy ra lỗi tại địa điểm.

Nhìn chung, phân cụm kéo dài trên Azure Stack HCI là giải pháp DR lý tưởng cho các tình huống như sau:

  • Giới thiệu tính năng chuyển đổi dự phòng tự động với sự phối hợp để phục hồi tầng máy chủ đầu cuối của ứng dụng dựa trên web sau thảm họa tại vị trí lưu trữ
  • Phân phối các phiên bản chính và phụ của các dịch vụ cốt lõi của cơ sở hạ tầng, chẳng hạn như Microsoft Active Directory, trên hai vị trí vật lý
  • Lưu trữ các ứng dụng có đặc điểm hiệu suất đầu vào/đầu ra ghi (I/O) thấp hơn
  • Chạy các dịch vụ dựa trên hệ thống tệp và các dịch vụ kinh doanh khác có thể chịu được việc lưu trữ trên các ổ đĩa có khả năng bị sập
  • Chạy khối lượng công việc cơ sở dữ liệu như Microsoft SQL Server, thường không thể duy trì được việc mất ngay cả một giao dịch duy nhất, trong khi sử dụng các giải pháp phục hồi ở lớp ứng dụng như nhóm khả dụng SQL Always On có thể phù hợp hơn

Đưa giải pháp vào thử nghiệm

Các kỹ sư của Dell Technologies đã tiến hành các thử nghiệm bằng chứng khái niệm (PoC) để chứng minh cách Dell EMC Integrated System for Azure Stack HCI với cụm kéo dài có thể xử lý VM và vị trí khối lượng. Chúng tôi cũng muốn quan sát tác động của một ứng dụng đang chạy thực tế (Dell EMC OpenManage Enterprise) trong các tình huống chuyển đổi dự phòng. Mỗi một trong bốn nút (hai nút cho mỗi trang web) trong môi trường thử nghiệm của chúng tôi bao gồm hai bộ xử lý Intel® Xeon® Gold 6230R và bộ nhớ 384 GB, chạy Azure Stack HCI, phiên bản 20H2.

Chúng tôi đã thử nghiệm các kịch bản sau và quan sát các kết quả được liệt kê. Để biết thông tin chi tiết, hãy đọc sách trắng, Thêm tính linh hoạt vào các kế hoạch DR với Stretch Clustering cho Azure Stack HCI .

  • Lỗi cụm nút không mong muốn: Tất cả các VM khởi động lại hoàn toàn trên nút thứ hai tại cùng một địa điểm trong khoảng 5 phút.
  • Lỗi trang web không mong muốn: Các máy ảo bị ảnh hưởng đã được di chuyển và hoạt động trở lại hoàn toàn trong vòng 15–20 phút.
  • Chuyển đổi dự phòng trang web theo kế hoạch: Ứng dụng OpenManage Enterprise có thể truy cập được từ thiết bị khách hàng trong vòng 3 phút kể từ khi di chuyển trực tiếp đến trang web 2.
  • Quản lý vòng đời: Việc áp dụng các bản cập nhật BIOS, chương trình cơ sở và trình điều khiển cho cụm mở rộng mất khoảng ba giờ và quá trình này không ảnh hưởng đến ứng dụng Dell EMC OpenManage Enterprise (OME).

Một con đường nhanh hơn đến DR đơn giản

Dell Technologies cung cấp danh mục rộng các cấu hình giải pháp được thiết kế để đáp ứng các yêu cầu của bất kỳ khối lượng công việc nào. Giải pháp cho DR được xây dựng trên Hệ thống tích hợp Dell EMC cho Azure Stack HCI có các nút AX được thiết kế thông minh từ các cấu hình của Dell Technologies. Các kỹ sư của Dell xác thực mọi thành phần của các cấu hình này, bao gồm cả phiên bản chương trình cơ sở và trình điều khiển. Ngoài ra, các kỹ thuật viên của Dell ProSupport biết toàn bộ giải pháp, từ phần cứng đến hệ điều hành đến Microsoft Storage Spaces Direct đến mạng. Họ có thể giúp duy trì cụm hoạt động ở hiệu suất và tính khả dụng cao nhất.