Hệ thống cơ sở dữ liệu có khả năng phục hồi cao là thiết yếu để đảm bảo hoạt động liên tục và giảm thời gian trong các ứng dụng then chốt. Tăng các nguyên tắc thiết kế hiệu quả có thể cải thiện tính bền bỉ và đáng tin cậy của hệ thống. Bài này khám phá các nguyên tắc then chốt và các ví dụ công nghiệp thực tế.

Sự dư dật và thất bại trong việc vận động

Sự dự phòng bao gồm các thành phần quan trọng để ngăn chặn các điểm thất bại. Các cơ chế lỗi quá trình tự động chuyển sang hệ thống dự phòng khi các thành phần chính bị hỏng. Những chiến lược này đảm bảo dữ liệu có sẵn và hệ thống tăng thời gian.

Chẳng hạn, các tổ chức tài chính thường triển khai các trung tâm dữ liệu dư thừa với sự thất bại tự động để duy trì việc xử lý giao dịch trong thời gian bị mất.

Sự tái tạo dữ liệu và sự nhất quán

Việc sao chép dữ liệu từ nhiều nút hoặc vị trí, tăng khả năng chịu đựng lỗi và tải cân bằng.

Những nhà lãnh đạo kỹ thuật như nhà cung cấp mây sử dụng tái tạo đa chiều để đảm bảo tính bền vững và sẵn có của dữ liệu, ngay cả khi thất bại trong vùng.

Tự động phục hồi

Việc giám sát liên tục phát hiện vấn đề sớm, cho phép phản ứng tức thời. Quá trình phục hồi tự động có thể khởi động lại dịch vụ bị lỗi hoặc chuyển hướng giao thông mà không có sự can thiệp của con người.

Ví dụ, các nền tảng điện tử quy mô lớn thực hiện giám sát và tự động thất bại để duy trì dịch vụ trong khi giao thông cao hay hệ thống lỗi.

Những gương kỹ thuật

  • [FLT:]Google Spanner: sử dụng đồng bộ hoá việc sao chép và TrueTime ADI để thống nhất toàn cầu và có sẵn cao.
  • Amazon DynamoDB: sự phân chia dữ liệu và tái tạo đa chiều cho sự khoan dung lỗi.
  • Cơ sở dữ liệu Microsoft Azure: đề nghị các nhóm địa lý và tự động thất bại trong việc phục hồi thảm họa.