Table of Contents
Thiết kế hệ thống phụ trách lỗi bao gồm việc tạo ra các cấu trúc phần cứng có thể tiếp tục hoạt động đúng mặc dù thất bại hay lỗi. Cách tiếp cận này tăng độ tin cậy hệ thống và sẵn có, điều này rất quan trọng trong các ứng dụng như không gian hàng không, thiết bị y tế và trung tâm dữ liệu.
Thiết kế phần cứng có số lượng dư
Việc dự phòng bao gồm việc kết hợp các thành phần hay hệ thống có thể tiếp quản nếu yếu tố chính thất bại. Các kiểu thông thường bao gồm phần cứng bị thay thế, như bộ xử lý, cung cấp điện năng, hoặc mô- đun bộ nhớ. Việc này đảm bảo thao tác liên tục ngay cả khi các phần riêng bị lỗi.
Hệ thống dự phòng thường được cấu hình song song hoặc tạm thời. Hệ thống song song hoạt động cùng lúc, chia sẻ trọng lượng, trong khi hệ thống tạm dừng hoạt động chỉ khi bị lỗi phát hiện. Thiết kế đúng giảm thời gian xuống và duy trì tính toàn vẹn của hệ thống.
Lỗi phát hiện và sửa kỹ thuật
Gặp lỗi khi phát hiện lỗi trong dữ liệu hay phần cứng. Kỹ thuật thông thường bao gồm kiểm tra cân, kiểm tra lại ngân sách và kiểm tra lại chu kỳ (CRC). Những phương pháp này giúp phát hiện lỗi sớm hơn, ngăn chặn xử lý dữ liệu sai.
Kỹ thuật sửa lỗi không những phát hiện mà còn sửa lỗi. Thí dụ bao gồm mã Hamming và code Reed-Solomon. Những bộ nhớ này được dùng trong hệ thống bộ nhớ và truyền dữ liệu để đảm bảo tính toàn vẹn mà không cần chuyển đổi lại.
Tha thứ vì không tha thứ
Thiết kế có hiệu quả sửa lỗi kết hợp với các kỹ thuật sửa lỗi và sửa chữa lỗi. Hệ thống được giám sát liên tục, và các cơ chế tự động bị hỏng được thực hiện để chuyển đổi sang các thành phần dự phòng không thể thay đổi.
- Thành phần phần cứng dư thừa
- Gặp lỗi khi phát hiện thuật toán
- Hệ thống tự động ngắt kết nối
- Thử ra hệ thống chính quy