故障耐性の組込みシステムは、一部のコンポーネントが故障しても正しく機能し続けるように設計されています。 それらは、航空宇宙、医療機器、および産業オートメーションなどの信頼性と安全性が重要なアプリケーションで不可欠です。 この記事では、このようなシステムを開発するための基本的な概念と実用的なアプローチについて説明します。

故障許容の理論的基礎

故障公差は、障害から検出、分離、回復できるシステムの設計を含みます。 主な概念には冗長性、エラー検出、および障害のマスクが含まれます。 冗長性は、ハードウェアの重複やソフトウェア技術を介して実装することができ、主が失敗した場合、バックアップコンポーネントが引き継がれることができることを保証します。

checksums、parity bit、watchdog タイマーなどのエラー検出方法は、早期に障害を識別するのに役立ちます。 トリプルモジュラー冗長(TMR)の投票システムのような不正マスク技術は、システム出力に欠陥が影響するのを防ぎます。

実用的な実装戦略

組込みシステムにおける障害耐性の実装には、慎重な計画が必要です。 デュアルコアプロセッサやバックアップ電源などのハードウェア冗長性は、信頼性を高めます。 ソフトウェア戦略には、 watchdog のタイマー、例外処理、定期的な自己テストが含まれます。

デザイナーは、システムの堅牢性を評価するために、欠陥の注入テストを頻繁に使用します。このプロセスは、誤りから検出および回復するシステムの機能を確認する断層を意図的に導入することを含みます。

共通の欠陥の許容の技術

  • [] ハードウェア冗長:[ 重複コンポーネントを使用して、連続操作を保証します。
  • [ソフトウェア冗長:[]]]は、複数のアルゴリズムやクレンスを実装して重要な機能を実行します。
  • エラー検出:]チェックサム、パリティー、および watchdog タイマー。
  • ] フォールマスキング:] 投票方式 TMR のような。
  • 自己検査:] 早期に障害を識別するための定期的な診断。