微处理器的故障容积对于确保关键系统中的可靠运行至关重要,它涉及到检测、纠正或防止处理过程中可能出现的错误的技术。本条探讨了用于评估故障容积的常用方法、计算和实际执行。

过失容忍方法

微处理器中采用了若干技术来增强断层容恕性,其中包括硬件冗余、错误检测和校正代码以及基于软件的方法。硬件冗余涉及复制组件,这样,如果一个部件失败,另一个部件就可以接手。错误检测方法,如等值检查和循环冗余检查(CRC),在数据传输或处理过程中识别错误。

错误校正码,如汉明码,不仅自动检测,而且自动纠正某些类型的错误. 软件方法涉及监理计时器和例外处理常规,用于监控系统健康,及时应对故障.

过失容忍计算

评估故障耐受性往往涉及计算系统在故障率(MTBF)和误差率之间的平均时间. 可靠性模型,如断层树分析(FTA),有助于识别潜在的故障点和估计系统稳健性. 例如,如果一个组件故障概率为p,并且使用冗余,则可以根据冗余单位的数量计算总体系统可靠性.

在具有n冗余组件的系统中,系统故障的概率往往被模拟为:

P(系统故障)=pn]

实用方法

在微处理器中实施故障容忍性,涉及根据系统要求选择适当的技术. 硬件冗余在可靠性至关重要的航空航天和医疗设备中很常见. 错误检测和校正被整合到内存和通信接口中,以防止数据腐败.

设计者还包含容错架构,如三联模块冗余(TMR),三个相同的模块平行运行,多数投票决定正确的输出. 定期测试和验证对于随着时间的推移保持系统完整性至关重要.