החלת עקרונות סובלנות ל-AWS Infrastructure: מחקרים וכימיה
יישום סובלנות אשמה בתשתיות AWS מבטיח זמינות גבוהה וחוסנות מפני כישלונות. מאמר זה חוקר מחקרים ו חישובים מעשיים כדי להפגין אסטרטגיות יעילות של סובלנות אשמה בתוך סביבות AWS.
הבנה של סובלנות ב-AWS
סובלנות Fault מתייחסת ליכולת של מערכת להמשיך לפעול כראוי במקרה של כשל של חלק מהרכיבים שלה. ב-AWS, זה כרוך בעיצוב ארכיטקטורות שיכולות לעמוד בכישלונות חומרה, בעיות ברשת או הפרעות אחרות ללא זמן רב.
מחקר: Multi-region Deployment
חברה פריסת היישום שלה על פני שני אזורי AWS כדי לשפר את סובלנות הפגמים.כל אזור מארח משאבים זהים, כולל EC2 מקרים, מסדי נתונים RDS, ומאזןי עומס.האדריכלות משתמשת כביש 53 עבור DNS נכשלובר, הפניית התנועה אם אזור אחד הופך לבלתי זמין.
חישובים מראים כי עם הגדרה זו, המערכת יכולה לסבול את הכישלון של אזור שלם עם השפעה מינימלית על זמינות. בהנחה שלכל אזור יש 99.9% עד למעלה, הזמינות של המערכת המשולבת עולה באופן משמעותי, להפחית את הסיכון של זמן השבתה.
עלויות וגמישות אמינות
כדי להעריך סובלנות לקויה, חישובים לשקול את ההסתברות של כישלונות ועלות של undancy.לדוגמה, פריסת משאבים באזורי זמינות מרובים באזור יכול להפחית את הסיכון של כשל באזור.אם לכל אזור יש ⁇ 9% מהזמן, ההסתברות של כשלון בו זמנית יורדת לרמה רשלנית.
ניתוח עלויות מאזן את עלות משאבים נוספים נגד התועלת של זמינות מוגברת.שימוש במודלים של התמחור של AWS, ארגונים יכולים לקבוע את המספר האופטימלי של אזורים ואזורים כדי לעמוד בדרישות הסובלנות שלהם.
Best Practices for Fault Tolerance in AWS
- (ב) מקורות שונים (ב) ושטחי מילואים (ב"ב)
- (ב) מנגנוני הכשל האוטומטיים (FLT:0)
- (ב) ,0) תוכניות שיקום אסון מבחן בתיקון:
- (ב) ,0) בריאות מערכת העצבים ברציפות.
- (ב) ,0) שירותים מנוהלים עם סובלנות מובנת.