תשתיות, ענן ו-DevOps · מתקדם

זמינות גבוהה והתאוששות מאסון

בשורה אחת: החליטו כמה השבתה עולה לכם בשעה, ורק אז החליטו כמה כפילות לקנות.

להגדיר יעד לפני פתרון

ההפרש בין 99.9 ל-99.99 אחוזי זמינות הוא הפרש של פי כמה בעלות ובמורכבות. רוב המערכות העסקיות אינן צריכות את הגבוה, ומי שכן צריך יודע לנמק זאת בכסף.

שכבות של עמידות

מופעים מרובים באזורי זמינות שונים; בסיס נתונים עם עותק משני והחלפה אוטומטית; חוסר תלות במצב מקומי; ובדיקות בריאות שמוציאות מופע פגום מהתעבורה.

לשלב הבא — אזור גאוגרפי שני — עלות ומורכבות משמעותיות, כולל שאלות של השהיה ועקביות נתונים.

תרחיש האסון

לא רק שרת שנפל: מחיקה בטעות, השחתת נתונים, וחשבון ענן שננעל. לכל אחד מהם נדרשת תשובה אחרת, ולשלושתם צריכה להיות תוכנית כתובה שמישהו קרא בשנה האחרונה.

לעומק

הפעילו תרגילי כשל מבוקרים: הפילו מופע, נתקו תלות, מלאו דיסק — בסביבה מבוקרת ובשעה ידועה. מערכת שמעולם לא נבדקה בכשל אינה עמידה, היא רק לא נבדקה.