تابآوری واقعی، تصمیمگیری قهرمانانه در آخرین لحظه در طول یک بحران نیست. این آمادگی بیروح و منظمی است که از قبل انجام شده است.
من سالها به شرکتهای بزرگ کمک کردهام تا از قطعیهای فاجعهبار بهبود یابند: خرابیهای ابری، خاموشیهای منطقهای، طوفانها، سیلها و بله، طوفانهای زمستانی. چیزی که دیگر برای من تعجبآور نیست این است که محیطهای فناوری اطلاعات مدرن بسیار شکنندهتر از آن چیزی هستند که اکثر تیمهای رهبری حاضر به پذیرش آن هستند.
یک طوفان زمستانی نیازی به “آخرالزمانی” بودن ندارد تا خسارت واقعی ایجاد کند. قطعی برق طولانی، زیرساختهای یخزده، دفاتر غیرقابل دسترس و قطعی اینترنت منطقهای میتواند عملیات را برای چند روز یا بیشتر فلج کند. تابآوری واقعی، تصمیمگیری قهرمانانه در آخرین لحظه در طول یک بحران نیست. این آمادگی بیروح و منظمی است که از قبل به خوبی انجام شده است.
در اینجا پنج روش عملی وجود دارد که شرکتها میتوانند قبل از رسیدن طوفان بعدی، وضعیت پشتیبانگیری و بازیابی از فاجعه خود را تقویت کنند.
1. تنوع منطقهای واقعی را بپذیرید
تکیه بر یک مرکز داده واحد یا حتی یک منطقه ابری واحد، یک قمار است. بخش قابل توجهی از خرابیهای مراکز داده هنوز به قطعی برق ناشی از آب و هوا برمیگردد. اگر یک طوفان زمستانی بزرگ، یک منطقه در دسترس را از کار بیندازد، برنامههای شما صرف نظر از اینکه Hyperscaler شما چند “نه” وعده میدهد، از کار میافتند.
همچنین در پنج سال گذشته شاهد بودهایم که وابستگیهای زیرساخت منطقهای به طور مکرر از کار افتادهاند. وابستگیهای شبکه بین مناطق ابری به این معنی است که وقتی یک منطقه از کار میافتد، میتواند مناطق به هم پیوسته را با خود ببرد. خود AWS نمیتواند در دسترس بودن را در یک منطقه تضمین کند. آن SLA 99.5٪ وجود دارد زیرا سرویسهای اصلی به مناطق خاص مراجعه میکنند. این واقعیت معماری به زودی تغییر نخواهد کرد و اگر به یک ابر واحد، چه رسد به یک منطقه واحد، متکی باشید، کارهای زیادی میتوانید انجام دهید.
راه حل: مطمئن شوید که سایت failover شما در یک منطقه جغرافیایی کاملاً متفاوت قرار دارد و میتواند به طور خودکار فعال شود. اگر بازیابی در طول طوفان نیاز به مداخله انسانی داشته باشد، طرح شما از قبل بسیار شکننده است. ابزارهایی را انتخاب کنید که بازیابی فاجعه را ساده کرده و بازیابی فوری از یک مکان ایزوله را تضمین میکنند.
تبلیغات
۲. بدون پرداخت دو بار هزینه، دادههای خود را در خارج از سایت، از حالت Air-Gap خارج کنید
قرار دادن تمام نسخههای پشتیبان خود در همان ابری که تولید را انجام میدهد، نقطه تابآوری را از بین میبرد. کل مناطق ابری میتوانند و در واقع از دسترس خارج میشوند. اما بسیاری از تیمهای فناوری اطلاعات به دلیل پیچیدگی و هزینههای سنگین خروج، از پشتیبانگیری چند ابری اجتناب میکنند. راه حل: ابزارهای مدرن اکنون به تیمها اجازه میدهند دادهها را در AWS و Azure یا در ذخیرهسازی شیء بسیار کمهزینه برای مدت طولانی بدون پراکندگی عملیاتی یا صورتحساب مضاعف، تکرار کنند.
حتی بهتر از آن، پلتفرمهای امروزی میتوانند Air-Gapهای واقعی و منطقی را در ابرهای جداگانه مانند ذخیرهسازی کمهزینه Wasabi ایجاد کنند که دادههای شما را در یک محیط جداگانه و بدون نیاز به یک زیرساخت کامل دوم، ایزوله میکند. این راهحلها همچنین بر تغییرناپذیری تأکید دارند و تضمین میکنند که پس از دریافت دادههای پشتیبان، حتی توسط اعتبارنامههای به خطر افتاده یا افراد داخلی مخرب، قابل تغییر، رمزگذاری یا حذف نیستند. شرکتها میتوانند به سرعت از این مکانها بازیابی شوند، حتی اگر طوفان زمستانی یا قطعی منطقهای کل ابر را آفلاین کند.
هدف این است که وقتی ابر اصلی شما غیرقابل دسترس میشود، دادههای شما نیز با آن ناپدید نشوند.
۳. انتظار حملات سایبری پس از طوفان را داشته باشید و برای آنها برنامهریزی کنید
هم FBI و هم CISA دائماً هشدار میدهند که کمپینهای فیشینگ و باجافزار پس از رویدادهای مهم آب و هوایی افزایش مییابند. مهاجمان میدانند که تیمهای فناوری اطلاعات حواسشان پرت است، گردش کار مختل شده و کارمندان تشنه بهروزرسانی هستند.
راه حل: این فراتر از آموزشهای آگاهیبخشی اولیه است. قبل از شروع زمستان، شبیهسازیهای فیشینگ با موضوع طوفان مانند اعلانهای جعلی «بازگرداندن برق»، «هشدارهای آب و هوایی» یا «بهروزرسانیهای اضطراری منابع انسانی» را اجرا کنید. ارتباطات داخلی را از قبل مرحلهبندی کنید تا کارمندان دقیقاً بدانند که بهروزرسانیهای قانونی در طول قطعی برق از کجا میآیند. و از همه مهمتر، اطمینان حاصل کنید که نسخههای پشتیبان جدا، تغییرناپذیر و غیرقابل لمس هستند، حتی اگر اعتبارنامهها به خطر افتاده باشند.
۴. برای قطع برق در لایه انسانی برنامهریزی کنید
ابر شما ممکن است در حال اجرا باشد، اما اگر افراد شما در حال اجرا نباشند چه اتفاقی میافتد؟ اگر کارکنان کلیدی برای چند روز برق نداشته باشند، نتوانند به اسناد دسترسی داشته باشند یا از شبکههای خانگی ناامن کار کنند، چه میشود؟
راه حل: انعطافپذیری شامل در دسترس بودن نیروی انسانی است. تیمها را آموزش متقابل دهید، نقشهای حیاتی را در مناطق مختلف توزیع کنید و مطمئن شوید که اسناد ضروری به صورت آفلاین قابل دسترسی هستند. دسترسی VPN و MFA را برای کار از راه دور اعمال کنید – و فرض کنید امنیت دفتر کار خانگی در طول قطعیهای طولانی کاهش مییابد.
همچنین ارزش دارد فراتر از ابزارهای سنتی فکر کنید. اگر Slack، ایمیل یا شبکههای تلفن همراه از کار بیفتند، گزینههای ارتباطی “خارج از شبکه” مانند MeshTastic یا پیامرسانی نظیر به نظیر میتوانند تیمها را در هنگام تاریکی هماهنگ نگه دارند.
5. آب و هوای شدید را به عنوان یک ریسک تجاری – نه یک مشکل فناوری اطلاعات – در نظر بگیرید.
در کشورهایی مانند سوئد و انگلستان، دولتها آشکارا برای اختلالات خدمات چند هفتهای برنامهریزی میکنند. شرکتها باید همین طرز فکر را اتخاذ کنند.
آمادگی مؤثر برای اختلال در درازمدت باید شامل موارد زیر باشد:
آزمایشهای منظم و برنامهریزیشده که جدولهای زمانی ناخوشایند و بدترین حالت را مدلسازی میکنند.
اثبات سازگاری کامل با محیط






Reviews
There are no reviews yet.