آنچه در این مقاله میخوانید
در تاریخ ۱۹ ژوئیه اختلال گستردهای در دنیای فناوری رخ داد که در سراسر جهان پیامدهایی در پی داشت: زمان پروازها به تعویق افتاد، پزشکان نتوانستند به پرونده سوابق بیماران دسترسی پیدا کنند، شرکتها در فرایند مکاتبه و تجارت خود دچار اختلال شدند و سیستمهای بانکی برخی از کشورها نیز از انجام تراکنشها باز ماندند. این آشوب به علت وقوع نقص در بهروزرسانی محتوا CrowdStrike Falcon در بستر ویندوز به وجود آمد. خبرگزاری بیبیسی گزارش داد که ۸.۵ میلیون دستگاه درگیر این مسئله شدند.
پیامدهای این رخداد در بسیاری از سازمانها به توقفهای گسترده منجر شد و برخی از کسبوکارها هنوز هم نتوانستهاند میزان خسارت ناشی از این اختلال را کامل برآورد کنند.
تجربه ثابت کرده است تاریخ، زمانی تکرار میشود که ما از آن درس نگیریم. هدف از این مقاله اشاره به نکاتی است که سازمانها میتوانند از این رخداد بیاموزند. مهم است که از این حادثه درس عبرت بگیریم و اقداماتی پیشگیرانه انجام دهیم که در آینده از اثرات چنین پیشامدهایی بکاهیم.
۱. اصول پایه را ساده نگیرید
امروزه ما همواره در جستوجوی فناوریهای پیشرو و جدید نظیر هوش مصنوعی، رایانش کوانتومی و… هستیم اما همچنان باید گوشهچشمی به اصول پایه حاکمیت فناوری اطلاعات داشته باشیم. چنین اصولی شامل سیاستها و فرآیندهای غیرقابلنفوذ است. همان اختلال بزرگ فناوری که کسبوکارهای جهان را تحت تأثیر قرار داد تنها به خاطر بهروزرسانی اشتباه سیستمی صورت گرفت. جالبتوجه است که این اتفاق بدون استفاده از هرگونه حملات سایبری یا دیپفیک مبتنی بر هوش مصنوعی رخ داد. در نتیجه حائز اهمیت است که اصول پایه حاکمیت فناوری اطلاعات را ساده نگیرید.

۲. فرآیند تغییر را درست مدیریت کنید
مدیریت تغییرات فرآیندی بسیار قدیمی در حاکمیت فناوری اطلاعات به شمار میآید. هدف از مدیریت تغییرات این است که تغییرات در سیستمهای فناوری اطلاعات، زیرساختها یا برنامهها پس از قبولی در آزمونها و دریافت تأییدیه در محیط عملیاتی عملی شوند. گاهی مواقع کسبوکارها نیاز دارند برخی از محصولات را زودتر به مشتریان ارائه کنند. در چنین شرایطی تصمیم بر این میشود که موقتاً از فرآیند مدیریت تغییرات چشمپوشی کنند. چنین سرپیچیهایی میتوانند پیامدهایی فاجعهبار به دنبال داشته باشند.
۳. مدیریت پچها را در اولویت قرار دهید
پچ در حیطه فناوری اطلاعات کاربردهای گوناگونی دارد. برخی از کاربردهای پچ این است که باگها را رفع کند یا آسیبپذیریهای امنیتی را کاهش دهد. در مواقع دیگر پچها در فرآیند بهبود قابلیتها، سهولت استفاده، ارتقا عملکرد برنامه یا دستگاه مفید واقع میشوند. اگر مدیریت پچها به خوبی انجام شود نسخ جدید بر اساس رویههای از پیش تعیینشده آزمایش میشوند تا علاوه بر رفع مشکلات از وقوع مشکلاتی دیگر جلوگیری کنند. بسیاری از تیمهای عملیاتی این اشتباه را مرتکب میشوند که پچها را کامل آزمایش نمیکنند. به همین دلیل آنها نمیدانند که ممکن است آسیبپذیری احتمالی جدیدی در محیط فناوری اطلاعات رخنه کند.
۴. سرویس بازیابی از بحران خود را بسنجید
سرویسهای بازیابی از بحرانی که بهدرستی اجرا میشوند به سازمانها، کسبوکارها یا نهادهای دولتی کمک میکنند تا در حین وقوع و پس از بحران، وظایف اساسی خود را انجام دهند. سرویسهای بازیابی از بحران از اثرات مخرب بحران بر عملیات سازمان میکاهند و تضمین میکنند که فعالیتها و فرآیندهای حیاتی کسبوکار در حین وقوع بحران و پس از آن ادامه یابند. این سرویس معمولاً از چهار مرحله تشکیل میشود:
۱. پیشگیری از بحران
۲. آمادگی مقابله با بحران
۳. پاسخدهی حین بحران و پس از بحران
۴. بازیابی از بحران

حائز اهمیت است که سازمانها این سرویسها را منظم بسنجند تا پیشامدهایی همانند آنچه که در شرکت CrowdStrike رخ داد گریبانگیر آنان نشوند و در صورت وقوع بحران سازمانها بتوانند فرآیندهای اصلی خود را همچنان فعال نگه دارند.
همین امروز، زیرساخت خود را از بحرانها بیمه کنید:
- اختلال CrowdStrike چه بود و چرا میلیونها دستگاه را تحت تأثیر قرار داد؟
اختلال CrowdStrike در پی انتشار یک بهروزرسانی معیوب برای حسگر Falcon در سیستمعامل ویندوز رخ داد. این بهروزرسانی باعث از کار افتادن میلیونها دستگاه در سراسر جهان شد و اختلال گستردهای در خدمات بانکی، حملونقل، درمانی و کسبوکارها ایجاد کرد.
- چگونه میتوان از تکرار اختلالهای ناشی از بهروزرسانیهای اشتباه جلوگیری کرد؟
برای کاهش احتمال وقوع اختلالهای ناشی از بهروزرسانی، سازمانها باید فرآیند مدیریت تغییرات و مدیریت پچ را بهدرستی اجرا کنند. آزمایش بهروزرسانیها در محیط آزمایشی، استقرار مرحلهای و داشتن برنامه بازگشت (Rollback) از مهمترین اقدامات پیشگیرانه هستند.
- در زمان وقوع اختلال گسترده زیرساختی، سرویس بازیابی از بحران چه نقشی دارد؟
سرویس بازیابی از بحران (DR) به سازمانها کمک میکند در زمان وقوع اختلال، سرویسهای حیاتی خود را فعال نگه دارند و در کوتاهترین زمان ممکن عملیات را بازیابی کنند. وجود برنامه بازیابی از بحران آزمایششده میتواند از توقف طولانیمدت کسبوکار و خسارتهای مالی جلوگیری کند.
این مقاله را به اشتراک بگذارید