1721585646
2024-07-21 12:39:58
今週末のグローバル ソフトウェア更新の失敗によって発生した IT 障害は、現代の IT インフラストラクチャの相互接続性と脆弱性を浮き彫りにしています。これは、単一障害点が広範囲にわたる影響を及ぼす可能性があることを実証しています。
の 停電 自動的に展開された単一のアップデートにリンクされていました クラウドストライク ファルコン、ユビキタスサイバーセキュリティツール 主に大規模な組織で使用されているこれにより、世界中の Microsoft Windows コンピューターがクラッシュしました。
CrowdStrike はその後、自社側でこの問題を解決しました。多くの組織は現在業務を再開できていますが、IT チームが影響を受けたすべてのシステムを完全に修復するにはしばらく時間がかかります。その作業の一部は手動で行う必要があります。
どうしてこんなことが起きたのでしょうか?
多くの組織が同じクラウド プロバイダーとサイバー セキュリティ ソリューションに依存しています。その結果、一種のデジタル モノカルチャーが形成されています。
この標準化は、コンピュータシステムが効率的に動作し、幅広い互換性を持つことを意味しますが、同時に 問題は連鎖的に起こる可能性がある 多くの業界や地域にまたがって広がっています。CrowdStrike の事例で確認したように、攻撃は世界中に波及する可能性があります。
現代のITインフラは高度に相互接続され、相互依存しています。1つのコンポーネントに障害が発生すると、そのコンポーネントが 連鎖反応 システムの他の部分に影響を与えます。
ソフトウェアとそれが動作するネットワークが複雑になるにつれて、予期しない相互作用やバグが発生する可能性が高まります。小さな更新でも予期しない結果が生じ、ネットワーク全体に急速に広がる可能性があります。
これまで見てきたように、監視者がそれを防ぐために反応する前に、システム全体が完全に停止してしまう可能性があります。
Microsoft はどのように関与しましたか?
あらゆる場所の Windows コンピュータが「ブルー スクリーン オブ デス」メッセージとともにクラッシュし始めたとき、初期のレポートでは、IT 障害は Microsoft が原因であると報じられました。
実際には、 マイクロソフトが確認 同社は、2024年7月18日木曜日の東部標準時午後6時(SAST午後12時)頃から、米国中部地域でクラウドサービスの停止を経験しました。
この停止は、さまざまな Azure サービスを使用している一部の顧客に影響を与えました。 アズール は、Microsoft 独自のクラウド サービス プラットフォームです。
Azureの障害は広範囲に及び、複数のセクターにわたるサービスに支障をきたしました。 航空会社、 小売り、銀行、メディア業界に被害が及びました。米国だけでなく、南アフリカやオーストラリアなどの国でも被害が及んでいます。また、PowerBI、Microsoft Fabric、Teams など、さまざまな Microsoft 365 サービスにも影響が及んでいます。
今では、Azure全体の停止は CrowdStrikeのアップデートに遡るこの場合、Falcon がインストールされた Windows を実行している Microsoft の仮想マシンに影響を及ぼしていました。
このエピソードから何を学べるでしょうか?
IT 関連のあらゆるものを 1 つのバスケットにまとめないでください。
企業はマルチクラウド戦略を採用すべきです。つまり、ITインフラを複数のクラウドサービスプロバイダーに分散させるのです。こうすることで、1つのプロバイダーがダウンしても、 他の人は続けることができる 重要な業務をサポートするため。
企業はまた、 彼らのビジネスは継続している ITシステムに冗長性を組み込むことで、1つのコンポーネントがダウンしても、他のコンポーネントが代わりに対応できます。これには、バックアップサーバー、代替データセンター、「フェイルオーバー停電が発生した場合にバックアップ システムに迅速に切り替えることができるメカニズムです。
日常的な IT プロセスを自動化すると、停止の一般的な原因である人為的エラーのリスクを軽減できます。自動化されたシステムは、潜在的な問題を監視して、重大な問題につながる前に対処することもできます。
スタッフのトレーニング 停電が発生したときの対応方法 困難な状況を正常な状態に戻すことができます。これには、誰に連絡すればよいか、どのような手順を踏めばよいか、代替ワークフローをどのように使用すればよいかを知ることが含まれます。
IT 障害はどの程度深刻になる可能性があるでしょうか?
インフラストラクチャの分散型および非中央集権型の性質により、世界中のインターネット全体がダウンする可能性はほとんどありません。複数の冗長パスとシステムがあります。一部に障害が発生した場合、トラフィックは他のネットワークを経由して再ルーティングされます。
しかし、CrowdStrike の障害よりもさらに大規模で広範囲にわたる混乱が発生する可能性は存在します。
考えられる原因のリストは、災害映画の脚本のようだ。 キャリントンイベント 1859年に発生したこの地震は、インターネットの基盤である衛星、電力網、海底ケーブルに広範囲にわたる被害をもたらす可能性がある。このような地震が発生すると、大陸をまたいで数か月間インターネットが利用できなくなる可能性がある。
世界のインターネットは、 海底光ファイバーケーブル自然災害、地震、事故、あるいは意図的な妨害行為などにより、複数の主要ケーブルが同時に損傷すると、国際的なインターネットトラフィックに大きな混乱が生じる可能性があります。
ルート DNS サーバーや主要なインターネット エクスチェンジ ポイントなどの重要なインターネット インフラストラクチャを標的とした、高度で組織的なサイバー攻撃も、大規模な障害を引き起こす可能性があります。
インターネットが完全に崩壊する可能性は非常に低いですが、デジタル世界は相互につながっているため、大規模な障害が発生すると、私たちが頼りにしてきたオンライン サービスが中断されるため、広範囲にわたる影響が生じます。
世界的な通信インフラの回復力を確保するには、継続的な適応と準備が極めて重要です。![]()
- 著者のデイビッド・タフリーは、グリフィス大学の応用倫理学とサイバーセキュリティの上級講師である。
- この記事は以下から転載されています 会話 クリエイティブ・コモンズ・ライセンスの下で
次に読む: CrowdStrike Falcon によってコンピューターがブロックされました。何が起こったのか、そしてそれを修復するにはどうすればよいのか
#CrowdStrikeの災害はタイムリーな警告を発している