アクティブ・アクティブデータセンターに関する一般的な説明は、冗長性に焦点を当てています。一方のサイトが障害になったら、もう一方がシームレスに引き継ぐ、というものです。しかし、中国の開発者コミュニティからのこの記事が指摘するように、実際の課題はデータの局所性です。2つのアクティブサイトがある場合、重要な問題は、すべてのトランザクションでデータがネットワークを越える必要がないようにすることです。記事では、ある企業のビジネス全体が単一のデータセンターに依存しており、計画的なネットワーク切り替えの際には、エンジニアが不安定の兆候を監視しながら総出で対応した事例が紹介されています。1時間の停止は数千万円の損失になると見積もられました。解決策は明白に見えます。2つのサイトを実行し、一方が障害になったらもう一方が引き継ぐことです。しかし、実装は決して簡単ではありません。データがそれを必要とするコンピューティングのローカルにない場合、レイテンシとネットワーク依存が発生し、元の問題よりも悪化する可能性があります。この洞察は、回復力のあるシステムを設計するアーキテクトにとって重要であり、焦点を「フェイルオーバーする方法」から「データを処理される場所の近くに保つ方法」に移します。
アクティブ・アクティブデータセンターの実際の課題は、フェイルオーバーではなくデータの局所性にあることを、実例とコストの観点から解説。