vSAN streched cluster & Rack awarness

Un cliente ha richiesto la realizzazione di un’infrastruttura vSphere/vSAN Cluster distribuita su due siti, ciascuno composto da tre rack, con i seguenti requisiti operativi:

  1. In caso di indisponibilità di un intero sito, le macchine virtuali devono essere riavviate automaticamente sull’altro sito tramite meccanismi di High Availability (HA).
  2. In caso di guasto di un singolo rack, le macchine virtuali devono essere riavviate all’interno dello stesso sito, senza impatto sul sito secondario.

Il primo requisito può essere soddisfatto implementando un vSAN Stretched Cluster, che consente la replica sincrona dei dati fra i due siti e garantisce il failover automatico tramite HA.

Per il secondo requisito, la funzionalità vSAN Fault Domains non risulta utilizzabile, poiché lo Stretched Cluster crea di default tre fault domains (i due siti e il witness) e non consente la definizione di sub-fault domains all’interno di ciascun sito.

Per risolvere questa esigenza, è stata valutata la creazione di più cluster locali, ciascuno costituito da due host per rack. Su tali cluster verrebbe poi applicata una storage policy con livello di resilienza secondario FTT = 2 / RAID-6, garantendo che i sei componenti dello stripe con parità siano distribuiti su sei host distinti del medesimo sito.

Con questa configurazione, in caso di guasto di un intero rack (e quindi di due host del cluster locale), la policy FTT=2 assicura comunque la disponibilità dei dati e la continuità operativa delle macchine virtuali.