Ein Missverständnis beim HA Admission Control Cluster Resource Percentage
Beim Arbeiten an meinem VCDX-Design bin ich über HA Admission Control gestolpert. Mit vSphere 6.5 kam «Cluster resource percentage» dazu. Klingt einfach, ist es nicht.
Dieser Beitrag ist von 2018. Er bleibt online, weil er nach wie vor nachgefragt wird, beschreibt aber einen Produktstand von damals.
Beim Arbeiten an meinem VCDX-Design bin ich heute über HA Admission Control gestolpert. Mit VMware vSphere 6.5 kam “Cluster resource percentage” dazu. Damit wählst du, wie viele Host-Ausfälle toleriert werden sollen, und vSphere rechnet den Prozentsatz der entsprechenden Reservation selbst aus. Klingt einfach. Ist es nicht, wenn du dir die Details dieser Konfiguration ansiehst.
In meinem Designvorschlag wollte ich HA Admission Control nutzen, um sicherzustellen, dass für einen Site-Failover genug Ressourcen frei bleiben. Ich habe HA Admission Control so eingestellt, dass 50 % der Ressourcen für den Failover reserviert bleiben. Als ich das in meiner VCDX-Vorbereitungsgruppe erwähnte, fragte mich jemand, ob ich auf den VMs Resource Reservations verwende. Tue ich nicht, und aus mehreren Gründen wollte ich das auch nicht.
Die Frage machte mich neugierig, also habe ich mir die Berechnung hinter der Einstellung genauer angesehen. Es zeigt sich: Die Berechnung ignoriert die konfigurierten Ressourcen, ausser sie sind reserviert. Ist das nicht der Fall, nimmt HA an, dass 32 MHz und 0 MB RAM pro VM reichen, dazu der Overhead für den Betrieb dieser VM. Mit dieser sehr tiefen Annahme funktioniert HA Admission Control nicht so, wie ich es für mein Design gedacht hatte. Im schlimmsten Fall liesse es deutlich mehr VMs starten als vorgesehen und liesse mir im Katastrophenfall zu wenig Ressourcen für die geschützten Workloads.
Der Kollege aus meiner VCDX-Gruppe, der ebenfalls an seiner Einreichung arbeitet, riet mir, HA Admission Control wegzulassen und es nur als Rückfalllösung zu erwähnen, falls doch reserviert wird.
Hier die Links zur Dokumentation:
VMware HA Admission Control – Cluster Resource Percentage
Ein möglicher Workaround ist, die Werte für die minimalen MHz und MB RAM höher zu setzen. Das geht pro Cluster in den HA Advanced Settings mit diesen zwei Einstellungen:
das.vmcpuinmhz
das.vmmemoryinmb
Hier stehen die Details zu diesen Advanced Settings.
Ich wollte diese Lektion einfach weitergeben. Im Kern: Prüf jede Konfiguration in der offiziellen Dokumentation nach, damit sie auch wirklich das tut, was du annimmst. Das erspart dir später unangenehme Fragen.