Resumen
Cuando se usa la característica drain-roles en el sistema operativo de Azure Stack HCI, versión 21H2 o 22H2, puede producirse un error de purga de nodo en escenarios de clústeres grandes (como ocho o más clústeres) debido a un tiempo de espera cuando el almacenamiento se pone en modo de mantenimiento. Este problema se produce especialmente al actualizar el sistema operativo de Azure Stack HCI.
Más información
Para resolver el tiempo de espera de error de purga, siga estos pasos:
- Antes de habilitar el modo de mantenimiento o cualquier operación que implique un modo de mantenimiento, como el purgado de nodos o la actualización compatible con clústeres, aumente primero el intervalo de análisis de discos físicos del servicio de mantenimiento. Para ello, cambie la configuración de mantenimiento mediante la ejecución del siguiente comando:
get-storagesubsystem Cluster* | set-storagehealthsetting -name System.Storage.PhysicalDisk.CheckPeriodMs -Value10800000
Nota En este ejemplo, aumentamos el valor de quince minutos a tres horas. Sin embargo, debe ajustar este valor para asegurarse de que es más largo que la duración esperada del flujo de trabajo que implica el modo de mantenimiento. - Espera hasta que finalicen los exámenes en curso. La duración exacta depende del entorno. En un clúster de 16 nodos, puede tardar entre 40 y 60 minutos en finalizar. Para comprobar que han finalizado todos los exámenes existentes, compruebe el registro del servicio de mantenimiento en el nodo propietario del "Grupo SDDC" y busque el patrón:
'Maintenance Mode Event Interpreter' está interpretando Tipo de evento - Origin 'Storage', EntityType 'SPACES_PhysicalDisk.
Nota Si no hay tal entrada en el último minuto, significa que todos los exámenes han finalizado. El registro de estado se puede recuperar ejecutando el siguiente comando:
Get-ClusterLog -Destination . -TimeSpan 5 -UseLocalTime -Health - Ejecute una operación en modo de mantenimiento u otro flujo de trabajo que implique el modo de mantenimiento.
- Revertir la configuración de mantenimiento a su configuración original. Esto es importante, ya que un intervalo largo podría causar algún retraso en determinadas funcionalidades del servicio de estado, como errores relacionados con el disco físico o la retirada. Para revertir la configuración de estado, ejecute el siguiente comando:
get-storagesubsystem Cluster* | remove-storagehealthsetting -name System.Storage.PhysicalDisk.CheckPeriodMs
Referencias
Procedimientos de mantenimiento del clúster de conmutación por error
Obtenga información sobre la terminología estándar que se usa para describir las actualizaciones de software de Microsoft.