获取验证码
ESXi 9.0安装完成,vSAN Skyline健康检查报磁盘组配置警告,集群可以运行,但存在配置风险,部分存储策略合规性异常,虚拟机可能出现重新平衡、同步告警。
有VMware全系列产品官方资源和定制版资源需求的可以移步:
OSA架构磁盘组不满足1块缓存SSD+1块及以上容量盘硬性组合;ESA模式磁盘介质、扇区、硬件不在HCL兼容列表;缓存SSD磨损临近阈值;磁盘残留旧vSAN元数据分区;磁盘组布局版本不匹配大硬盘要求;集群内磁盘扇区大小混用触发警告。
第一步:校验磁盘组成员硬件组合
进入vCenter集群→配置→vSAN磁盘管理,逐个检查每台主机磁盘组。OSA架构每个磁盘组必须拥有1块SSD作为缓存层,搭配1块或多块HDD/SSD容量盘,不允许缺少缓存盘、全部为容量盘,不允许一个磁盘组多块缓存SSD。
ESA架构全部使用NVMe闪存介质,确认所有磁盘在vSAN ESA HCL硬件兼容清单,不要使用消费级NVMe盘,RAID卡需要切换为直通模式,不允许RAID模式下透传磁盘给vSAN。
第二步:检查缓存SSD剩余耐久寿命
查看SSD的Media Wearout Indicator磨损指标,剩余寿命低于20%触发警告,低于10%强烈建议更换磁盘。ESXi SSH执行命令查看磁盘SMART磨损信息,磨损过高直接更换缓存盘,缓存SSD故障会直接导致整个磁盘组不可用。
第三步:磁盘扇区与布局版本校验
vSAN9.0 ESA模式不建议集群内部混用512N与4KN扇区规格磁盘,混合部署会触发配置警告。大容量磁盘需要64bit磁盘组布局,旧32bit布局会弹出警告,需要开启主机维护模式,数据疏散后重建磁盘组完成升级布局版本。
第四步:清理磁盘残留旧元数据分区
重装ESXi后磁盘残留历史vSAN分区,会造成磁盘识别异常、幽灵磁盘,导致磁盘组配置警告。主机进入维护模式,疏散磁盘组全部数据,移除磁盘组,清除磁盘所有分区标签,之后重新创建磁盘组。
第五步:重建磁盘组(高危操作)
确认集群FTT容错级别满足,有足够资源完成数据重建;主机开启维护模式,勾选疏散全部数据;删除告警磁盘组;校验磁盘无残留分区;按照规范重新创建磁盘组;退出维护模式,等待vSAN组件全部重新同步完成,重新运行Skyline健康检查验证警告清除。
删除磁盘组前必须完成数据疏散,不疏散直接删除磁盘组会造成数据丢失。启用重删压缩环境,磁盘组内任意单盘异常,会让整个磁盘组离线。操作前确认集群对象健康,无不可访问对象,可执行esxcli vsan debug object health summary get查看对象状态。
集群全部节点ESXi版本保持一致;vSAN磁盘全部使用VMware HCL认证企业级硬件;定期监控SSD耐久磨损;ESA集群统一磁盘扇区规格;重装系统务必清除磁盘旧vSAN分区;磁盘组配置完成后手动执行一次完整vSAN健康校验。
esxcli vsan storage list esxcli vsan debug object health summary get esxcli storage core device smart get -d naa.xxx