我有一个由12个ESX主机(ClusterA)组成的vcenter集群,还有一个由3个ESX主机(ClusterB)组成的集群。所有这些都是poweredge r620s和r630s的混合体。
一些主机有硬件错误,可以在iDRAC日志和液晶显示屏幕前看到,例如:
修复这些硬件错误通常涉及以下步骤:
ClusterB很好-从来没有问题。我面临的真正问题是,当我从ClusterA修复两个主机时,ClusterA中的1-3个随机主机将在一两天内崩溃。在最初的1-3次崩溃之后,如果我把事情放在一边,几周后就不会再有主机崩溃了。这使我回到了我开始的地方,我已经观察到这种行为好几次了。
有什么好查的吗?
发布于 2022-06-20 21:02:23
R620 / R630非常老,所以对于初学者来说,他们可能只是处于最后一条腿上,并且有合法的硬件故障。也就是说,有可能导致这些问题的事情:
https://serverfault.com/questions/1101807
复制相似问题