Então, depois de trazer um terceiro sistema para o mix e experimentar o mesmo problema, começamos a questionar o ambiente. Eu desenterrei uma cópia do Guia de resolução de problemas dos servidores HP ProLiant e localizou o fluxograma de problemas do POST mostrado abaixo.
Examinando cuidadosamente as etapas do gráfico, percebemos que a única constante em todos os servidores era um comutador KVM conectado ao carrinho de colisão do datacenter. Este era um KVM habilitado para USB de classe de consumo. De acordo com o nó realçado no fluxograma, Você conhece um bom KVM? , não consegui responder de forma conclusiva.
Então, desconectamos os servidores do switch KVM e executamos uma inicialização automatizada, sleep 300; reboot sequence em rc.local . Os servidores não tiveram problemas com isso, independentemente do DIMM normal, DIMMs de baixa voltagem, potência da fonte de alimentação, etc.
Isso foi tudo resultado de uma interação ruim com um comutador KVM USB. Em virtude de que este era o console, ele garantiu que veríamos o fracasso se estivéssemos procurando por ele. Auto-realizável ...
