虚拟机宕机
xenserver吧
全部回复
仅看楼主
level 11

1:那2台主机发生Crash dump的原因是什么?
[Penny] 刚发了信详细解释了原因,简单来说就是发生问题时那两台主机跟存储之间的连接有问题从而导致访问存储心跳超时,触发了HA的自我保护机制(强制主机crash并重启);
那两台主机与存储之间的连接问题从log看更像是硬件(HBA卡)或者驱动/固件的问题,在另一封信中有详细的建议
2:虚机宕机是Crash dump引起的吗?这个pool有其它主机是活着的,为什么没迁移到其它主机上?(已经配置WLB、HA)
[Penny] 虚机宕机的问题现在不重现,之前有问题时间的log也没有保存到现在,因此这个问题现在没法下定论。仅从描述来看,跟本case的问题也不是同一个,以后如果问题重现了请肖工另开case追踪。
3: 如何避免以后出现类似的问题?
[Penny] 从本次的分析来看,生成crash dump的最根本的原因可能还是存储的HBA卡硬件或者驱动/固件的问题引起的,应着重解决这块的问题,建议在另一封信中。
对于其他的生成crash dump的原因则只能case by case地分析,解决
从log中来看,是XenServer跟存储之间的通信有问题。
根据log的分析,需要检查以下几个方面:
---
After verifying the qlogic driver and firmware versions match that required by your storage vendor, update if needed, I would start troubleshooting the hardware.
- FC-CABLE (make sure it is not looped too tight), swap with another.
- GBIC.
- FC-SWITCH port, check for errors, switch to alternate port.
- FC-HBA, replace.
If this is a blade, check enclosure interface to FC.
---
之前在其他客户那边出现这种问题多是HBA卡出错,如果确定不是HBA卡的问题,则需要从上面的其他方面去考虑。
2013年06月14日 02点06分 1
level 3
原来是是XenServer跟存储之间的通信有问题,希望以后可以避免出现类似的问题啊。
---------------------------------------------------------------------------------
爱他,就带她来南京看瀑布
2013年06月24日 03点06分 2
1