我正在考虑建立一个支持SLA的系统。作为一条基线,我想大致了解一个非集群Windows2003Server所期望的可用性百分比。
假设服务器为它正在运行的应用程序提供了很好的规范(所以它不会费力),而在正常运行时,我的意思是服务器是可用的。它需要进行reasonalbe一般维护(安全修补等)。
人们会期望什么?
发布于 2009-07-06 12:39:10
在起草SLA时,更重要的是在设备和预算的限制下,与客户达成一致,他们期望(并负担得起)与您愿意支持的东西。
例如:一个单一的非集群服务器不适合于一个客户,它需要99.999%的正常运行时间和24小时的待命支持,以及在重大故障时需要1小时的“返回操作”。接受这一点在技术上是不合理的,客户需要理解这一点。
是的,Windows2003Server是可靠的,可以很好地执行。品牌服务器具有经验证的可靠性和坚固可靠的保证。服务器上的定期监视和TLC可以使它持续许多年。
你需要“抱最好的希望,但要做最坏的打算”。
您还需要准确地计算您的可用性统计数据,并得到与客户一致的计算结果(凌晨2点1小时的停机时间与周二上午11点的“成本”不同)。
您将需要合并保持服务器活动所需的所有附加设备(网络、交换机、防火墙、操作员时间、备份)。
最后,您需要测试您的应急计划,并保持基础设施的灵活性,这样您就可以通过几种不同的方式解决故障。
发布于 2009-07-06 09:34:56
没有一个标准的数字,我们可以引用您,服务器2003本身是一个非常稳定的系统,但您可以期望的正常运行时间取决于许多可变的因素。
理论上,您需要使服务器离线的唯一方法是应用更新,更新最多每周一次。您可以通过计时服务器重新启动所需的时间来计算这些服务器的停机时间。
理论上这一切都很好,但我们都知道服务器也因为其他原因而离线,硬件故障、网络问题、软件挂起,这些都不是你可以轻易预测的事情,但最好能及时适应不可预测的事件。
最后,您要考虑到计划中的升级或更改的时间,服务器的使用是否会随着时间的推移而增加,它是否需要升级以应对更改?
所有这些因素都会给你预期的正常运行时间,如果你没有错误,而不是升级等等,那么你的实际正常运行时间可能会比这更好,但最好是谨慎。
发布于 2009-07-06 09:42:24
根据我使用Server 2003标准R2的经验,我可以告诉您,如果您没有任何硬件/网络故障,它是很高的。
运行Server 2003的2台服务器从未单独崩溃过一次。一个服务器有240天的记录正常运行时间!请注意:这是因为他们从未在系统上安装更新。
要想使2003年从正常运行中崩溃需要很长时间。
https://serverfault.com/questions/36241
复制相似问题