服务器故障排除的原则与方法
发布时间:1319522604 作者:Reton技术部.Lu
相比PC而言,服务器出故障的机率是小多了,但是它出故障造成的损失可也大多了。作为服务器维修人员需要了解一些服务器故障恢复的基本知识,知道在维修时可以做些什么,以便用最快速的解决问题,减少故障停机时间。本文并不是一本服务器故障解决的完全手册,但如果能够认真的按照下面的步骤维修维护,它也许可以解决大多数问题
一、服务器开机无显示应怎么办?
1、检查供电环境,零-火;零-地电压
2、检查电源指示灯,如果亮,正常吗
3、按下电源开关时,键盘上指示灯亮吗?风扇全部转动吗
4、是否更换过显示器,更换另一台显示器
5、去掉增加内存
6、去掉增加的CPU
7、去掉增加的第三方I/O卡
8、检查内存和CPU 插的是否牢靠
9、Clear CMOS
10、更换主要备件,如系统板,内存和CPU
二、服务器故障排除的基本原则是什么?
1、尽量恢复系统缺省配置
a:硬件配置:去除第三方厂商备件和非标配备件
b:资源配置:清除CMOS,恢复资源初始配置
c:BIOS,F/W,驱动程序:升级最新的BIOS,F/W和相关驱动程序
d:TPL:扩展的第三方的I/O卡属于该机型的硬件兼容列表(TPL)吗
2、从基本到复杂
a:系统上从个体到网络:首先将存在故障的服务器独立运行,待测试正常后再接入网络运行,观察故障现象变化并处理
b:硬件上从最小系统到现实系统:指从可以运行的硬件开始逐步到现实系统为止
c:软件上从基本系统到现实系统:指从基本操作系统开始逐步到现实系统为止
3、交换对比
a:在可能相同的条件下,交换操作简单效果明显的部件
b:交换NOS载体,既交换软件环境
c:交换硬件,既交换硬件环境
d:交换整机,既交换整体环境
三、服务器故障排除需要收集哪些信息
服务器信息:
1、机器型号
2、机器序列号(S/N:如:NC00075534)
3、Bios 版本
4、是否增加其它设备,如网卡,SCSI 卡,内存,CPU
5、硬盘如何配置,是否做阵列, 阵列级别
6、安装什么操作系统及版本(Winnt 4, Netware, Sco, others)
故障信息:
1、在POST时,屏幕显示的异常信息
2、服务器本身指示灯的状态
3、报警声和BEEP CODES
4、NOS的事件记录文件
5、Events Log 文件
确定故障类型和故障现象:
1、开机无显示
2、上电自检阶段故障
3、安装阶段故障和现象
4、操作系统加载失败
5、系统运行阶段故障
【在百度搜索更多 服务器故障排除的原则与方法】