发生服务器故障后,首先通过SSH远程登录Linux服务器(占90%以上生产场景),打开本地终端直接执行命令:
``` ssh 你的服务器账号@你的服务器公网IP -p 你的SSH端口 默认SSH端口为22,可省略-p参数 ```登录成功后,立即执行3个基础命令,快速定位故障方向:
top -bn1,看第一行load average,如果三个值都大于服务器CPU核心数,说明是负载过高故障df -h,看根分区/的使用率,如果超过90%,说明是磁盘占满故障ping 114.114.114.114 -c 3,如果丢包率超过50%,说明是网络类故障执行top命令,按P键按CPU使用率排序,找到占用资源最高的异常进程,记录进程ID(PID),按以下步骤处理:
处理完成后,再次执行top -bn1确认负载降到CPU核心数以下,即可完成恢复。
确认根分区占满后,执行以下命令快速找到占用空间最大的文件:
``` 列出根分区下所有大于100M的文件,按大小倒序排序 find / -type f -size +100M -exec ls -lh {} \; | sort -k5 -hr | head -20 ```kill -USR1 `cat /var/run/nginx.pid`,Java应用无需额外操作。/tmp目录下超过7天未访问的临时文件,执行命令:
```
find /tmp -type f -atime +7 -delete
```

处理完成后执行df -h确认根分区使用率降到80%以下即可。
首先检查服务器本地防火墙规则,执行对应命令查看开放端口:
``` CentOS/RHEL系 firewall-cmd --list-ports Debian/Ubuntu系 ufw status ```故障处理完成后,必须完成两步验证确保业务完全恢复:
故障恢复后,添加两个简单配置即可避免80%同类故障重复发生,全部可直接复制执行:
/etc/logrotate.d/nginx(其他应用修改路径即可),填入完整配置:
```
/var/log/nginx/log {
daily
rotate 10
missingok
notifempty
compress
sharedscripts
postrotate
[ -s /run/nginx.pid ] && kill -USR1 `cat /run/nginx.pid`
endscript
}
```
配置会自动每日切割压缩日志,只保留10天日志,从根源避免日志占满磁盘。按照以上流程操作,普通故障从排查到恢复一般不超过10分钟,所有命令和配置都可以直接复制使用,不需要额外修改适配。












易频IT社区是综合性互联网IT技术门户网站,专注分享网络技术、服务器运维、网络安全、编程开发、系统架构、云计算、大数据等行业干货,实时更新IT行业资讯、零基础教程、实战案例,为IT从业者、技术爱好者提供专业的学习交流平台。
Copyright © 2021-2026 易频IT社区. All Rights Reserved. 备案号:闽ICP备2023013482号 网站地图