参考消息
服务器资源检查需要同时观察使用率、等待时间和持续趋势,瞬时占用较高并不一定是故障,但资源长期接近上限通常会让服务超时、连接堆积或进💫程被⭐系统终止。
Linux常用命令:uptime 查看运行时间和负载;top 或 vmstat 1 5 查看CPU、内存和等待;free -h 查看内存;▶️df -h 与 df -i 查看容量和inode;ss ⭐-s 查看连接概况。
Windows常用命令:Get-Process 查看进程;Get-Counter 获取CPU、内存和磁盘计数器;Get-Volume 查看卷空间;Get-NetTCPConnection 查看TC🎨P连⭐接。命令结果需要结合故障发生时间,避免把正常的定时任务误判为异常。
服务器状态检查的有效顺序是“先外部、后内部⭐,先基础设施、后业务服务”。单独看到进程正在运行、端口处于监听或主机可以💎 ping 通,都不能直接证明业务正常,因为服务可能已经卡死、依赖组件异常,或者请求在反向代理和应用层失败。
检查服务器状态时,第一步是把问题归入网络、主机、服务或应用中的一个🎆主要层级,避免一开始就重启服务🌈而丢失现场信息。
Linux日志检查:journalctl -p err -b --no-pager可查看本次启动以来的错误;针对具体服务可使用journalctl ⭐-u 服务名 --no-pager。Windows可使用Get-WinEv🚀ent读取系统和应用事件日志,再按故障时间筛选。