服务器监控工具推荐,实时查看负载内存硬盘
为什么需要能实时查看负载、内存和硬盘的工具
服务器变慢或服务无响应,往往最先表现在负载升高、内存耗尽或磁盘写满。
本文面向零基础运维,推荐几款能实时查看这三项指标的监控工具,并给出安装、配置和告警验证步骤,帮你快速定位问题。
选择工具时先判断需求:如果只是临时排查,用命令行工具最快;
如果要长期观察趋势并接收告警,建议部署带 Web 界面的监控系统。
轻量级命令行工具:Glances 快速上手
Glances 用一条命令就能在终端里同时显示 CPU、内存、磁盘、网络和进程信息,适合临时登录服务器时快速查看。
安装(以 Ubuntu/Debian 为例)
sudo apt update
sudo apt install -y glances
运行并查看关键指标
glances
进入界面后,顶部会显示 CPU 使用率、负载值(load),右侧显示内存和交换分区占用,底部有磁盘使用率。
按 q 退出。
如果只想看一次结果,可以用:
glances --once
Glances 还支持 Web 模式,方便远程查看:
glances -w
默认监听 0.0.0.0:61208,浏览器访问 http://服务器IP:61208 即可。
注意防火墙需要放行该端口,生产环境建议只允许内网访问。
可视化监控面板:Netdata 实时看板与告警
Netdata 安装后会提供一个实时刷新的 Web 面板,默认每秒采集一次数据,负载、内存、磁盘的图表非常直观,适合长期挂在浏览器里观察。
一键安装脚本(官方提供)
wget -O /tmp/netdata-kickstart.sh https://get.netdata.cloud/kickstart.sh
sudo bash /tmp/netdata-kickstart.sh
安装完成后,浏览器访问 http://服务器IP:19999。
如果打不开,先检查防火墙:
sudo ufw allow 19999/tcp
磁盘告警配置示例
Netdata 默认已对磁盘使用率做监控,如需自定义阈值,编辑配置文件:
sudo nano /etc/netdata/health.d/disks.conf
找到 disk_space_usage 部分,把 warn 和 crit 的值改成你需要的水位,例如:
warn: $this > (($status >= $WARNING) ? (75) : (85))
crit: $this > (($status == $CRITICAL) ? (85) : (95))
保存后重启服务:
sudo systemctl restart netdata
验证告警是否生效:可以手动创建一个占用空间的文件,观察面板是否出现红色告警。
宝塔面板用户:自带监控与告警设置
如果你用的是宝塔面板,登录后台后左侧菜单点击「监控」,就能看到 CPU、内存、磁盘的实时曲线。
设置告警通知
进入「面板设置」→「告警通知」,勾选「CPU 使用率」「内存使用率」「磁盘使用率」,并填写邮箱或微信推送。
阈值建议不要设置得太低,否则容易频繁告警。
查看磁盘详情
在「文件」页面可以直观看到各分区剩余空间,也可以安装「磁盘管理」插件查看 inode 使用情况。
避坑与验证要点
不要只看负载不看 CPU 核数。
负载值 4 在单核机器上已经很高,在 8 核机器上则属于正常范围。
判断标准:负载值持续超过 CPU 核数,说明有排队。
内存要看 available 而不是 free。
Linux 会把空闲内存用于缓存,free -h 中 available 列才是真正可用的内存。
磁盘要同时看空间和 inode。
用 df -h 看空间,用 df -i 看 inode。
有时空间没满但 inode 耗尽,同样会导致无法写入文件。
安装监控工具后要验证数据是否真实。
可以运行 stress --cpu 2 --timeout 30 制造压力,观察监控面板 CPU 曲线是否上升,确认采集正常。
远程访问监控端口务必限制来源 IP。
Netdata、Glances Web 模式如果直接暴露公网,容易被扫描和利用,建议通过安全组或防火墙只放行自己的 IP。
常见疑问
监控工具会占用很多资源吗?
Glances 和 Netdata 都比较轻量,单机部署对系统影响很小。如果服务器配置极低,可以只保留命令行工具,按需运行。
能不能同时监控多台服务器?
可以。Netdata 支持通过父节点集中查看多台子节点,宝塔也有多机监控方案。单机临时排查用 Glances 就够了。
告警阈值设多少合适?
没有统一标准。建议先观察一周正常业务下的指标范围,再以略高于正常峰值的数值作为告警线,避免误报。
这些工具支持 Windows 服务器吗?
Netdata 和 Glances 主要面向 Linux。Windows 可以用任务管理器或性能监视器,也可以部署 Zabbix 等跨平台方案。
选对工具后,关键是把告警阈值和验证步骤落到实处。
建议先按本文步骤完成一次安装和告警测试,再根据业务负载调整参数。