文档
快速开始 + 每部分每设备的功能说明(持续更新中)
健康检测与仪表盘
本文介绍仪表盘的服务器健康监控功能,以及各项指标的含义。
功能简介
仪表盘批量展示所有服务器的实时健康状态:CPU 负载、内存使用、磁盘占用、系统信息、在线状态。打开面板首页即可一览全部服务器。
适用场景
- 快速判断哪些服务器运行正常、哪些有异常
- 监控内存/磁盘是否快满,提前预警
- 查看服务器的基础信息(CPU 型号、核数、系统版本、架构)
展示的内容(每个指标是什么意思)
每台服务器卡片会显示:
| 指标 | 含义 | 通俗解释 |
|---|---|---|
| 在线状态 | 在线 / 离线(绿点 / 红点) | 面板能否 SSH 连上它 |
| CPU 负载 | 系统负载平均值 | 数字越接近「核数」说明越忙;长期超核数说明 CPU 吃紧 |
| 内存 | 总量 / 已用 / 可用 | 可用内存太少(<8%)要警惕 OOM |
| 磁盘 | 根分区 总量 / 已用 / 使用率 | 使用率超 90% 就该清理了 |
| 运行时长 | 距上次重启的天数 | 数值大说明系统稳定 |
| CPU 型号 / 核数 / 架构 | 如「4 核 / x86_64 / Intel Xeon」 | 硬件配置 |
| 操作系统 | 发行版名称和版本 | 如「Ubuntu 22.04」 |
| 主机名 | 服务器的 hostname | 机器名 |
| 局域网 IP | 服务器内网地址 | 内网地址 |
负载和核数的关系
- 负载 < 核数:正常,机器有空闲
- 负载 = 核数:刚好跑满
- 负载 > 核数:超载,可能变慢
- 负载 > 核数 × 3:严重超载(崩溃防护默认会在此阈值介入)
刷新机制
- 面板会批量检测所有服务器(并行),避免逐个连接太慢
- 健康数据有 60 秒缓存:同一分钟内的刷新不会重复 SSH 连接
- 检测失败的服务器有 30 秒失败缓存:离线服务器不会每次都浪费超时等待
> 因此,你手动点「刷新」时,如果数据没变,是正常的缓存行为,等 60 秒后会自动更新。
在线 / 离线状态说明
「离线」不代表服务器宕机,它只表示「面板无法通过 SSH 连上这台服务器」。常见原因:
1. SSH 端口不可达(云防火墙/安全组拦截、NAT 端口映射失效)
2. 账号密码错误
3. 服务器确实宕机了
排查方法见 常见问题 FAQ 的「服务器显示离线」一节。
注意事项
1. 健康检测通过 SSH 远程执行命令完成,不在目标服务器安装任何程序,不占用目标资源。
2. 对于「穿透服务器」(无公网 IP),健康数据通过反向隧道传输,检测方式与普通服务器相同。
3. 如果某台服务器长期离线且已不再使用,建议在「服务器管理」中删除,避免每次刷新都等待超时。