文档

快速开始 + 每部分每设备的功能说明(持续更新中)

崩溃防护

本文介绍面板的「崩溃防护」功能——自动监控内存、CPU、磁盘,在服务器资源耗尽前主动干预,防止服务器卡死。

一句话理解

服务器最怕的不是「某个程序报错」,而是「内存被吃光 / CPU 跑满,整台机器卡到连 SSH 都连不上,只能去服务商后台强制重启」。崩溃防护就是在这件事发生之前,自动揪出那个「吃资源」的进程并处理掉,给你留一条活路。

功能简介

崩溃防护在目标服务器上部署一个轻量守护进程,持续监控内存、CPU、磁盘。当资源出现异常时自动干预(杀掉异常进程),防止服务器因 OOM(内存耗尽)或 CPU 爆炸而完全无法访问。

为什么要用它(什么是 OOM / CPU 爆炸)

  • OOM(Out Of Memory,内存耗尽):某个程序有内存泄漏,或一次性申请了过多内存,把服务器的内存全部占满。此时系统为了自保会开始「杀进程」,但往往把关键服务也一起杀了,甚至整机卡死。
  • CPU 爆炸:某个程序陷入死循环或异常计算,把 CPU 全部核心占满。此时 SSH 连不上、面板也连不上,只能硬重启。

这些故障往往是逐渐发生的——先是某个进程慢慢吃资源,最后才彻底卡死。崩溃防护的作用就是在「不可挽回之前」主动介入。

防护阈值(默认值)

防护项默认阈值行为
内存可用内存 < 8%触发干预,杀掉占用 > 15% 的异常进程(5 分钟冷却,避免频繁误杀)
CPU负载 > 核数 × 3连续 3 次超阈值才动手;单进程 > 30% 才杀
CPU 极端负载 ≥ 阈值 × 4立即干预,不等连续计数(防 CPU 爆炸来不及反应)
磁盘使用率 > 92%仅告警提醒(不自动删除文件

> 这些是经过验证的保守默认值,大多数服务器无需调整即可安心使用。如需自定义,可在崩溃防护面板中修改阈值。

适用场景

  • 服务器上跑着内存不太稳定的程序(如某些 Java 应用、爬虫脚本)
  • 服务器内存本身较小,容易被打满
  • 希望有一道「最后防线」兜底,防止半夜卡死却无人值守

使用方法

1. 进入目标服务器的「系统管理面板 → 崩溃防护」

2. 点击「一键部署」,面板通过 SSH 在目标服务器上部署守护进程

3. 部署后显示「守护进程运行中」,并列出当前防护阈值说明

4. 触发防护时,可在「告警事件」里查看:触发时间、原因(哪个进程、占用多少资源)、处理动作

部署方式

  • 有 systemd 的服务器(Debian/Ubuntu/CentOS 等):以 systemd 服务部署,开机自启 + 崩溃自动拉起(显示「开机自启」徽章)
  • 无 systemd 的服务器(Alpine 等):回退 nohup 方式运行(能监控,但重启后不自动拉起,需手动重新部署)

注意事项

1. 零足迹:守护进程是独立的轻量脚本,只占极小资源,不影响目标服务器业务。

2. 白名单保护:内核线程、系统关键进程默认不杀,避免误杀导致系统崩溃。

3. 磁盘只告警不清理:磁盘满不会自动删你的文件(避免误删重要数据),只提醒你手动处理。

4. 卸载:在崩溃防护面板点「卸载」即可,会清理守护进程和 systemd 服务。