35-DevOps自动化-服务器监控与运维
35 · DevOps自动化——服务器监控与运维小马在云服务商那里买了两台低配 VPS,一台跑着个人网站和数据库,另一台是测试环境。他不想装复杂的监控系统(Prometheus、Grafana 之类),但又担心服务器出问题自己不知道。如果有这么一个轻量级的管家,能定时检查服务器状态、分析日志、自动备份,在出问题时及时通知我——Hermes 在 DevOps 场景下的能力正合适。一、系统监控Hermes 可以通过terminal工具执行系统命令,读取服务器的运行状态。创建一个系统监控的 Skill,定义需要监控的指标:CPU与内存监控:# CPU 使用率top-bn1|grep"Cpu(s)"|awk'{print $2 + $4"%"}'# 内存使用free-h|grep"Mem"|awk'{print $3 "/" $2}'# 系统负载uptime|awk-F'load average:''{print $2}'Hermes 会定期执行这些命令,记录状态变化,并在异常时触发告警。磁盘监控:# 磁盘使用率df-h|grep