博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
shell 监控cpu,memory,load average
阅读量:6447 次
发布时间:2019-06-23

本文共 2999 字,大约阅读时间需要 9 分钟。

shell 监控cpu,memory,load average,记录到log,当负载压力时,发电邮通知管理员。

原理:

1.获取cpu,memory,load average的数值

2.判断数值是否超过自定义的范围,例如(CPU>90%,Memory<10%,load average>2)

3.如数值超过范围,发送电邮通知管理员。发送有时间间隔,每小时只会发送一次。

4.将数值写入log。

5.设置crontab 每30秒运行一次。

ServerMonitor.sh

#!/bin/bash# 系统监控,记录cpu、memory、load average,当超过规定数值时发电邮通知管理员# *** config start ***# 当前目录路径ROOT=$(cd "$(dirname "$0")"; pwd)# 当前服务器名HOST=$(hostname)# log 文件路径CPU_LOG="${ROOT}/logs/cpu.log"MEM_LOG="${ROOT}/logs/mem.log"LOAD_LOG="${ROOT}/logs/load.log"# 通知电邮列表NOTICE_EMAIL='admin@admin.com'# cpu,memory,load average 记录上一次发送通知电邮时间CPU_REMARK='/tmp/servermonitor_cpu.remark'MEM_REMARK='/tmp/servermonitor_mem.remark'LOAD_REMARK='/tmp/servermonitor_loadaverage.remark'# 发通知电邮间隔时间REMARK_EXPIRE=3600NOW=$(date +%s)# *** config end ***# *** function start ***# 获取CPU占用function GetCpu() {    cpufree=$(vmstat 1 5 |sed -n '3,$p' |awk '{x = x + $15} END {print x/5}' |awk -F. '{print $1}')    cpuused=$((100 - $cpufree))    echo $cpuused    local remark    remark=$(GetRemark ${CPU_REMARK})    # 检查CPU占用是否超过90%    if [ "$remark" = "" ] && [ "$cpuused" -gt 90 ]; then        echo "Subject: ${HOST} CPU uses more than 90% $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}        echo "$(date +%s)" > "$CPU_REMARK"    fi}# 获取内存使用情况function GetMem() {    mem=$(free -m | sed -n '3,3p')    used=$(echo $mem | awk -F ' ' '{print $3}')    free=$(echo $mem | awk -F ' ' '{print $4}')    total=$(($used + $free))    limit=$(($total/10))    echo "${total} ${used} ${free}"    local remark    remark=$(GetRemark ${MEM_REMARK})    # 检查内存占用是否超过90%    if [ "$remark" = "" ] && [ "$limit" -gt "$free" ]; then        echo "Subject: ${HOST} Memory uses more than 90% $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}        echo "$(date +%s)" > "$MEM_REMARK"    fi}# 获取load averagefunction GetLoad() {    load=$(uptime | awk -F 'load average: ' '{print $2}')    m1=$(echo $load | awk -F ', ' '{print $1}')    m5=$(echo $load | awk -F ', ' '{print $2}')    m15=$(echo $load | awk -F ', ' '{print $3}')    echo "${m1} ${m5} ${m15}"    m1u=$(echo $m1 | awk -F '.' '{print $1}')    local remark    remark=$(GetRemark ${LOAD_REMARK})    # 检查是否负载是否有压力    if [ "$remark" = "" ] && [ "$m1u" -gt "2" ]; then        echo "Subject: ${HOST} Load Average more than 2 $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}        echo "$(date +%s)" > "$LOAD_REMARK"    fi}# 获取上一次发送电邮时间function GetRemark() {    local remark    if [ -f "$1" ] && [ -s "$1" ]; then        remark=$(cat $1)        if [ $(( $NOW - $remark )) -gt "$REMARK_EXPIRE" ]; then            rm -f $1            remark=""        fi    else        remark=""    fi    echo $remark}# *** function end ***cpuinfo=$(GetCpu)meminfo=$(GetMem)loadinfo=$(GetLoad)echo "cpu: ${cpuinfo}" >> "${CPU_LOG}"echo "mem: ${meminfo}" >> "${MEM_LOG}"echo "load: ${loadinfo}" >> "${LOAD_LOG}"exit 0
crontab

* * * * * /home/xxxx/ServerMonitor.sh* * * * * sleep 30; /home/xxxx/ServerMonitor.sh

转载于:https://www.cnblogs.com/fdipzone/p/3715046.html

你可能感兴趣的文章
Ubuntu 16.04安装Synaptic Package Manager图形化APT管理工具
查看>>
Facebook 宕机事故系服务器配置问题导致
查看>>
谈一个技术的问题:oracle中sql语句的优化
查看>>
在 MaxCompute UDF 中运行 Scipy
查看>>
那些阿里的年轻人
查看>>
Kafka Streams 剖析
查看>>
TortoiseSVN客户端使用教程
查看>>
卖VR眼镜需谨慎,已经有30多人因传播VR小黄片被抓了
查看>>
使用unisphere添加nas过程
查看>>
【看图识算法】这是你见过最简单的 “算法说明书”
查看>>
Oracle12C—用户概要文件profile日常操作
查看>>
ImportError: No module named items
查看>>
Oracle中可被并行化执行的SQL操作
查看>>
目标管理的感悟
查看>>
getopt_long的用法
查看>>
Ruby 数组操作
查看>>
linux系统日志
查看>>
tinyxml 用法
查看>>
MySQL数据库性能优化之存储引擎选择
查看>>
网络部署Xenserver6.5
查看>>