1. 程式人生 > >系統資源監控指令碼

系統資源監控指令碼

#!/bin/bash
#統一寫下接收監控郵件的郵箱
mail_account="[email protected]"


#監控系統負載與CPU、記憶體、硬碟、登入使用者數,超出警戒值則發郵件告警。

#提取本伺服器的IP地址資訊
IP=`/sbin/ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "`

# 1、監控系統負載的變化情況,超出時發郵件告警:

#抓取cpu的總核數
cpu_num=`grep -c 'model name' /proc/cpuinfo`

#抓取當前系統15分鐘的平均負載值
load_15=`uptime | awk '{print $12}'`

#計算當前系統單個核心15分鐘的平均負載值,結果小於1.0時前面個位數補0。
average_load=`echo "scale=2;a=$load_15/$cpu_num;if(length(a)==scale(a)) print 0;print a" | bc`

#取上面平均負載值的個位整數
average_int=`echo ${average_load} | cut -f 1 -d "."`

#設定系統單個核心15分鐘的平均負載的告警值為0.70(即使用超過70%的時候告警)。
load_warn=0.70

#當單個核心15分鐘的平均負載值大於等於1.0(即個位整數大於0) ,直接發郵件告警;如果小於1.0則進行二次比較
if (($average_int > 0)); then
    echo "${IP}伺服器15分鐘的系統平均負載為${average_load},超過警戒值1.0,請立即處理!!!" | mutt -s "${IP} 伺服器系統負載嚴重告警!!!" ${mail_account}
else

#當前系統15分鐘平均負載值與告警值進行比較(當大於告警值0.70時會返回1,小於時會返回0 )
load_now=`expr ${average_load} \> ${load_warn}`

#如果系統單個核心15分鐘的平均負載值大於告警值0.70(返回值為1),則發郵件給管理員
#if (($load_now == 1)); then
#echo "${IP}伺服器15分鐘的系統平均負載達到 ${average_load},超過警戒值0.70,請及時處理。" | mutt -s "${IP} 伺服器系統負載告警" ${mail_account}
#fi

fi

# 2、監控系統cpu的情況,當使用超過80%的時候發告警郵件:

#取當前空閒cpu百份比值(只取整數部分)
cpu_idle=`top -b -n 1 | grep Cpu | awk '{print $5}' | cut -f 1 -d "."`

#設定空閒cpu的告警值為20%,如果當前cpu使用超過80%(即剩餘小於20%),立即發郵件告警
if ((${cpu_idle} < 20)); then
echo "${IP}伺服器cpu剩餘${cpu_idle}%,使用率已經超過80%,請及時處理。" | mutt -s "${IP} 伺服器CPU告警" ${mail_account}
fi

# 3、監控系統交換分割槽swap的情況,當使用超過80%的時候發告警郵件:

#系統分配的交換分割槽總量
swap_total=`free -m | grep Swap | awk '{print $2}'`

#當前剩餘的交換分割槽free大小
swap_free=`free -m | grep Swap | awk '{print $4}'`

#當前已使用的交換分割槽used大小
swap_used=`free -m | grep Swap | awk '{print $3}'`

if (($swap_used != 0)); then
#如果交換分割槽已被使用,則計算當前剩餘交換分割槽free所佔總量的百分比,用小數來表示,要在小數點前面補一個整數位0
swap_per=0`echo "scale=2;${swap_free}/$swap_total" | bc`

#設定交換分割槽的告警值為20%(即使用超過80%的時候告警)。
swap_warn=0.20

#當前剩餘交換分割槽百分比與告警值進行比較(當大於告警值(即剩餘20%以上)時會返回1,小於(即剩餘不足20%)時會返回0 )
swap_now=`expr ${swap_per} \> ${swap_warn}`

#如果當前交換分割槽使用超過80%(即剩餘小於20%,上面的返回值等於0),立即發郵件告警
if (($swap_now == 0)); then
echo "${IP}伺服器swap交換分割槽只剩下 ${swap_free} M 未使用,剩餘不足20%,使用率已經超過80%,請及時處理。" | mutt -s "${IP} 伺服器記憶體告警" ${mail_account}
fi

fi

# 4、監控系統硬碟分割槽使用的情況,當使用超過80%的時候發告警郵件:

for i in `df -h | grep -v Filesystem | awk '{ print $5 }' | cut -f 1 -d '%'`; do
if (( $i >= 80 ));then
echo "${IP} 伺服器硬碟使用率已經超過80%,請及時處理。" | mutt -s "${IP} 伺服器硬碟告警" ${mail_account}
fi
done


#取當前根分割槽(/dev/sda3)已用的百份比值(只取整數部分)
#disk_sda2=`df -h | grep /dev/sda2 | awk '{print $5}' | cut -f 1 -d "%"`

#設定空閒硬碟容量的告警值為80%,如果當前硬碟使用超過80%,立即發郵件告警
#if (($disk_sda2 > 80)); then
#echo "${IP} 伺服器 /根分割槽 使用率已經超過80%,請及時處理。" | mutt -s "${IP} 伺服器硬碟告警" ${mail_account}
#fi
#########usr分割槽監控###########
#disk_sda5=`df -h | grep /dev/sda5 | awk '{print $5}' | cut -f 1 -d "%"`

#設定空閒硬碟容量的告警值為80%,如果當前硬碟使用超過80%,立即發郵件告警
#if (($disk_sda5 > 80)); then
#echo "${IP} 伺服器 /usr 使用率已經超過80%,請及時處理。" | mutt -s "${IP} 伺服器硬碟告警" ${mail_account}
#fi
#########home分割槽監控###########
#disk_sda8=`df -h | grep /dev/sda8 | awk '{print $5}' | cut -f 1 -d "%"`

#設定空閒硬碟容量的告警值為80%,如果當前硬碟使用超過80%,立即發郵件告警
#if (($disk_sda8 > 80)); then
#echo "${IP} 伺服器 /home 使用率已經超過80%,請及時處理。" | mutt -s "${IP} 伺服器硬碟告警" ${mail_account}
#fi

##############################################################################################################################
#5、監控系統使用者登入的情況,當用戶數超過3個的時候發告警郵件:

#取當前使用者登入數(只取數值部分)
users=`uptime | awk '{print $6}'`

#設定登入使用者數的告警值為3個,如果當前使用者數超過3個,立即發郵件告警
if ((${users} >= 3)); then
echo "${IP} 伺服器使用者數已經達到${users}個,請及時處理。" | mutt -s "${IP} 伺服器使用者數告警" ${mail_account}
fi

#6、監控網路連線數的情況,連線數大於2000時發告警郵件
conn_num=`netstat -nat | grep -i "80" | wc -l`

#設定網路連線數告警值為2000,如果連線數超過2000,立即發郵件告警
if (($conn_num >= 2000)); then
echo "${IP} 伺服器網路連線數已經達到${conn_num}個,請及時處理。" | mutt -s "${IP} 伺服器併發連線數" ${mail_account}
fi

#7、監控伺服器賬號表,用md5sum方法加密,儲存到一個檔案內,兩個對比,如果不匹配發出報警
default_md5=`cat /script/md5`
Check_md5=`md5sum /etc/passwd | awk '{print $1}'`
#使用者表發生變化,理解發出報警
if [ "$Check_md5"x != "$default_md5"x ]; then
echo "${IP} 伺服器使用者表發生變化,請及時處理。" | mutt -s "${IP} 伺服器使用者表告警" ${mail_account}
fi

#8、監控伺服器密碼錶,用md5sum方法加密,儲存到一個檔案內,兩個對比,如果不匹配發出報警
default_passwd5=`cat /script/passwdmd5`
Check_passwd5=`md5sum /etc/shadow | awk '{print $1}'`
#使用者表發生變化,理解發出報警
if [ "${Check_passwd5}"x != "${default_passwd5}"x ]; then
echo "${IP} 伺服器密碼發生變化,請及時處理。" | mutt -s "${IP} 伺服器使用者表告警" ${mail_account}
fi


#9、監控網站檔案,檢視是否有異常檔案,如果發現立即報
abno_num=`php /root/chk.php scan /home/wwwroot/ | grep -v "xx" | grep -v "chk.php" | wc -l`
#判斷個數,因為執行完沒有異常的話會輸出一行空行,所以要判斷有幾個,再判斷是否是異常檔案
if ((${abno_num} > 1)); then
php /root/chk.php scan /home/wwwroot/ | grep -v "xx" | grep -v "chk.php" > /script/abno_file
echo "${IP} 伺服器網站發現異常檔案${abno_num}個,請及時處理。" |  mutt -s "${IP} 伺服器網站異常檔案告警" ${mail_account}
fi

  轉自:https://www.cnblogs.com/yepei/p/7216945.html