shell指令碼監控伺服器狀態

來源:互聯網
上載者:User

標籤:

 

一、mutt的安裝                                           

1 yum -y install postfix2 #需要安裝sendmail並開啟防火牆的25連接埠,如果你需要收郵件110連接埠也要開3 yum -y install mutt

  二、配置資訊                                                

  關於配置資訊,有一點需要說明的,網上很多教程都說,編輯/root/.muttrc以修改設定檔,我想說的是,我在安裝完成之後, /root目錄下並沒有 .muttrc 這個隱藏檔案,你可以從其它地方複製過來,或者自己建立一個檔案。這裡我是複製的。

  你可以通過find命令找到Muttrc這個檔案,命令如下 find / -name Muttrc ,然後通過命令 cp /etc/Muttrc /root/.muttrc 複製到 /root 下後更名為 .muttrc ,然後你就可以編輯設定檔了。

1 #如果你收到的郵件亂碼,設定以下資訊2 set charset="utf-8"3 set rfc2047_parameters=yes4 #如果你想自訂寄件者資訊,需要進行如下設定5 set envelope_from=yes6 set use_from=yes7 set [email protected]8 set realname="itdhz"

安裝完郵件程式後

vi /etc/script/sys-warning.sh

#!/bin/bash#統一寫下接收監控郵件的郵箱mail_account="[email protected]"#監控系統負載與CPU、記憶體、硬碟、登入使用者數,超出警戒值則發郵件警示。#提取本伺服器的IP地址資訊IP=`/sbin/ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "`# 1、監控系統負載的變化情況,超出時發郵件警示:#抓取cpu的總核心數cpu_num=`grep -c ‘model name‘ /proc/cpuinfo`#抓取當前系統15分鐘的平均負載值load_15=`uptime | awk ‘{print $12}‘`#計算當前系統單個核心15分鐘的平均負載值,結果小於1.0時前面個位元補0。average_load=`echo "scale=2;a=$load_15/$cpu_num;if(length(a)==scale(a)) print 0;print a" | bc`#取上面平均負載值的個位整數average_int=`echo $average_load | cut -f 1 -d "."`#設定系統單個核心15分鐘的平均負載的警示值為0.70(即使用超過70%的時候警示)。load_warn=0.70#當單個核心15分鐘的平均負載值大於等於1.0(即個位整數大於0) ,直接發郵件警示;如果小於1.0則進行二次比較if (($average_int > 0)); thenecho "$IP伺服器15分鐘的系統平均負載為$average_load,超過警戒值1.0,請立即處理!!!" | mutt -s "$IP 伺服器系統負載嚴重警示!!!" $mail_accountelse#當前系統15分鐘平均負載值與警示值進行比較(當大於警示值0.70時會返回1,小於時會返回0 )load_now=`expr $average_load \> $load_warn`#如果系統單個核心15分鐘的平均負載值大於警示值0.70(傳回值為1),則發郵件給管理員#if (($load_now == 1)); then#echo "$IP伺服器15分鐘的系統平均負載達到 $average_load,超過警戒值0.70,請及時處理。" | mutt -s "$IP 伺服器系統負載警示" $mail_account#fifi# 2、監控系統cpu的情況,當使用超過80%的時候發警示郵件:#取當前空閑cpu百份比值(只取整數部分)cpu_idle=`top -b -n 1 | grep Cpu | awk ‘{print $5}‘ | cut -f 1 -d "."`#設定空閑cpu的警示值為20%,如果當前cpu使用超過80%(即剩餘小於20%),立即發郵件警示if (($cpu_idle < 20)); thenecho "$IP伺服器cpu剩餘$cpu_idle%,使用率已經超過80%,請及時處理。" | mutt -s "$IP 伺服器CPU警示" $mail_accountfi# 3、監控系統交換分區swap的情況,當使用超過80%的時候發警示郵件:#系統分配的交換分區總量swap_total=`free -m | grep Swap | awk ‘{print $2}‘`#當前剩餘的交換分區free大小swap_free=`free -m | grep Swap | awk ‘{print $4}‘`#當前已使用的交換分區used大小swap_used=`free -m | grep Swap | awk ‘{print $3}‘`if (($swap_used != 0)); then#如果交換分區已被使用,則計算當前剩餘交換分區free所佔總量的百分比,用小數來表示,要在小數點前面補一個整數位0swap_per=0`echo "scale=2;$swap_free/$swap_total" | bc`#設定交換分區的警示值為20%(即使用超過80%的時候警示)。swap_warn=0.20#當前剩餘交換分區百分比與警示值進行比較(當大於警示值(即剩餘20%以上)時會返回1,小於(即剩餘不足20%)時會返回0 )swap_now=`expr $swap_per \> $swap_warn`#如果當前交換分區使用超過80%(即剩餘小於20%,上面的傳回值等於0),立即發郵件警示if (($swap_now == 0)); thenecho "$IP伺服器swap交換分區只剩下 $swap_free M 未使用,剩餘不足20%,使用率已經超過80%,請及時處理。" | mutt -s "$IP 伺服器記憶體警示" $mail_accountfifi# 4、監控系統硬碟分區使用的情況,當使用超過80%的時候發警示郵件:for i in `df -h | grep -v Filesystem | awk ‘{ print $5 }‘ | cut -f 1 -d ‘%‘`; doif (( $i >= 80 ));thenecho "$IP 伺服器硬碟使用率已經超過80%,請及時處理。" | mutt -s "$IP 伺服器硬碟警示" $mail_accountfidone#取當前根分區(/dev/sda3)已用的百份比值(只取整數部分)#disk_sda2=`df -h | grep /dev/sda2 | awk ‘{print $5}‘ | cut -f 1 -d "%"`#設定空閑硬碟容量的警示值為80%,如果當前硬碟使用超過80%,立即發郵件警示#if (($disk_sda2 > 80)); then#echo "$IP 伺服器 /根分區 使用率已經超過80%,請及時處理。" | mutt -s "$IP 伺服器硬碟警示" $mail_account#fi#########usr分區監控############disk_sda5=`df -h | grep /dev/sda5 | awk ‘{print $5}‘ | cut -f 1 -d "%"`#設定空閑硬碟容量的警示值為80%,如果當前硬碟使用超過80%,立即發郵件警示#if (($disk_sda5 > 80)); then#echo "$IP 伺服器 /usr 使用率已經超過80%,請及時處理。" | mutt -s "$IP 伺服器硬碟警示" $mail_account#fi#########home分區監控############disk_sda8=`df -h | grep /dev/sda8 | awk ‘{print $5}‘ | cut -f 1 -d "%"`#設定空閑硬碟容量的警示值為80%,如果當前硬碟使用超過80%,立即發郵件警示#if (($disk_sda8 > 80)); then#echo "$IP 伺服器 /home 使用率已經超過80%,請及時處理。" | mutt -s "$IP 伺服器硬碟警示" $mail_account#fi###############################################################################################################################5、監控系統使用者登入的情況,當使用者數超過3個的時候發警示郵件:#取目前使用者登入數(只取數值部分)users=`uptime | awk ‘{print $6}‘`#設定登入使用者數的警示值為3個,如果目前使用者數超過3個,立即發郵件警示if (($users >= 3)); thenecho "$IP 伺服器使用者數已經達到$users個,請及時處理。" | mutt -s "$IP 伺服器使用者數警示" $mail_accountfi#6、監控網路連接數的情況,串連數大於2000時發警示郵件conn_num=`netstat -nat | grep -i "80" | wc -l`#設定網路連接數警示值為2000,如果串連數超過2000,立即發郵件警示if (($conn_num >= 2000)); thenecho "$IP 伺服器網路連接數已經達到$conn_num個,請及時處理。" | mutt -s "$IP 伺服器並發串連數" $mail_accountfi#7、監控伺服器帳號表,用md5sum方法加密,儲存到一個檔案內,兩個對比,如果不匹配發出警示default_md5=`cat /script/md5`Check_md5=`md5sum /etc/passwd | awk ‘{print $1}‘`#使用者表發生變化,理解發出警示if [ "$Check_md5"x != "$default_md5"x ]; thenecho "$IP 伺服器使用者表發生變化,請及時處理。" | mutt -s "$IP 伺服器使用者表警示" $mail_accountfi #8、監控伺服器密碼錶,用md5sum方法加密,儲存到一個檔案內,兩個對比,如果不匹配發出警示default_passwd5=`cat /script/passwdmd5`Check_passwd5=`md5sum /etc/shadow | awk ‘{print $1}‘`#使用者表發生變化,理解發出警示if [ "$Check_passwd5"x != "$default_passwd5"x ]; thenecho "$IP 伺服器密碼發生變化,請及時處理。" | mutt -s "$IP 伺服器使用者表警示" $mail_accountfi#9、監控網站檔案,查看是否有異常檔案,如果發現立即報abno_num=`php /root/chk.php scan /home/wwwroot/ | grep -v "xx" | grep -v "chk.php" | wc -l`#判斷個數,因為執行完沒有異常的話會輸出一行空行,所以要判斷有幾個,再判斷是否是異常檔案if (($abno_num > 1)); thenphp /root/chk.php scan /home/wwwroot/ | grep -v "xx" | grep -v "chk.php" > /script/abno_fileecho "$IP 伺服器網站發現異常檔案$abno_num個,請及時處理。" |  mutt -s "$IP 伺服器網站異常檔案警示" $mail_accountfi

  

 

 

shell指令碼監控伺服器狀態

相關文章

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.