一、安装linux下面的一个邮件客户端msmtp软件(类似于一个foxmail的工具)
 1、下载安装: http://downloads.sourceforge.net/msmtp/msmtp-1.4.16.tar.bz2?modtime=1217206451&big_mirror=0 
  # tar jxvf msmtp-1.4.16.tar.bz2
  # cd msmtp-1.4.16
  # ./configure --prefix=/usr/local/msmtp
  # make
  # make install
 2、创建msmtp配置文件和日志文件(host为邮件域名,邮件用户名test,密码123456)
  # vim ~/.msmtprc
account default  
host 126.com  
from test@126.com  
auth login  
user test  
password 123456  
logfile ~/.msmtp.log 
  # chmod 600  ~/.msmtprc
  # touch ~/.msmtp.log
 3、mutt安装配置:(一般linux下有默认安装mutt)
  # vim ~/.muttrc
set sendmail="/usr/local/msmtp/bin/msmtp" 
set use_from=yes 
set realname="moniter"   
set from=test@126.com  
set envelope_from=yes 
set rfc2047_parameters=yes 
set charset="utf-8" 

 4、邮件发送测试(-s邮件标题,-a表加附件)
  # echo "邮件内容123456" | mutt -s "邮件标题测试邮件" -a /scripts/test.txt  test@126.com
 
二、监控服务器系统负载情况:
1、用uptime命令查看当前负载情况(1分钟,5分钟,15分钟平均负载情况)
 # uptime
   15:43:59 up 186 days, 20:04,  1 user,  load average:  0.01,    0.02,   0.00  

系统负荷的经验法则:(摘自http://www.ruanyifeng.com/blog/2011/07/linux_load_average_explained.html)
(1) 主要观察"15分钟系统负荷",将它作为电脑正常运行的指标。
(2) 如果15分钟内,(系统负荷除以CPU核心数目之后的)平均负荷大于1.0,表明问题持续存在,不是暂时现象。
(3) 当系统负荷持续大于0.7,你必须开始调查了,问题出在哪里,防止情况恶化。
(4) 当系统负荷持续大于1.0,你必须动手寻找解决办法,把这个值降下来。
(5) 当系统负荷达到5.0,就表明你的系统有很严重的问题,长时间没有响应,或者接近死机了。

2、查看服务器cpu的总核数
 # grep -c 'model name' /proc/cpuinfo

3、截取服务器1分钟、5分钟、15分钟的负载情况
# uptime | awk '{print $8,$9,$10,$11,$12}'
   load average:  0.01,    0.02,   0.00  

4、查看截取15分钟的平均负载
 # uptime | awk '{print $12}' (用 '{print $12}' 这个获取的不够准确,如果都用awk取第12个字段的话,结果有可能为空了。而用$NF表输出最后一段的内容)
# uptime | awk '{print $NF}'
5、编写系统负载监控的脚本文件:
# vim /scripts/load-check.sh
#!/bin/bash  
#使用uptime命令监控linux系统负载变化  
 
#取系统当前时间(以追加的方式写入文件>>)  
date >> /scripts/datetime-load.txt     
 
#提取服务器1分钟、5分钟、15分钟的负载情况  
uptime | awk '{print $8,$9,$10,$11,$12}' >> /scripts/load.txt  
 
#逐行连接上面的时间和负载相关行数据(每次重新写入文件>)  
paste  /scripts/datetime-load.txt /scripts/load.txt   > /scripts/load_day.txt 
  # chmod a+x /scripts/load-check.sh
6、编写系统负载结果文件邮件发送脚本:
# vim /scripts/sendmail-load.sh
#!/bin/bash  
#把系统负载监控生成的load_day.txt文件通过邮件发送给用户  
 
#提取本服务器的IP地址信息  
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "`  
 
#提取当前日期  
today=`date -d "0 day" +%Y年%m月%d日`  
 
#发送系统负载监控结果邮件  
echo "这是$IP服务器$today的系统负载监控报告,请下载附件。" | mutt -s "$IP服务器$today的系统负载监控报告" -a /scripts/load_day.txt  test@126.com  
  # chmod a+x /scripts/sendmail-load.sh
7、编写系统负载监控的脚本文件:
 # vim /scripts/load-warning.sh
#!/bin/bash  
#使用uptime命令监控linux系统负载变化  
 
#提取本服务器的IP地址信息  
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "`  
 
#抓取cpu的总核数  
cpu_num=`grep -c 'model name' /proc/cpuinfo`  
 
#抓取当前系统15分钟的平均负载值  
load_15=`uptime | awk '{print $NF}'`  
 
#计算当前系统单个核心15分钟的平均负载值,结果小于1.0时前面个位数补0。  
average_load=`echo "scale=2;a=$load_15/$cpu_num;if(length(a)==scale(a)) print 0;print a" | bc`  

#取上面平均负载值的个位整数  
average_int=`echo $average_load | cut -f 1 -d "."`  
 
#设置系统单个核心15分钟的平均负载的告警值为0.70(即使用超过70%的时候告警)。  
load_warn=0.70  
 
#当单个核心15分钟的平均负载值大于等于1.0(即个位整数大于0) ,直接发邮件告警;如果小于1.0则进行二次比较  
if (($average_int > 0)); then  
      echo "$IP服务器15分钟的系统平均负载为$average_load,超过警戒值1.0,请立即处理!!!" | mutt -s "$IP 服务器系统负载严重告警!!!"  test@126.com  
else  
#当前系统15分钟平均负载值与告警值进行比较(当大于告警值0.70时会返回1,小于时会返回0 )  
load_now=`expr $average_load \> $load_warn`  
 
#如果系统单个核心15分钟的平均负载值大于告警值0.70(返回值为1),则发邮件给管理员  
 if (($load_now == 1)); then  
    echo "$IP服务器15分钟的系统平均负载达到 $average_load,超过警戒值0.70,请及时处理。" | mutt -s "$IP 服务器系统负载告警"  test@126.com  
 fi  
fi 
  # chmod a+x /scripts/load-warning.sh
三、监控服务器系统cpu占用情况:
1、使用top命令查看linux系统cpu使用情况:
 #  top -b -n 1 | grep Cpu   (-b -n 1 表只需要1次的输出结果)
     Cpu(s):  0.0%us,  0.0%sy,  0.0%ni, 99.9%id,  0.0%wa,  0.0%hi,  0.0%si,  0.0%st
                                                           (空闲值)
 2、查看截取空闲cpu的百分比数值命令(只取整数部分):
 # top -b -n 1 | grep Cpu | awk '{print $5}' | cut -f 1 -d "."
 3、编写cpu监控的脚本文件:
 # vim /scripts/cpu-check.sh
#!/bin/bash  
#使用top命令监控linux系统cpu变化  
 
#取系统当前时间(以追加的方式写入文件>>)  
date >> /scripts/datetime-cpu.txt     
 
#抓取当前cpu的值(以追加的方式写入文件>>)  
top -b -n 1 | grep Cpu  >> /scripts/cpu-now.txt   
 
#逐行连接上面的时间和cpu相关行数据(每次重新写入文件>)  
paste  /scripts/datetime-cpu.txt   /scripts/cpu-now.txt  > /scripts/cpu.txt 
  # chmod a+x /scripts/cpu-check.sh

 4、查看CPU监控的结果文件:
 # cat /scripts/cpu.txt

 5、编写cpu结果文件邮件发送脚本:
# vim /scripts/sendmail-cpu.sh
#!/bin/bash  
#把生成的cpu.txt文件通过邮件发送给用户  
 
#提取本服务器的IP地址信息  
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "`  
 
#提取当前日期 
today=`date -d "0 day" +%Y年%m月%d日`  
 
#发送cpu监控结果邮件  
echo "这是$IP服务器$today的cpu监控报告,请下载附件。" | mutt -s "$IP服务器$today的CPU监控报告" -a /scripts/cpu.txt  test@126.com 
  # chmod a+x /scripts/sendmail-cpu.sh
四、监控系统cpu的情况,当使用超过80%的时候发告警邮件:
  # vim /scripts/cpu-warning.sh
#!/bin/bash  
#监控系统cpu的情况脚本程序  
 
#提取本服务器的IP地址信息  
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "`  
 
#取当前空闲cpu百份比值(只取整数部分)  
cpu_idle=`top -b -n 1 | grep Cpu | awk '{print $5}' | cut -f 1 -d "."`  
 
#设置空闲cpu的告警值为20%,如果当前cpu使用超过80%(即剩余小于20%),立即发邮件告警  
if (($cpu_idle < 20)); then  
      echo "$IP服务器cpu剩余$cpu_idle%,使用率已经超过80%,请及时处理。" | mutt -s "$IP 服务器CPU告警"  test@126.com  
fi 
  # chmod a+x /scripts/cpu-warning.sh
五、加入任务计划:系统负载与CPU占用率每十分钟检测一次,有告警则立即发邮件(十分钟发一次),负载与CPU检测结果邮件每天早上8点发一次

# crontab -e
*/10 * * * *  /scripts/load-check.sh  
*/10 * * * *  /scripts/load-warning.sh  
0 8 * * *  /scripts/sendmail-load.sh  
 
*/10 * * * *  /scripts/cpu-check.sh  
*/10 * * * *  /scripts/cpu-warning.sh  
0 8 * * *  /scripts/sendmail-cpu.sh 
 # service crond restart

本文出自 “我的技术梦想之路” 博客,请务必保留此出处http://huangrs.blog.51cto.com/2677571/788379

利用shell脚本来监控linux系统的负载与CPU占用情况的更多相关文章

  1. Linux系统的负载与CPU、内存、硬盘、用户数监控的shell脚本

    利用Shell脚本来监控Linux系统的负载.CPU.内存.硬盘.用户登录数. 这几天在学习研究shell脚本,写的一些系统负载.CPU.内存.硬盘.用户数监控脚本程序.在没有nagios监控的情况下 ...

  2. linux 系统的负载与CPU、内存、硬盘、用户数监控脚本[marked]

    转载文章 原始出处  在没有nagios监控的情况下,只要服务器能上互联网,就可通过发邮件的方式来提醒管理员系统资源的使用情况. 一.编写linux系统告警邮件脚本 # vim /scripts/sy ...

  3. SHELL脚本自动备份Linux系统

    今天来写一个使用shell脚本增量备份系统文件,顺便复习一下shell脚本相关的命令,这个脚本可以根据自己的需求来备份不同的文件或者文件夹,进行完整备份和增量备份.直接上脚本如下: #!/bin/sh ...

  4. Linux系统使用iftop查看带宽占用情况

    Linux系统下如果服务器带宽跑满了,查看跟哪个ip通信占用带宽比较多,可以通过iftop命令进行查询,使用方法如下: 1 安装方法[软件官网地址:http://www.ex-parrot.com/~ ...

  5. Shell脚本实现在Linux系统中自动安装JDK

    A:本脚本运行的机器,Linux B:待安装JDK的机器, Linux 首先在脚本运行的机器A上确定可以ssh无密码登录到待安装jdk的机器B上,然后就可以在A上运行本脚本: 复制代码 代码如下: $ ...

  6. shell脚本定时任务 ( linux系统)

    watermark/2/text/aHR0cDovL2Jsb2cuY3Nkbi5uZXQvbGV5YW5nanVu/font/5a6L5L2T/fontsize/400/fill/I0JBQkFCMA ...

  7. 监控Linux系统节点和服务CPU内存性能

    1.获取信息 #!/bin/bash #描述: # 把top信息输入到一个文件内部 #作者:孤舟点点 #版本:1.0 #创建时间:-- :: PATH=/bin:/sbin:/usr/bin:/usr ...

  8. linux系统下oracle表空间占用情况

    1.我们先查询表空间的占用情况,使用sql如下: select upper(f.tablespace_name) "表空间名", d.tot_grootte_mb "表空 ...

  9. linux下top命令查看cpu占用情况

    可以通过 top 命令来查看 CPU 使用状况.运行 top 命令后,CPU 使用状态会以全屏的方式显示,并且会处在对话的模式 -- 用基于 top 的命令,可以控制显示方式等等.退出 top 的命令 ...

  10. shell脚本监控Linux系统性能指标

    2016-11-04 22:41 原作者不详 分类: Linux(7) 在服务器运维过程中,经常需要对服务器的各种资源进行监控, 例如:CPU的负载监控,磁盘的使用率监控,进程数目监控等等,以在系统出 ...

随机推荐

  1. 12月12日内容总结——Django之数据增删改查、Django请求生命周期流程图、Django路由层(路由匹配、转换器、正则匹配)、反向解析

    目录 一.可视化界面之数据增删改查 二.django请求生命周期流程图 三.django路由层 1.路由匹配 2.转换器 3.正则匹配 不同版本的区别 正则匹配斜杠导致的区别 4.正则匹配的无名有名分 ...

  2. Vue31 消息订阅和发布

    1 简介 组件之间的通信除了使用事件总线之外,还可以使用一些插件来通过消息的订阅和发布来实现.pubsub-js就是一个不错的选择. 2 使用 2.1 安装 npm i pubsub-js # 或 y ...

  3. javaEE(网络编程、TCP、线程池优化)

    网络编程 Client-Server(CS) Browser/Server(BS) 1.客户端--服务端 安装客户端 更新. 依赖PC 2.浏览器和服务端 分布式 兼容性 一站开发 网络通信: UDP ...

  4. 滴水2.c++构造 与 继承

    1.构造函数特点 2.析构函数的特点: 析构函数前面必须有~ 3.继承 一个子类可以有多个父类 作业1. #include<stdio.h> struct DateInfo { int y ...

  5. 数值的扩展方法以及新增数据类型BigInt

    二进制和八进制表示法 ES6提供了二进制和八进制数值的新的写法,分别用前缀0b(或0B)和0o或(0O)表示 0b111110111 === 503 // true; 0o767 === 503; / ...

  6. MVC3三层架构

    以上部分来自黑马

  7. ctf 菜鸟杯

    web签到 首先最里面的是ctfshow-QQ群:,而他需要进行cookie传参,因此我们需要在cookie传入CTFshow-QQ群=a,然后就要以POST方式传入a的值,我们传入a=b,而b是以G ...

  8. ChatGPT API使用介绍

    1.概述 随着人工智能技术的不断发展,越来越多的AI产品被应用到各个领域,其中最具代表性的莫过于人工智能语言模型.语言模型是一种可以通过学习大量语言数据来预测文本或语音的技术,其应用范围十分广泛,如智 ...

  9. Yapi安装配置(CentOs)

    环境要求 nodejs(7.6+) mongodb(2.6+) git 准备工作 清除yum命令缓存 sudo yum clean all 卸载低版本nodejs yum remove nodejs ...

  10. Git Please commit your changes or stash them before you merge.

    本地分支和远程修改了同一个文件代码,pull远程分支的代码的时候会文件冲突 出现这个错误 Please commit your changes or stash them before you mer ...