侯体宗的博客
  • 首页
  • Hyperf版
  • beego仿版
  • 人生(杂谈)
  • 技术
  • 关于我
  • 更多分类
    • 文件下载
    • 文字修仙
    • 中国象棋ai
    • 群聊
    • 九宫格抽奖
    • 拼图
    • 消消乐
    • 相册

Linux服务器硬件运行状态及故障邮件提醒的监控脚本分享

linux  /  管理员 发布于 7年前   231

监控硬件运行状况

shell 监控cpu,memory,load average,记录到log,当负载压力时,发电邮通知管理员。
原理:
1.获取cpu,memory,load average的数值
2.判断数值是否超过自定义的范围,例如(CPU>90%,Memory<10%,load average>2)
3.如数值超过范围,发送电邮通知管理员。发送有时间间隔,每小时只会发送一次。
4.将数值写入log。
5.设置crontab 每30秒运行一次。

ServerMonitor.sh

#!/bin/bash  # 系统监控,记录cpu、memory、load average,当超过规定数值时发电邮通知管理员  # *** config start ***  # 当前目录路径 ROOT=$(cd "$(dirname "$0")"; pwd)  # 当前服务器名 HOST=$(hostname)  # log 文件路径 CPU_LOG="${ROOT}/logs/cpu.log" MEM_LOG="${ROOT}/logs/mem.log" LOAD_LOG="${ROOT}/logs/load.log"  # 通知电邮列表 NOTICE_EMAIL='[email protected]'  # cpu,memory,load average 记录上一次发送通知电邮时间 CPU_REMARK='/tmp/servermonitor_cpu.remark' MEM_REMARK='/tmp/servermonitor_mem.remark' LOAD_REMARK='/tmp/servermonitor_loadaverage.remark'  # 发通知电邮间隔时间 REMARK_EXPIRE=3600 NOW=$(date +%s)  # *** config end ***   # *** function start ***  # 获取CPU占用 function GetCpu() {   cpufree=$(vmstat 1 5 |sed -n '3,$p' |awk '{x = x + $15} END {print x/5}' |awk -F. '{print $1}')   cpuused=$((100 - $cpufree))   echo $cpuused    local remark   remark=$(GetRemark ${CPU_REMARK})    # 检查CPU占用是否超过90%   if [ "$remark" = "" ] && [ "$cpuused" -gt 90 ]; then     echo "Subject: ${HOST} CPU uses more than 90% $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}     echo "$(date +%s)" > "$CPU_REMARK"   fi }  # 获取内存使用情况 function GetMem() {   mem=$(free -m | sed -n '3,3p')   used=$(echo $mem | awk -F ' ' '{print $3}')   free=$(echo $mem | awk -F ' ' '{print $4}')   total=$(($used + $free))   limit=$(($total/10))   echo "${total} ${used} ${free}"    local remark   remark=$(GetRemark ${MEM_REMARK})    # 检查内存占用是否超过90%   if [ "$remark" = "" ] && [ "$limit" -gt "$free" ]; then     echo "Subject: ${HOST} Memory uses more than 90% $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}     echo "$(date +%s)" > "$MEM_REMARK"   fi }  # 获取load average function GetLoad() {   load=$(uptime | awk -F 'load average: ' '{print $2}')   m1=$(echo $load | awk -F ', ' '{print $1}')   m5=$(echo $load | awk -F ', ' '{print $2}')   m15=$(echo $load | awk -F ', ' '{print $3}')   echo "${m1} ${m5} ${m15}"    m1u=$(echo $m1 | awk -F '.' '{print $1}')    local remark   remark=$(GetRemark ${LOAD_REMARK})    # 检查是否负载是否有压力   if [ "$remark" = "" ] && [ "$m1u" -gt "2" ]; then     echo "Subject: ${HOST} Load Average more than 2 $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}     echo "$(date +%s)" > "$LOAD_REMARK"   fi }  # 获取上一次发送电邮时间 function GetRemark() {   local remark    if [ -f "$1" ] && [ -s "$1" ]; then     remark=$(cat $1)      if [ $(( $NOW - $remark )) -gt "$REMARK_EXPIRE" ]; then       rm -f $1       remark=""     fi   else     remark=""   fi    echo $remark }   # *** function end ***  cpuinfo=$(GetCpu) meminfo=$(GetMem) loadinfo=$(GetLoad)  echo "cpu: ${cpuinfo}" >> "${CPU_LOG}" echo "mem: ${meminfo}" >> "${MEM_LOG}" echo "load: ${loadinfo}" >> "${LOAD_LOG}"  exit 0 


监控网站是否异常
shell 监控网站是否异常的脚本,如有异常自动发电邮通知管理员。
流程:
1.检查网站返回的http_code是否等于200,如不是200视为异常。
2.检查网站的访问时间,超过MAXLOADTIME(10秒)视为异常。
3.发送通知电邮后,在/tmp/monitor_load.remark记录发送时间,在一小时内不重复发送,如一小时后则清空/tmp/monitor_load.remark。

#!/bin/bash  SITES=("http://web01.example.com" "http://web02.example.com") # 要监控的网站 NOTICE_EMAIL='[email protected]'     # 管理员电邮 MAXLOADTIME=10# 访问超时时间设置 REMARKFILE='/tmp/monitor_load.remark' # 记录时否发送过通知电邮,如发送过则一小时内不再发送 ISSEND=0   # 是否有发送电邮 EXPIRE=3600  # 每次发送电邮的间隔秒数 NOW=$(date +%s)  if [ -f "$REMARKFILE" ] && [ -s "$REMARKFILE" ]; then   REMARK=$(cat $REMARKFILE)      # 删除过期的电邮发送时间记录文件   if [ $(( $NOW - $REMARK )) -gt "$EXPIRE" ]; then     rm -f ${REMARKFILE}     REMARK=""   fi else   REMARK="" fi  # 循环判断每个site for site in ${SITES[*]}; do    printf "start to load ${site}\n"   site_load_time=$(curl -o /dev/null -s -w "time_connect: %{time_connect}\ntime_starttransfer: %{time_starttransfer}\ntime_total: %{time_total}" "${site}")   site_access=$(curl -o /dev/null -s -w %{http_code} "${site}")   time_total=${site_load_time##*:}    printf "$(date '+%Y-%m-%d %H:%M:%S')\n"   printf "site load time\n${site_load_time}\n"   printf "site access:${site_access}\n\n"    # not send   if [ "$REMARK" = "" ]; then     # check access     if [ "$time_total" = "0.000" ] || [ "$site_access" != "200" ]; then       echo "Subject: ${site} can access $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}       ISSEND=1     else       # check load time       if [ "${time_total%%.*}" -ge ${MAXLOADTIME} ]; then         echo "Subject: ${site} load time total:${time_total} $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}         ISSEND=1       fi     fi   fi  done  # 发送电邮后记录发送时间 if [ "$ISSEND" = "1" ]; then   echo "$(date +%s)" > $REMARKFILE fi  exit 0 


  • 上一条:
    script_tool_for_linux.bash: Linux 环境下的 hosts 一键部署脚本
    下一条:
    Linux下Shell编程快捷键大全(日常整理)
  • 昵称:

    邮箱:

    0条评论 (评论内容有缓存机制,请悉知!)
    最新最热
    • 分类目录
    • 人生(杂谈)
    • 技术
    • linux
    • Java
    • php
    • 框架(架构)
    • 前端
    • ThinkPHP
    • 数据库
    • 微信(小程序)
    • Laravel
    • Redis
    • Docker
    • Go
    • swoole
    • Windows
    • Python
    • 苹果(mac/ios)
    • 相关文章
    • 在Linux系统中使用Iptables实现流量转发功能流程步骤(0个评论)
    • vim学习笔记-入门级需要了解的一些快捷键(0个评论)
    • 在centos7系统中实现分区并格式化挂载一块硬盘到/data目录流程步骤(0个评论)
    • 在Linux系统种查看某一个进程所占用的内存命令(0个评论)
    • Linux中grep命令中的10种高级用法浅析(0个评论)
    • 近期文章
    • 智能合约Solidity学习CryptoZombie第三课:组建僵尸军队(高级Solidity理论)(0个评论)
    • 智能合约Solidity学习CryptoZombie第二课:让你的僵尸猎食(0个评论)
    • 智能合约Solidity学习CryptoZombie第一课:生成一只你的僵尸(0个评论)
    • 在go中实现一个常用的先进先出的缓存淘汰算法示例代码(0个评论)
    • 在go+gin中使用"github.com/skip2/go-qrcode"实现url转二维码功能(0个评论)
    • 在go语言中使用api.geonames.org接口实现根据国际邮政编码获取地址信息功能(1个评论)
    • 在go语言中使用github.com/signintech/gopdf实现生成pdf分页文件功能(0个评论)
    • gmail发邮件报错:534 5.7.9 Application-specific password required...解决方案(0个评论)
    • 欧盟关于强迫劳动的规定的官方举报渠道及官方举报网站(0个评论)
    • 在go语言中使用github.com/signintech/gopdf实现生成pdf文件功能(0个评论)
    • 近期评论
    • 122 在

      学历:一种延缓就业设计,生活需求下的权衡之选中评论 工作几年后,报名考研了,到现在还没认真学习备考,迷茫中。作为一名北漂互联网打工人..
    • 123 在

      Clash for Windows作者删库跑路了,github已404中评论 按理说只要你在国内,所有的流量进出都在监控范围内,不管你怎么隐藏也没用,想搞你分..
    • 原梓番博客 在

      在Laravel框架中使用模型Model分表最简单的方法中评论 好久好久都没看友情链接申请了,今天刚看,已经添加。..
    • 博主 在

      佛跳墙vpn软件不会用?上不了网?佛跳墙vpn常见问题以及解决办法中评论 @1111老铁这个不行了,可以看看近期评论的其他文章..
    • 1111 在

      佛跳墙vpn软件不会用?上不了网?佛跳墙vpn常见问题以及解决办法中评论 网站不能打开,博主百忙中能否发个APP下载链接,佛跳墙或极光..
    • 2016-11
    • 2017-07
    • 2017-10
    • 2017-11
    • 2018-01
    • 2018-02
    • 2020-03
    • 2020-04
    • 2020-05
    • 2020-06
    • 2021-02
    • 2021-03
    • 2021-04
    • 2021-06
    • 2021-07
    • 2021-08
    • 2021-09
    • 2021-10
    • 2021-11
    • 2021-12
    • 2022-01
    • 2022-03
    • 2022-04
    • 2022-08
    • 2022-11
    • 2022-12
    • 2023-01
    • 2023-02
    • 2023-03
    • 2023-06
    • 2023-07
    • 2023-10
    • 2023-12
    • 2024-01
    • 2024-04
    Top

    Copyright·© 2019 侯体宗版权所有· 粤ICP备20027696号 PHP交流群

    侯体宗的博客