服务端监控

机器监控核心指标

指标这个指标是什么主要监控场景可以提前发现的问题
CPU使用率 > 80%CPU处理计算任务的繁忙程度。超过80%表示剩余计算能力不足20%应用计算、请求处理、数据计算请求排队、响应变慢、任务积压、服务超时
RSS内存使用率 > 80%RSS 全称是 Resident Set Size 即“常驻内存集”,表示进程或容器当前实际占用的物理内存,包括堆内存、线程栈和部分堆外内存等,通常不包括已转移到Swap中的内存应用、容器和进程的实际内存使用情况内存泄漏、频繁GC、容器或进程被OOM杀死
Swap使用率 > 80%Swap是磁盘上的备用内存。物理内存不足时,系统会将暂时不用的数据放入Swap物理内存不足或内存压力较大的机器频繁内存换页、系统变慢、内存耗尽和OOM
系统负载 > 3正在使用CPU、等待CPU或等待磁盘I/O的任务平均数量超过4判断系统整体是否繁忙CPU任务排队、磁盘阻塞、系统卡顿
磁盘繁忙率 > 10%磁盘正在处理读写请求的时间占比超过10%,不是磁盘空间使用率数据库、日志、文件读写、备份任务磁盘I/O瓶颈、读写变慢、接口响应延迟
TCP连接数 > 3000,持续3分钟TCP连接是客户端与服务器之间的网络通信通道,包括浏览器访问服务器、服务之间调用、应用连接数据库等。连接数不等于用户数服务的并发连接情况连接堆积、连接未释放、文件描述符耗尽、新连接失败
TCP重传数升高TCP数据没有成功送达或没有及时收到确认时,系统重新发送数据的次数浏览器与服务器、服务器与服务器之间的网络通信质量网络丢包、网络拥塞、请求变慢和超时
网络流入速率 > 50 MB/s机器每秒接收到的数据超过50 MB,相当于约400 Mbps文件上传、数据同步、接口请求、消息消费入站带宽占满、异常流量、网络拥塞
网络流出速率 > 50 MB/s机器每秒发送出去的数据超过50 MB,相当于约400 Mbps文件下载、接口响应、日志发送、数据同步出口带宽占满、异常下载或数据传输
时间偏移 > 1000 ms机器时间与标准时间源相差超过1秒服务器时间同步日志时间错乱、认证失败、定时任务异常、分布式系统数据错序
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

. . . . .

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值