服务器之家:专注于服务器技术及软件下载分享
分类导航

Linux|Centos|Ubuntu|系统进程|Fedora|注册表|Bios|Solaris|Windows7|Windows10|Windows11|windows server|

服务器之家 - 服务器系统 - Linux - linux 服务器性能分析及优化的一些方法

linux 服务器性能分析及优化的一些方法

2020-10-29 22:47后台开发深度探索 Linux

本文主要为大家分享linux 服务器性能分析及优化的一些方法,有需要的朋友可以参考下

1. 首先查看网络连接数

netstat -an

或者 ss -s 进行统计,如果带上-p参数的话当连接数比较多的时候就会比较慢

或者查看系统:

/proc/net/sockstat:

sockets: used 160

TCP: inuse 0 orphan 0 tw 0 alloc 4 mem 0

UDP: inuse 0 mem 1

UDPLITE: inuse 0

RAW: inuse 0

FRAG: inuse 0 memory 0

2. 系统dmesg提示 socket out of memory

首先查看系统socket使用了多少,参考1.

3. 查看系统给tcp分配的内存大小限制

cat /proc/sys/net/ipv4/tcp_rmem #tcp read buffer bytes

4096 87380 629145

第一项是buffer最小4096字节,第二项是默认值87380字节,第三项是read buffer 最大限制629145 字节

cat /proc/sys/net/ipv4/tcp_wmem #tcp write buffer bytes

write buffer与read buffer类似

cat /proc/sys/net/ipv4/tcp_mem #tcp memory pages

21498 28665 42996

第一个值是内存使用的下限;第二个值是内存压力模式开始对缓冲区使用应用压力的上限;第三个值是内存使用的上限。在这个层次上可以将报文丢弃,从而减少对内存的使用socket out of memory。可以结合sockstat里的统计数据分析tcp使用内存是否超过了限制,注意这里单位是页,查看页大小getconf PAGESIZE

另外可以查看tcp读写发送窗口默认值:

/proc/sys/net/core/rmem_default

/proc/sys/net/core/rmem_max

/proc/sys/net/core/wmem_default

/proc/sys/net/core/wmem_max

另外socket out of memory 也有可能是孤儿socket过多导致的。

4. 内核配置最大的孤儿socket数:

cat /proc/sys/net/ipv4/max_orphans

4096

查看孤儿socket

cat /proc/net/sockstat

sockets: used 403

TCP: inuse 4 orphan 0 tw 0 alloc 10 mem 1

UDP: inuse 12 mem 7

UDPLITE: inuse 0

RAW: infuse 0

FRAG: inuse 0 memory 0

注意这里的orphan 往往会被内核x2 或者x4,所以有时候看到这里的orphan数比较小,但是却有out of socket memory的提示,有可能就是这个放大倍数导致的。关于孤儿socket 可以参考:孤儿socket

5. 一个tcp socket占用多大内存

首先socket包括本地ip、端口,对端ip、端口;发送、接收缓冲区等(跟配置有关)。

如果按照上面最小的读写缓冲区来算那么一个socket大概占用8K的内存。

如果单从一个socket占用的内存来看,一个8GB的内存,一般情况下可以承受100万得sock长连接,前提是系统文件句柄要调大

tcp内存最大也要进行调整。

tcp内核参数调优

tcp参数调优

6. 查看系统总共使用了多少文件描述符

cat /proc/sys/fs/file-nr

4096 0 9000

第一项就是当前系统已经打开的文件句柄(包括socket ),最后一项是整个系统最大可以打开的文件句柄数

cat /proc/sys/fs/file-max

系统最大的文件句柄数

cat /proc/sys/fs/nr_open

1048576

系统配置的单个进程最大可以打开的文件句柄数

7.dmesg or dmesg -T

查看内核的错误信息,比如tcp链接太多,句柄不够用,内存不足导致某些进程被kill掉

8. 使用slabtop 查看内核内存分配

IOStat -d 1 10 -x

9. 查看系统统计

vmstat -n 1 10

可以通过该命令动态观察swap内存是否在发生变化,如果一直在增长,那么可以初步断定 系统内存不够用。

当cache、buffer占用大量内存是可以通过调整内核参数释放改内存:

$sync (必须要先执行)

$ echo “3” > /proc/sys/vm/drop_caches (该值默认是0,不释放)

10. tcp keepalive time 如果想开启tcp 半打开状态的连接的回收,单单配置keep alive是不够的,需要在程序中调用setsockopt 开启探测功能,否则即使系统侧配置了keepalive time也是不够的。

11. top 然后按数字1,看各个cpu是否存在不均衡的情况,如果是则看下系统软中断一列的cpu是否使用过高,如果是则进一步确认是不是网卡软中断引起的:

linux 服务器性能分析及优化的一些方法

Fig 1:各个cpu使用情况

下图是系统中断在各个cpu的分布,通过分析上下两个图就可以知道是不是因为网卡导致软中断过高,如果是网卡收发包软中断过高则需要进行多网卡队列配置优化或者是收发包软中断优化(RPS/RFS)

linux 服务器性能分析及优化的一些方法

查看网卡是否支持多网卡队列可以通过以下命令:

ethtool -L eth0

RPS/RFS 优化配置(原理就是根据四元组进行hash选则对应的CPU进行CPU负载均衡、提升CPU缓存命中率):

RPS:

RPS指定哪些接收队列需要通过rps平均到配置的cpu列表上。

/sys/class/net/(dev)/queues/rx-(n)/rps_cpus

RFS:

每个队列的数据流表总数可以通过下面的参数来设置:

该值设置成rps_sock_flow_entries/N,其中N表示设备的接收队列数量。

/sys/class/net/(dev)/queues/rx-(n)/rps_flow_cnt

全局数据流表(rps_sock_flow_table)的总数,红帽是建议设置成32768,一般设置成最大并发链接数量

/proc/sys/net/core/rps_sock_flow_entries

延伸 · 阅读

精彩推荐
  • Linuxlinux top命令详解

    linux top命令详解

    这篇文章主要介绍了linux top命令详解,小编觉得挺不错的,现在分享给大家,也给大家做个参考。一起跟随小编过来看看吧...

    sparkdev5622022-03-01
  • Linuxssh 登录很慢该如何解决

    ssh 登录很慢该如何解决

    这篇文章主要介绍了ssh 登录很慢该如何解决的相关资料,这里提供了两种方法,DNS反向解析及关闭ssh的gssapi认证的解决办法,需要的朋友可以参考下...

    linuxeye9922021-12-16
  • Linux将 Linux 终端与 Nautilus 文件管理器结合起来

    将 Linux 终端与 Nautilus 文件管理器结合起来

    Nautilus 是 GNOME 桌面环境中的图形化文件浏览器。你可以使用它来访问和管理系统中的文件和文件夹。 尽管并非所有人都喜欢使用终端来管理文件和目录,...

    未知812023-08-08
  • Linuxlinux设置tomcat自启动的方法

    linux设置tomcat自启动的方法

    这篇文章主要介绍了linux设置tomcat自启动的方法,需要的朋友可以参考下...

    Linux教程网8512021-10-10
  • Linux在Linux系统中创建新的亚马逊AWS访问密钥的方法

    在Linux系统中创建新的亚马逊AWS访问密钥的方法

    如何在Linux系统中创建新的亚马逊AWS访问密钥?我在配置一个需要访问我的亚马逊AWS帐号的应用时被要求提供AWS访问密钥ID和秘密访问密钥,我怎样创建一个...

    Linux教程网6182019-10-30
  • Linuxlinux驱动程序开发详细介绍

    linux驱动程序开发详细介绍

    前提,一般来说内核代码的错误可能会引起一个用户进程的死亡,或者整个系统的瘫痪,更严重的后果,可能导致磁盘损伤~因此建议最好有一台实验机进行...

    Linux教程网5392019-12-17
  • LinuxLinux系统下无法卸载挂载的目录怎么办?

    Linux系统下无法卸载挂载的目录怎么办?

    我们在日常运维中经常性会遇到需要进行磁盘的扩容、卸载、挂载等操作,但是有时候这个系统上跑的应用并没有停止或者有其他的运维同事在操作这个目...

    今日头条10302020-12-30
  • Linux理解 Linux/Unix 登录脚本的技巧

    理解 Linux/Unix 登录脚本的技巧

    有一些常见的情况,例如从Debian的包管理程序到Iaas的管理中,很多任务需要设置环境变量才能正常运行。 有时,程序通常只需要在 登陆时运行一次,例如...

    未知1042023-05-12