服务器之家:专注于服务器技术及软件下载分享
分类导航

Linux|Centos|Ubuntu|系统进程|Fedora|注册表|Bios|Solaris|Windows7|Windows10|Windows11|windows server|

服务器之家 - 服务器系统 - Linux - Linux系统内存问题排查的“套路”你掌握了吗?

Linux系统内存问题排查的“套路”你掌握了吗?

2024-01-05 17:04未知服务器之家 Linux

最近一段时间有点忙,有段时间没更新文章了,今天我们一起完成关于内存模块的最后一块拼图,如何高效的找到Linux系统内存的问题。在前面我们讲了内存的基本概念、内存映射、分配和回收、Page Cache、内存泄露相关的案例分析

Linux系统内存问题排查的“套路”你掌握了吗?

最近一段时间有点忙,有段时间没更新文章了,今天我们一起完成关于内存模块的最后一块拼图,如何高效的找到Linux系统内存的问题。在前面我们讲了内存的基本概念、内存映射、分配和回收、Page Cache、内存泄露相关的案例分析。感兴趣的朋友们,可以回过头翻阅查看。

内存性能指标

为了分析内存的性能瓶颈,首先你要知道,怎样衡量内存的性能,也就是性能指标问题。这里又可以分别从整体内存使用情况和进程内存使用情况去观察内存指标。

系统内存使用

Linux系统内存问题排查的“套路”你掌握了吗?

Linux系统free命令输出

  • Used&Free:已用内存和剩余内存很容易理解,就是已经使用和还未使用的内存。
  • Shared:共享内存是通过 tmpfs 实现的,所以它的大小也就是 tmpfs 使用的内存大小。tmpfs 其实也是一种特殊的缓存
  • Available:可用内存是新进程可以使用的最大内存,它包括剩余内存和可回收缓存
  • Buff缓冲区是对原始磁盘块的临时存储,用来缓存将要写入磁盘的数据。这样,内核就可以把分散的写集中起来,统一优化磁盘写入。
  • Cache一部分是磁盘读取文件的页缓存,用来缓存从磁盘读取的数据,可以加快以后再次访问的速度。另一部分,则是Slab 分配器中的可回收内存。

进程内存使用

Linux系统内存问题排查的“套路”你掌握了吗?

  • VIRT、VSZ虚拟内存,包括了进程代码段、数据段、共享内存、已经申请的堆内存和已经换出的内存等。这里要注意,已经申请的内存,即使还没有分配物理内存,也算作虚拟内存。
  • RES、RSS常驻内存是进程实际使用的物理内存,不过,它不包括Swap和共享内存。
  • SHR:共享内存,既包括与其他进程共同使用的真实的共享内存,还包括了加载的动态链接库以及程序的代码段等
  • Swap:是指通过 Swap 换出到磁盘的内存。
  • 缺页异常:
  • Majflt主缺页异常。需要磁盘I/O 介入(比如 Swap)来分配内存。主缺页异常升高,那么内存访问也会慢很多。
  • Minflt:次缺页异常。直接从物理内存中分配内存。

这些内存的性能指标都需要我们熟记并且会用。我把它们汇总成了一个思维导图供大家参考。

Linux系统内存问题排查的“套路”你掌握了吗?

内存性能工具

我们知道了内存的性能指标后,我们还需要学会根据性能指标找工具(性能观察命令),下面表格整理了内存性能指标和工具的关系。

Linux系统内存问题排查的“套路”你掌握了吗?

分析内存性能瓶颈的排查套路

快速定位内存问题,可以先从整体内存使用情况入手,在观察进程的内容使用情况,找出可疑进程后,在进一步分析进程的内存地址空间分布等等;在使用性能工具使用优先选覆盖面大的工具,这样可以同时观察到多个指标。具体的步骤可以分成以下几步:

  • 先用free和top,查看系统整体的内存使用情况。
  • 再用vmstat和pidstat,查看一段时间的趋势,从而判断出内存问题的类型。
  • 最后进行详细分析:
  • pidstat观测到可疑进程,可以继续使用pmap观察进程内存地址分配情况。
  • 可以使用内存分配分析工具memleak,检查是否存在内存泄漏。

系统内存优化建议

  • 禁用Swap:如果必须开启 Swap,降低 swappiness 的值,减少内存回收时 Swap 的使用倾向。
  • 减少内存的动态分配。比如,可以使用内存池、大页(HugePage)等。
  • 尽量使用缓存和缓冲区来访问数据。比如,可以使用堆栈明确声明内存空间,来存储需要缓存的数据;或者用 Redis 这类的外部缓存组件,优化数据的访问。
  • 使用 cgroups 等方式限制进程的内存使用情况。这样,可以确保系统内存不会被异常进程耗尽。通过 /proc/pid/oom_adj ,调整核心应用的 oom_score。这样,可以保证即使内存紧张,核心应用也不会被 OOM 杀死。
  • 根据需要优化Linux内核中关于内存相关参数,一些核心参数如下。
  • vm.swappiness。
  • vm.overcommit_memory。
  • vm.dirty_ratio、vm.dirty_background_ratio。
  • vm.min_free_kbytes。
  • vm.drop_caches。

Linux系统内存问题排查的“套路”你掌握了吗?

延伸 · 阅读

精彩推荐
  • Linux在Linux系统中创建新的亚马逊AWS访问密钥的方法

    在Linux系统中创建新的亚马逊AWS访问密钥的方法

    如何在Linux系统中创建新的亚马逊AWS访问密钥?我在配置一个需要访问我的亚马逊AWS帐号的应用时被要求提供AWS访问密钥ID和秘密访问密钥,我怎样创建一个...

    Linux教程网6182019-10-30
  • Linuxlinux设置tomcat自启动的方法

    linux设置tomcat自启动的方法

    这篇文章主要介绍了linux设置tomcat自启动的方法,需要的朋友可以参考下...

    Linux教程网8512021-10-10
  • Linuxlinux top命令详解

    linux top命令详解

    这篇文章主要介绍了linux top命令详解,小编觉得挺不错的,现在分享给大家,也给大家做个参考。一起跟随小编过来看看吧...

    sparkdev5622022-03-01
  • Linux理解 Linux/Unix 登录脚本的技巧

    理解 Linux/Unix 登录脚本的技巧

    有一些常见的情况,例如从Debian的包管理程序到Iaas的管理中,很多任务需要设置环境变量才能正常运行。 有时,程序通常只需要在 登陆时运行一次,例如...

    未知1042023-05-12
  • Linuxlinux驱动程序开发详细介绍

    linux驱动程序开发详细介绍

    前提,一般来说内核代码的错误可能会引起一个用户进程的死亡,或者整个系统的瘫痪,更严重的后果,可能导致磁盘损伤~因此建议最好有一台实验机进行...

    Linux教程网5392019-12-17
  • Linuxssh 登录很慢该如何解决

    ssh 登录很慢该如何解决

    这篇文章主要介绍了ssh 登录很慢该如何解决的相关资料,这里提供了两种方法,DNS反向解析及关闭ssh的gssapi认证的解决办法,需要的朋友可以参考下...

    linuxeye9922021-12-16
  • Linux将 Linux 终端与 Nautilus 文件管理器结合起来

    将 Linux 终端与 Nautilus 文件管理器结合起来

    Nautilus 是 GNOME 桌面环境中的图形化文件浏览器。你可以使用它来访问和管理系统中的文件和文件夹。 尽管并非所有人都喜欢使用终端来管理文件和目录,...

    未知812023-08-08
  • LinuxLinux系统下无法卸载挂载的目录怎么办?

    Linux系统下无法卸载挂载的目录怎么办?

    我们在日常运维中经常性会遇到需要进行磁盘的扩容、卸载、挂载等操作,但是有时候这个系统上跑的应用并没有停止或者有其他的运维同事在操作这个目...

    今日头条10302020-12-30