
最近一直收到某个服务pod容器内存超过80%的告警,堆内存加上堆外内存目前看也只有1G左右,但pod内存却达到4G多,查来查去查到active_file对应的logs占用大量内存,目前现状是k8s中springboot服务日志挂载到宿主机/logs目录,/logs目录的所有日志大小有3G,容器内存显示也包含日志的3G,即使挂载出来了也没生效?
挂载设置如下:
volumeMounts:
- mountPath: /logs
name: logs-volume
volumes:
- hostPath:
path: /logs
type: ''
name: logs-volume这里查询资料,K8s/Docker 对容器的内存统计基于 Linux Cgroup 的 memory.usage_in_bytes,该值包含两部分:
# 查看cgroup内存统计,关注 rss 字段(进程实际占用),cache 字段是可回收的文件缓存
cat /sys/fs/cgroup/memory/memory.stat
手动清理 Page Cache(临时方案)
进入容器或宿主机执行(需要权限):
# 清理文件缓存,不会影响运行
echo 1 > /proc/sys/vm/drop_caches当SpringBoot应用向/logs 目录写入 3G 日志时:
/logs 通过 hostPath 挂载到宿主机磁盘,容器内进程写入的所有日志数据都会先进入 Page Cache这部分 3G 的缓存数据会被完整统计到容器的内存使用量中
container_memory_working_set_bytes)时使用公式:总内存使用 - 非活跃文件缓存,而频繁写入的日志文件属于"活跃文件(active_file)",不会被扣除,因此最终显示的内存占用就包含了这3G日志大小
关键点是:即使挂载到了宿主机,但在大量请求服务时,服务在读写日志文件,这时就会一直在操作日志文件没有释放,在 cgroup 的内存统计中,哪个进程触发了 I/O,产生的 Page Cache 就归到哪个进程的 cgroup 里。但之前已经轮换的日志压缩文件不会占用。
还有一点,就是多个一个服务的多个实例在同一个节点,那操作的日志文件就会两个实例同时进行读写 这就可能会导致其中一个实例不会释放这个日志文件或操作轮转失败 一直存在 那内存就会越来越高。