0

0

systemd-oomd 杀错进程或不杀的配置与优先级调整经验

冰川箭仙

冰川箭仙

发布时间:2026-01-20 17:38:02

|

180人浏览过

|

来源于php中文网

原创

systemd-oomd 是 systemd 提供的用户空间 oom 管理器,基于 cgroup 和进程行为动态评分,在内核 oom killer 前主动终止进程;需通过精准 cgroup 划分、合理设置 memorymax/oomscoreadjust 及调整压力阈值来避免误杀或不杀。

systemd-oomd 杀错进程或不杀的配置与优先级调整经验

systemd-oomd 是 systemd 提供的用户空间 OOM(Out-of-Memory)管理器,它在内核 OOM Killer 触发前主动干预内存压力,目标是更智能、可配置地终止进程。但它确实存在“杀错”或“该杀不杀”的问题——常见于默认策略过于宽泛、进程分类不准、或与传统 oom_score_adj 冲突。以下基于实际运维经验,给出关键配置要点和调优逻辑。

理解 systemd-oomd 的决策逻辑

systemd-oomd 不依赖 /proc/$PID/oom_score_adj,而是基于 cgroup 层级结构 + 进程行为特征(如内存增长速率、是否为“桌面交互类”)动态评分。它只作用于属于 systemd 管理的 scope 或 slice 的进程(即通过 systemd-run、systemd services 启动,或被自动归入 user.slice/system.slice 的进程)。独立启动的进程(如直接 bash 中 ./app)默认落入 system.slice,但缺乏明确资源归属,容易被误判。

它默认启用三类策略:

  • MemoryPressure:当 cgroup 内存压力持续高于阈值(默认 80%)且增长快时触发
  • SwapFree:交换空间低于阈值(默认 10%)时参与决策
  • WorkingSetSize:对“工作集”过大的进程倾向终止(避免只看 RSS)

防止杀错:精准划分 cgroup 并设置保护等级

核心原则:让关键进程处于有明确定义、可配置的 cgroup 中,并显式声明其重要性。

Reecho睿声
Reecho睿声

Reecho AI:超拟真语音合成与瞬时语音克隆平台

下载
  • systemd-run --scope --scope-property=MemoryAccounting=true --scope-property=MemoryMax=2G myapp 启动应用,确保它被纳入独立 scope,便于监控和隔离
  • 为关键服务(如数据库、消息队列)创建专用 slice:
    sudo systemctl set-property mydb.service MemoryMax=4G CPUWeight=100 IOWeight=100
    配合 OOMScoreAdjust=-900(仍需保留,作为双重保险)
  • 禁用对特定 slice 的 oomd 干预:
    sudo systemctl set-property system.slice ManagedOOMMemPressureLimit=0
    或更彻底:sudo systemctl set-property mycritical.slice ManagedOOM=false

解决“不杀”问题:调整触发灵敏度与权重

systemd-oomd 默认较保守,尤其在低内存但无 swap 的系统上可能迟迟不动作。可通过以下方式增强响应:

  • 降低内存压力触发阈值(单位:百分比):
    sudo systemctl set-property user.slice ManagedOOMMemPressureLimit=50
  • 缩短压力持续时间窗口(单位:秒):
    sudo systemctl set-property system.slice ManagedOOMMemPressureDurationSec=10
  • 强制启用 swap 压力参与决策(即使 swap 很小):
    sudo systemctl set-property system.slice ManagedOOMSwapFreeLimit=5
  • 查看当前生效策略:
    systemctl show --property=ManagedOOM* system.slice

与传统 oom_score_adj 协同而非冲突

systemd-oomd 和内核 OOM Killer 是两套机制,可共存但需注意优先级关系:systemd-oomd 先行动;若它未终止足够内存,内核 OOM Killer 才会 fallback 触发。因此建议:

  • 对必须保活的核心进程(如 sshd、dbus),仍设 OOMScoreAdjust=-1000 —— systemd-oomd 尊重该值,不会选中 -1000 的进程
  • 对“重要但可牺牲”的中间件(如日志收集 agent),设 OOMScoreAdjust=-300,既降低被 systemd-oomd 选中的概率,又保留 fallback 给内核 OOM Killer 的余地
  • 避免将普通进程设为 OOMScoreAdjust=0(默认值)就放任不管 —— 它在 systemd-oomd 眼里就是“无特殊标记”,最易被选中

systemd-oomd 不是黑盒,它的日志(journalctl -u systemd-oomd -f)会详细记录每次决策依据、候选进程列表及最终选择原因。调优必须从日志出发,而不是凭猜测改参数。不复杂但容易忽略。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
什么是中间件
什么是中间件

中间件是一种软件组件,充当不兼容组件之间的桥梁,提供额外服务,例如集成异构系统、提供常用服务、提高应用程序性能,以及简化应用程序开发。想了解更多中间件的相关内容,可以阅读本专题下面的文章。

181

2024.05.11

Golang 中间件开发与微服务架构
Golang 中间件开发与微服务架构

本专题系统讲解 Golang 在微服务架构中的中间件开发,包括日志处理、限流与熔断、认证与授权、服务监控、API 网关设计等常见中间件功能的实现。通过实战项目,帮助开发者理解如何使用 Go 编写高效、可扩展的中间件组件,并在微服务环境中进行灵活部署与管理。

225

2025.12.18

数据库三范式
数据库三范式

数据库三范式是一种设计规范,用于规范化关系型数据库中的数据结构,它通过消除冗余数据、提高数据库性能和数据一致性,提供了一种有效的数据库设计方法。本专题提供数据库三范式相关的文章、下载和课程。

383

2023.06.29

如何删除数据库
如何删除数据库

删除数据库是指在MySQL中完全移除一个数据库及其所包含的所有数据和结构,作用包括:1、释放存储空间;2、确保数据的安全性;3、提高数据库的整体性能,加速查询和操作的执行速度。尽管删除数据库具有一些好处,但在执行任何删除操作之前,务必谨慎操作,并备份重要的数据。删除数据库将永久性地删除所有相关数据和结构,无法回滚。

2108

2023.08.14

vb怎么连接数据库
vb怎么连接数据库

在VB中,连接数据库通常使用ADO(ActiveX 数据对象)或 DAO(Data Access Objects)这两个技术来实现:1、引入ADO库;2、创建ADO连接对象;3、配置连接字符串;4、打开连接;5、执行SQL语句;6、处理查询结果;7、关闭连接即可。

357

2023.08.31

MySQL恢复数据库
MySQL恢复数据库

MySQL恢复数据库的方法有使用物理备份恢复、使用逻辑备份恢复、使用二进制日志恢复和使用数据库复制进行恢复等。本专题为大家提供MySQL数据库相关的文章、下载、课程内容,供大家免费下载体验。

259

2023.09.05

vb中怎么连接access数据库
vb中怎么连接access数据库

vb中连接access数据库的步骤包括引用必要的命名空间、创建连接字符串、创建连接对象、打开连接、执行SQL语句和关闭连接。本专题为大家提供连接access数据库相关的文章、下载、课程内容,供大家免费下载体验。

329

2023.10.09

数据库对象名无效怎么解决
数据库对象名无效怎么解决

数据库对象名无效解决办法:1、检查使用的对象名是否正确,确保没有拼写错误;2、检查数据库中是否已存在具有相同名称的对象,如果是,请更改对象名为一个不同的名称,然后重新创建;3、确保在连接数据库时使用了正确的用户名、密码和数据库名称;4、尝试重启数据库服务,然后再次尝试创建或使用对象;5、尝试更新驱动程序,然后再次尝试创建或使用对象。

420

2023.10.16

JavaScript浏览器渲染机制与前端性能优化实践
JavaScript浏览器渲染机制与前端性能优化实践

本专题围绕 JavaScript 在浏览器中的执行与渲染机制展开,系统讲解 DOM 构建、CSSOM 解析、重排与重绘原理,以及关键渲染路径优化方法。内容涵盖事件循环机制、异步任务调度、资源加载优化、代码拆分与懒加载等性能优化策略。通过真实前端项目案例,帮助开发者理解浏览器底层工作原理,并掌握提升网页加载速度与交互体验的实用技巧。

23

2026.03.06

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Java 教程
Java 教程

共578课时 | 78.3万人学习

国外Web开发全栈课程全集
国外Web开发全栈课程全集

共12课时 | 1万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号