日期范围
163
全部讨论数
Bugfix重要分析 success作者:gregkh2026/08/19 19:144 封邮件

FAILED: patch "[PATCH] sched_ext: Take cgroup_lock() first in scx_cgroup_lock()" failed to apply to 6.18-stable tree

scx_cgroup_lock() 中先取 rwsem 写锁再 cgroup_lock() 的顺序会通过 kernfs 与 enable/rmdir/cpu.weight 形成死锁闭环。修复把 cgroup_lock() 提到写锁之前断开环路,并把该 patch 连同两个 stable-dep(warning 翻转、enable/disable 路径重构)一起按 6.18-stable 的 kernel/sched/ext.c 路径回迁。

lore
Bugfix分析 success作者:Greg Kroah-Hartman2026/08/19 17:17286 封邮件

[PATCH 7.1 001/271] mount: honour SB_NOUSER in the new mount API

本 thread 是 Greg Kroah-Hartman发布的 Linux 7.1.9-rc1 stable review,271 枚 patch + 13 封 Tested-by 回复。scheduler 子树相关8 枚 patch集中修复 sched_ext sub-sched 启停 race、cgroup_lock 顺序、psi psimon kthread 与 rtpoll_timer 生命周期,以及 rqspinlock deadlock 路径的 tail 重置。整体是稳定分支的合订公告,分类为 bugfix 序列。

lore
RFC重要分析 success作者:Joshua Hahn2026/08/19 11:462 封邮件

[RFC PATCH v3 00/14] Introduce tiered memcg limits

Joshua Hahn 提出一套 14 patch 的 RFC,把 memory.{min,low,high,max} 在每个内存层级(DRAM/CXL/PMEM 等)按系统容量比例缩放,从而防止先到的 cgroup 独占高速层。在 1TB 双层机器上的测试显示,多 workload 在 DRAM/CXL 上的占用极差从 7.10x 降到 1.06x,作业完成时间极差从 54.9s 降到 26.1s。Song Hu 另指出 calculate_high_delay() 存在 pre-existing 整数溢出,建议作独立 fix。

lore
Bugfix重要分析 success作者:gregkh2026/08/19 03:302 封邮件

FAILED: patch "[PATCH] sched/psi: Shut down rtpoll_timer in psi_cgroup_free()" failed to apply to 5.15-stable tree

上游 commit 5457025fa8ca 把 psi rtpoll_timer 的关闭从 trigger 销毁路径移到 psi_cgroup_free(),用 timer_shutdown_sync() 一次性绑定 group 生命周期,消除调度器热路径 re-arm 导致的 use-after-free。该补丁 cherry-pick 到 5.15-stable 失败,Greg KH 发出 FAILED 通知。Sasha Levin 随后提交手工适配版,把 cgroup->psi-> 指针解引用改为内嵌的 cgroup->psi.,并把 rtpoll_* 成员名改回 poll_*。

lore
其它分析 success作者:Liang Hao2026/08/18 23:191 封邮件

[PATCH] sched/hrtick: Name the minimum slice and derive the rearm slack

本 patch 把 hrtick 子系统中硬编码的 10000ns floor 与 5000ns rearm 阈值抽成两个命名宏,并显式把余量定义为最小切片的一半,仅提升可读性、不改变行为。作者本人也提出疑问:5us 阈值当年是否刻意作为 10us 的一半引入,等维护者澄清历史语义后再决定是否合入。

lore
其它重要分析 success作者:Luo Gengkun2026/08/18 22:424 封邮件

[PATCH v9 1/2] sched/cache: Reduce the overhead of task_cache_work by only scan the visisted cpus

本系列补丁为 cache-aware scheduling 引入 visited_cpus cpumask,让 task_cache_work() 只扫描最近真正访问过的 CPU,把多 NUMA 系统中的扫描 CPU 数从 384 降到 16 左右,Redis p99 延迟下降约 25%。Chen Yu C 在 review 中进一步指出单线程进程 visited_cpus 位累积以及跨 NUMA 抖动两个潜在风险,作者倾向于不加 gate。

lore
RFC重要分析 success作者:Vlastimil Babka (SUSE)2026/08/18 19:404 封邮件

[PATCH RFC 0/5] allow kfree_nolock() handle kmalloc() objects

Vlastimil Babka 发布5 patch RFC,把 kfree_nolock() 从只能释放 kmalloc_nolock() 对象扩展为可释放任意 kmalloc() 对象(含 kfence、kmemleak 注册对象、large_kmalloc),必要时通过 irq_work 延迟释放。调度器据此把 set_cpus_allowed_force() 中的 kfree_rcu() 替换为 kfree_nolock(),避免 RCU grace period 延迟。Hao Li 给出 Reviewed-by;Catalin Marinas 对 kmemleak 扫描期间 defer...

lore
Bugfix分析 success作者:Eric Kim2026/08/18 11:491 封邮件

[PATCH v3] sched/fair: Reset NUMA fault locality after scan period update

Eric Kim 的 v3 patch 修复 update_task_scan_period() 在 period==0 分支提前 return 导致 numa_faults_locality 未被清零的 bug。原代码会让上一窗口的旧 locality 反复被计入下一个窗口,触发 numa_scan_period 持续翻倍直至 numa_scan_period_max,把 task 永久冻结在错误 NUMA 节点。修复方法是把 return 改为 goto out,强制所有退出路径都走尾部 memset cleanup。v2 已按 Peter Zijlstra 建议复用 out 标签,v3 ...

lore
其它重要分析 success作者:shisiyuan2026/08/17 22:543 封邮件

[PATCH] sched/psi: add cpu_prio pressure metric for high-priority task stalls

该补丁在 PSI 中新增 cpu_prio 资源,只统计静态优先级不高于阈值的任务等待 CPU 的时长,以隔离延迟敏感负载的争用信号。维护者 Peter Zijlstra 直接回 Yeah, I think not. 拒绝,Michal Koutny 进一步指出把目标任务放进独立 cgroup 后读取 cpu.pressure 已经能做到同样效果,因此没有继续迭代。

lore
RFC重要分析 success作者:Xukai Wang2026/08/16 13:174 封邮件

[PATCH RFC v2] sched/proxy: Defer donor commit until proxy resolution

Xukai Wang 提议把 pick_next_task() 的类提交语义(put_prev_set_next_task + rq_set_donor)推迟到 __schedule() 中 find_proxy_task() 解析成功之后执行,避免 proxy 解析失败时对 blocked donor 的投机性 set_next 与撤销。v2 同时把 zap_balance_callbacks() 收回 proxy_resched_idle(),并把候选与已提交 donor 在 proxy_deactivate / proxy_migrate_task 中显式区分。John Stultz 要...

lore
每页
上一页13 / 17下一页