日期范围
62
其它讨论数
其它重要分析 success作者:Shrikanth Hegde2026/08/27 21:3727 封邮件

[PATCH v10 00/12] sched, steal_governor: Introduce preferred CPUs and steal-driven vCPU backoff

本系列(v10,12 patch)在调度器核心引入 cpu_preferred_mask 与 wakeup/tick-push/load-balance 三处 hint,同时新增 CONFIG_STEAL_GOVERNOR 模块 drivers/virt/steal_governor.c,按 steal time 高低阈值动态放缩 preferred CPU 集合,用于在 paravirt 重载场景缓解 vCPU 抢占。Review 关注点集中在 x86/KVM/Xen 上默认阈值被 possible/online 比稀释、Xen dom0 加载副作用、ARM64 上 32-bit 任务在 t...

lore
其它分析 failed作者:Kayra Cizmeci2026/08/27 02:447 封邮件

[PATCH 1/2] sched/fair: reuse the ENQUEUE_DELAYED calculation in enqueue_task_fair()

sched/fair: reuse the ENQUEUE_DELAYED calculation in enqueue_task_fair()。Claude 分析失败,当前使用规则 fallback:该讨论被归为 other,共 7 封邮件。

lore
其它重要分析 success作者:Byungchul Park2026/08/25 21:19107 封邮件

[PATCH v19 00/40] DEPT(DEPendency Tracker)

Byungchul Park 提交 DEPT (DEPendency Tracker) v19 共 40 个 patch。该框架通过追踪 wait/event 三元组构建事件依赖图,捕获 folio_lock、wait_for_completion、dma-fence、RCU 等不被 lockdep 覆盖的同步原语间的死锁。本期新增 proc 依赖图接口、外部 wgen 机制以支持 PG_locked 跟踪,并配合 CONFIG_DEPT_AGGRESSIVE_TIMEOUT_WAIT 区分 timeout 环。v19 rebase 到 v7.0、文档迁入 dev-tools/,并处理了 sy...

lore
其它重要分析 success作者:Peter Zijlstra2026/08/24 21:5334 封邮件

[PATCH v3 0/7] sched: Flatten the pick

Peter Zijlstra 的 v3 系列把 cgroup 层级权重从 1/N^d 衰减修正为可切换的五档算法(up / smp / max / concur / tasks),新默认 concur 通过 min(M,N) 把组内有效权重稳定在 1;并以 sched/eevdf 单 rq 化把 pick_next_task 路径上的中间 group se 移除,目标是降低 P99 调度延迟。后续 tip-bot2 合入与 Chen Yu 的 u32 溢出 fix 把整套改造落到 sched/core,但 wake_affine_weight 在新权重下的退化仍在持续追讨。

lore
其它重要分析 success作者:Greg Kroah-Hartman2026/08/21 23:01357 封邮件

[PATCH 6.12 011/337] netfilter: br_netfilter: Reallocate headroom if necessary in neigh_hh_bridge()

本系列是 Greg Kroah-Hartman 发布的 Linux 6.12.103-rc1 稳定分支 review,共 337 个 patch,覆盖 netfilter、sched、scsi、drm、alsa、bluetooth、hwmon、mm、kvm、net 等 30 多个子系统的 bugfix 与少量 cleanup/feature。关键改动包括 sched/deadline 仅在 dl_server 运行中启用新唤醒规则、cpufreq/schedutil 在所有 sg_cpu 初始化后发布 util hook、neigh_hh_bridge 重新分配 headroom、SIP NA...

lore
其它分析 success作者:Hongyan Xia2026/08/20 18:482 封邮件

[PATCH RESEND] sched: Convert paravirt_steal to new static key APIs

本 PATCH RESEND 把 paravirt_steal_enabled 与 paravirt_steal_rq_enabled 两个全局静态键从已废弃的 raw static_key 接口替换为新的 DEFINE_STATIC_KEY_FALSE / static_branch_* API,覆盖 arm64、loongarch、powerpc、riscv、x86 vmware/KVM 与 Xen time 等 10 个文件,新增/删除各 21 行,零净增减、无功能改动。Shrikanth Hegde 的回复目前只是引用原 patch 上下文,尚未给出实质评审意见,仍待后续回复。

lore
其它重要分析 success作者:Luigi Rizzo2026/08/20 18:362 封邮件

[PATCH] sched/cpupri: Remove count field from struct cpupri_vec

Luigi Rizzo 提议删除 struct cpupri_vec 的 count 字段及配套的 atomic 操作与 smp_mb 屏障。动机是在 220 核 ARM 上,软中断 CPU 因 irq_thread 频繁调用 cpupri_set() 而有约 25% 时间耗在该函数;移除后该比例降至 2% 以内,且 RT 任务路由仍由 rq->lock 在 find_lock_lowest_rq 中兜底。v2 增加了 cpupri_find 的 benchmark 与无 barrier 安全性的注释。

lore
其它分析 success作者:Hongyan Xia2026/08/20 10:218 封邮件

[PATCH RESEND] sched: Move some scheduler fields to new static branch API

本 patch 是清理重构,把 fair.c 中的 __cfs_bandwidth_used 和 core.c 中的 preempt_dynamic_key_* 宏从旧的 struct static_key / static_key_* API 迁到新的 static_branch_* 系列,作者明确说明无功能变化。线程中 Peter Zijlstra 表示会和 Mark Rutland 的更大清理系列合并,预计最终只保留 lazy preempt 检查相关的 key。该改动只影响 2 个文件、13 行增删,评审重点是 API 命名一致性而非功能回归。

lore
其它分析 success作者:Hongyan Xia2026/08/19 16:131 封邮件

[PATCH RESEND] sched/feat: Use the new static key API for sched_feat

本 patch 把过时的 struct static_key 数组 sched_feat_keys 改造为 union sched_feat_key,并用 sched_feat_branch_true/false 两个 helper 把 SCHED_FEAT 宏展开桥接到 struct static_key_true/false 新 API。改动集中在 kernel/sched/debug.c 与 sched.h,共 +19/-10 行,作者声明零功能变更,仅完成 deprecation 迁移;这是 RESEND 拆分后的单 patch 单独提交,便于单挑 review。

lore
其它分析 success作者:Vladimir Zapolskiy2026/08/19 16:072 封邮件

[PATCH] sched: Remove unneeded function type cast in do_balance_callbacks()

Vladimir Zapolskiy 提交一个一行清理 patch,删除 kernel/sched/core.c 中 do_balance_callbacks() 对 balance_callback->func 的多余类型转换。Peter Zijlstra 确认并指出该 cast 是 callback_head 时代的历史残留,随着 commit 8e5bad7dccec 引入 struct balance_callback 后已不再需要,删除后代码更整洁、对 CFI 更友好。

lore
其它分析 success作者:Greg Kroah-Hartman2026/08/19 02:03464 封邮件

[PATCH 5.15 001/456] nvmet-tcp: Fix potential UAF when ddgst mismatch

Greg KH 一次性发布 Linux 5.15 LTS 5.15.216-rc1 的 stable review 公告,0/456 cover letter + 456 个补丁 + 7 位 maintainer/tester 测试回复,整批以 bugfix 为主,涵盖 futex requeue-PI 活锁、sched/vtime 通用实现清理、sctp 与 wifi 大量 OOB/UAF 修复、RCU 化释放等。本帖对调度子系统的设计无新讨论,仅在 stable review 周期里要求 LTS 订阅者在 2026-08-19 前反馈测试结果。

lore
其它分析 success作者:Liang Hao2026/08/18 23:191 封邮件

[PATCH] sched/hrtick: Name the minimum slice and derive the rearm slack

本 patch 把 hrtick 子系统中硬编码的 10000ns floor 与 5000ns rearm 阈值抽成两个命名宏,并显式把余量定义为最小切片的一半,仅提升可读性、不改变行为。作者本人也提出疑问:5us 阈值当年是否刻意作为 10us 的一半引入,等维护者澄清历史语义后再决定是否合入。

lore
其它重要分析 success作者:Luo Gengkun2026/08/18 22:427 封邮件

[PATCH v9 1/2] sched/cache: Reduce the overhead of task_cache_work by only scan the visisted cpus

本系列补丁为 cache-aware scheduling 引入 visited_cpus cpumask,让 task_cache_work() 只扫描最近真正访问过的 CPU,把多 NUMA 系统中的扫描 CPU 数从 384 降到 16 左右,Redis p99 延迟下降约 25%。Chen Yu C 在 review 中进一步指出单线程进程 visited_cpus 位累积以及跨 NUMA 抖动两个潜在风险,作者倾向于不加 gate。

lore
其它重要分析 success作者:shisiyuan2026/08/17 22:543 封邮件

[PATCH] sched/psi: add cpu_prio pressure metric for high-priority task stalls

该补丁在 PSI 中新增 cpu_prio 资源,只统计静态优先级不高于阈值的任务等待 CPU 的时长,以隔离延迟敏感负载的争用信号。维护者 Peter Zijlstra 直接回 Yeah, I think not. 拒绝,Michal Koutny 进一步指出把目标任务放进独立 cgroup 后读取 cpu.pressure 已经能做到同样效果,因此没有继续迭代。

lore
其它重要分析 success作者:Xin Zhao2026/08/15 19:0411 封邮件

[PATCH 10/10] sched/fair: Strive to find a task to migrate if newly idle when LB_PROMOTE

Xin Zhao 提交的 10-patch 系列引入新的 SCHED_FEAT 开关 LB_PROMOTE,针对嵌入式平台(CONFIG_HZ_250)上 CFS 任务出现的不合理 CPU idle(>2.5ms 甚至 >4ms)问题,从 wake-up CPU 选择、newly idle 兜底、CFS 被 RT 抢占迁移三个场景主动出击。配套包含 rd overload 误清零、active_balance 清零时机、active_load_balance_cpu_stop 通用化等前置修复。默认关闭,开启后以 sys% 上升换取 ≤4ms 的调度延迟保证。

lore
其它分析 success作者:Ziyang Men2026/08/14 04:245 封邮件

[PATCH 0/2] cgroup, sched: add bpf for cgroup cpu controller

Ziyang Men 提交一个 2 patch 系列,为 cpu cgroup 暴露三个 BPF kfunc:bpf_cpu_cgroup_flush_stats、bpf_cpu_cgroup_cputime、bpf_cpu_cgroup_throttled_self,沿用 mm/bpf_memcontrol.c 的 memcg 设计思路。cputime 内部用一次 __css_rstat_lock + cputime_adjust 算齐全部基础 CPU 时间,节流总和由内核通过去除 static 的 throttled_time_self() 提供。配套 selftests/bpf 验证 B...

lore
其它重要分析 success作者:Bharata B Rao2026/08/13 10:2140 封邮件

[PATCH v8 0/8] mm: Hot page tracking and promotion infrastructure

Bharata B Rao 第 8 版提交 pghot 子系统,把 NUMA hint fault、AMD IBS Memory Profiler 以及未来 CXL HMU 等热页来源统一到 per-PFN hotness 记录与 per-node kmigrated 线程,并把 kernel.numa_balancing=2 的 tiering 路径从 scheduler 迁到 mm。Andrew Morton、Matthew Wilcox、SJ Park、D. Hildenbrand 等 maintainer 提出与 DAMON 重叠、diffstat 过大、未拿到任何 Acked-by ...

lore
其它分析 success作者:Kayra Cizmeci2026/08/12 23:101 封邮件

[PATCH] sched/fair: Avoid calculating curr's key twice in pick_eevdf()

本 patch 把 pick_eevdf() 中 entity_eligible()→vruntime_eligible() 这条路径里重复的 entity_key(cfs_rq, curr) 减法抽成新的 curr_eligible(),让 vruntime - min_vruntime 只算一次。无功能变化,仅做 micro-cleanup,把 curr!=NULL/on_rq 的不变量交给 caller。建议补 WARN_ON_ONCE 与 micro-bench 以便 review。

lore
其它重要分析 success作者:Boqun Feng2026/08/12 19:1839 封邮件

[PATCH v5 00/18] Refcounted interrupt disable and SpinLockIrq for Rust

Boqun Feng 主推的 v5 18 贴系列把 preempt_count 中的 NMI 嵌套迁到 per-CPU 计数器,腾出 8 bit 给新的 HARDIRQ_DISABLE 计数器,并在 64-bit 架构把 PREEMPT_NEED_RESCHED 拆到独立字。系列在 C 端新增 local_interrupt_disable/enable 以及 spin_lock_irq_disable / spin_unlock_irq_enable 三件套,并附 KUnit 测试;在 Rust 端引入 kernel::interrupt 模块的 LocalInterruptDisabled...

lore
其它重要分析 success作者:Madadi Vineeth Reddy2026/08/11 13:4111 封邮件

[PATCH] sched/fair: Let sync wakeups target the waker's core

补丁在 select_idle_core() 中识别“waker 即将 sleep 且 rq 仅剩它自己”的状态,把 waker 的 CPU 视为 idle,使得 SMT 上 wakee 能落到 waker 核的兄弟线程,复用 cache 又避免 stacking。讨论中 Prateek 与 Chen Yu 提出上提到 select_idle_sibling() 或抽出 select_idle_sync_core() 的重构方案,x86 Zen 3 上 Kayra 的测试显示 cycles 下降 1.40% 但 cache-misses 上升 4.60%,收益高度依赖 SMT 编号方式。

lore
其它分析 success作者:Greg Kroah-Hartman2026/08/11 07:00457 封邮件

[PATCH 7.1 001/438] net: mpls: initialize rtm_tos in mpls_getroute()

Greg Kroah-Hartman 发布 Linux 7.1.8-rc1 稳定分支的 438 个回搬补丁合入评审。涵盖 mm/slab、btrfs、netfilter、bluetooth、KVM、ALSA、drm 等子系统;其中 sched/deadline 183/438 限定 revised wakeup rule 仅在 dl_server running 时生效。窗口期截止 2026-08-09 14:33 UTC;多数回信为 Tested-by/确认收到。

lore
其它分析 success作者:Greg Kroah-Hartman2026/08/11 06:40406 封邮件

[PATCH 6.18 001/396] netfilter: nf_conntrack_expect: restore helper propagation via expectation

Greg KH 发布的 6.18.44-rc1 stable review 一次拉取 396 个 patch,跨 netfilter、btrfs、mm/slab、drm、ALSA、Bluetooth、hwmon、net、scsi、can、phy 等 30+ 子系统。真正属于 scheduler 的只有 PATCH 149/396 sched/deadline: Use revised wakeup rule only for running dl_server,把 DL wakeup rule 的判定收敛到 dl_server 实际 running 时。其余 395 个均为各子系统 bugfi...

lore
其它重要分析 success作者:Shrikanth Hegde2026/08/10 21:2430 封邮件

[PATCH v9 00/11] sched, steal_governor: Introduce preferred CPUs and steal-driven vCPU backoff

本系列引入 cpu_preferred_mask 作为 scheduler 一等 cpumask 状态, 并把 virtualization 策略放到 drivers/virt/steal_governor 驱动中。驱动周期性采样系统 steal time, 与高/低阈值比较后逐步收缩或扩展 preferred CPU 集合; 调度器在 wakeup、tick、load balance 三条路径上优先使用 preferred。目的是为 paravirt 下多个 VM 提供协作式、可恢复、不破坏用户 affinity 的 vCPU 退避机制, 避免 CPU hotplug/isolcpuset ...

lore
其它重要分析 success作者:Andrea Righi2026/08/10 18:383 封邮件

[PATCH v5] sched/fair: Prefer fully idle cores for NOHZ balancing

Andrea Righi v5 修改 find_new_ilb(),在 SMT 系统中优先挑选整 core 空闲的 CPU 作为 ILB 目标,不存在时回退到任一 idle CPU。针对 NVIDIA Olympus(Vera)上 SMT 唤醒后 10 Ki cycle 才恢复单线程性能的特性,在自制 GEMM benchmark、每 core 一个 CPU 密集任务下,从约 6.2 TFLOP/s 提升到 9.4 TFLOP/s。非 SMT 系统行为保持不变。

lore
其它分析 success作者:Liang Hao2026/08/07 23:071 封邮件

[PATCH] sched/deadline: Do not pull when the local CPU is the only overloaded one

本 patch 把 RT 调度器 commit f73c52a5bcd1 中已有的 "pull 端短路" 镜像到 DEADLINE 调度器的 pull_dl_task():当 dlo_count==1 且本 CPU 拥有唯一的 dlo_mask bit 时直接返回,避免 for_each_cpu() 循环在本地 CPU 上空转。改动只动 kernel/sched/deadline.c 一处 +7/-1,作者明确说明无功能变化,仅做对称补齐和微小性能优化。

lore
其它重要分析 success作者:Usama Arif2026/08/07 17:522 封邮件

[PATCH v2] sched/psi: use __ffs() to walk task-count bitmasks in psi_group_change()

把 psi_group_change() 中遍历 clear/set 4-bit 掩码的写法从线性扫到最高位改为 __ffs()+m&=m-1,按置位数而不是位宽工作。微基准在常见 PSI mask 分布上提速 47-63%,生成代码减少 67 字节;属性能/可读性双优的 patch 清理。

lore
其它重要分析 success作者:Mark Rutland2026/08/07 11:3316 封邮件

[PATCH v2 0/6] sched: dynamic: Simplify PREEMPT_DYNAMIC

Mark Rutland 提出的 6 补丁系列在 v7.2-rc4 之上让 PREEMPT_DYNAMIC 直接依赖 ARCH_HAS_PREEMPT_LAZY,把因 7dadeaa6e851 而实际走不到的 NONE/VOLUNTARY 路径、HAVE_PREEMPT_DYNAMIC_{CALL,KEY} Kconfig 项以及 cond_resched / preempt_schedule / irqentry_exit_cond_resched 的动态跳板一次性删除,共削减 374 行;评审者 Jinjie Ruan 与 Shrikanth Hegde 给出逐封 review 与 acc...

lore
其它分析 success作者:Aaron Tomlin2026/08/05 20:373 封邮件

[PATCH v2] sched/debug: Introduce per-CPU debugfs files

Aaron Tomlin 在 v2 中向 kernel/sched/debug.c 新增 debugfs_cpu_init(),为每个 possible CPU 在 /sys/kernel/debug/sched/cpu/cpu<N>/debug 下创建独立 debug 文件,读取时通过 sched_debug_cpu_show() 复用 print_cpu() 输出该 CPU 的 runqueue 状态,offline CPU 返回 -ENODEV。v2 主要按 Peter Zijlstra 和 Zhan Xusheng 的反馈重写 commit message 动机,并补上 cpu_onl...

lore
其它重要分析 success作者:Aaron Tomlin2026/08/05 20:324 封邮件

[PATCH v4] security: Expand task_setscheduler LSM hook

Aaron Tomlin v4 patch 给 security_task_setscheduler hook 增加 sched_attr 和 cpumask 两个 __nullable 参数,让 LSM 在 sched_setaffinity 路径上能看到目标 CPU 集合。同步更新 SELinux/Smack/commoncap/cpuset/timerslack/MIPS 等 10 个文件,但当前 LSM 都用 __always_unused 暂时忽略新参数,为后续基于空间隔离的策略铺路。

lore
其它分析 success作者:fangqiurong2026/08/05 17:122 封邮件

[PATCH] sched/fair: Remove dead throttled check in pick_task_fair()

本 patch 删除 pick_task_fair() 中因 f666241e6bd5 重构而变成死代码的 throttled 变量与 task_throttle_setup_work() 调用,属于 cleanup 类改动,行为完全不变。回复者 K Prateek Nayak 指出 tip:sched/core 上 Peter Zijlstra 已经通过 85570f10a4c6(sched/eevdf: Move to a single runqueue)完成了同样的清理,作者需要 rebase 或撤回本 patch。

lore
其它重要分析 success作者:Andrea Righi2026/08/05 16:598 封邮件

[PATCH v3] sched/fair: Prefer fully idle cores for NOHZ balancing

Andrea Righi 改写 find_new_ilb(),让 ILB 目标优先选整核空闲的 SMT CPU,避免唤醒半活 core 的空闲兄弟线程,从而防止 NVIDIA Olympus/Vera 上 10 Ki cycles 的单线程性能恢复窗口被反复触发。v3 在见到 busy CPU 后跳过其所有兄弟,简化宽 SMT 扫描。审稿人主要质疑 this_cpu 检查是否冗余,并建议把 busy 检查与 this_cpu 判断合并。

lore
其它重要分析 success作者:Greg Kroah-Hartman2026/08/04 22:32502 封邮件

[PATCH 6.6 000/484] 6.6.148-rc1 review

Greg Kroah-Hartman 发布的 Linux 6.6.148-rc1 stable 候选版,包含 484 个跨子系统补丁。修复重点包括 CAN bcm/isotp 的并发 race、drm/virtio 的 fbdev probe 死锁、mmc vub300 的 use-after-free、KVM MMU 与 ASID 系列问题,以及 wifi、RDMA、thunderbolt 等驱动侧大量 OOB read/UAF 修复。本帖同时包含 17 封社区 review 回信,主要覆盖 mmc vub300 patch 的命名分歧和 ceph 布局 ioctl 校验。

lore
其它分析 success作者:Christoph Hellwig2026/08/04 21:002 封邮件

[PATCH v2] block: split out a new blk_plug.h header

Christoph Hellwig 把 struct blk_plug、blk_plug_cb 及相关 inline 从 include/linux/blkdev.h 抽出到新建的 include/linux/blk_plug.h,让 aio、writeback、io_uring、mm、kernel/sched/core.c 等非 block 模块不再被迫 include 重型 blkdev.h,从而减少 blkdev.h 改动触发的重编译、降低头耦合。维护者 Jens Axboe 当日 ack 并合入为 commit 758b86f7bc8a。

lore
其它重要分析 success作者:Boqun Feng2026/08/04 20:5259 封邮件

[GIT PULL] [PATCH 00/24] Rust synchronization changes for v7.3

Boqun Feng 推送 24 个 patch,把 IRQ disable 嵌套层数记进 preempt_count 的 HARDIRQ_DISABLE 字段,并以此为基础提供 Rust 端的 SpinLockIrq、synchronize_rcu() 安全封装和 trait-based 泛型 memory barrier。该系列还顺手修复 openrisc 的 smp.h 编译错误并把 64 位架构的 NMI 嵌套放回 preempt_count。Peter Zijlstra 在 patch 02 的 Signed-off-by 链、interrupt_disable_state 包装以及...

lore
其它分析 success作者:Zhan Xusheng2026/08/04 20:504 封邮件

[PATCH 0/3] sched: minor cleanups

Zhan Xusheng 提交的 3 个 cleanup 补丁:删除早就没有调用者的 static inline sched_fair_runnable();把 requeue_task_rt() 永远不用的 rq 形参去掉,三处 caller 同步;修正 rt.c 里与 #ifdef CONFIG_RT_GROUP_SCHED 配套的 #endif 注释(去掉多余的 !)。全部 No functional change,仅改善代码可读性和接口整洁度。

lore
其它分析 success作者:Zhan Xusheng2026/08/04 17:268 封邮件

[PATCH] sched/psi: Skip CPUs with zero non-idle jiffies in per-cpu aggregation

针对 collect_percpu_times() 对每个 possible CPU 都执行 nsecs_to_jiffies 与加权累加的浪费,作者利用 get_recent_times() 已设的 PSI_NONIDLE 位作为天然 zero-delta 标记,在循环里直接 continue。该优化在 i7-8700 以及 -smp 2..32 的 A/B 测试中带来最多约 18% 的 /proc/pressure/cpu 读延迟节省,且随 CPU 数放大。整条线索从 v1 到 v6 主要迭代判断条件、Reviewed-by 标签语义、commit 措辞以及 Peter Zijlstra ...

lore
其它重要分析 success作者:Shubhang Kaushik (Ampere)2026/08/04 08:226 封邮件

[PATCH v3] sched/fair: Prefer waker CPU for non-SMT reciprocal sync wakeups

本系列在 select_task_rq_fair() 中新增 prefer_sync_pair_cpu(),借助 last_wakee 识别 pipe-style ping-pong WF_SYNC 唤醒,在非 SMT 平台上让 wakee 留在 waker CPU,80核 Ampere Altra 上 perf bench sched pipe 提升约 30%。线程后续由 Prateek 提议下沉到 select_idle_sibling() 以覆盖 SMT,并由 Shrikanth 质疑 sync wakeup 的整体语义,呼吁先界定策略再决定合入。

lore
其它分析 success作者:Hongling Zeng2026/08/03 15:401 封邮件

[PATCH RESEND v2] sched: adjust the layout of the cfs_bandwith structure to save memory

通过 pahole 发现 struct cfs_bandwidth 有 13 字节 padding hole,v2 RESEND 把三个 u8 标志挪到 raw_spinlock_t lock 之后,把结构体从 240 字节压到 232 字节。代价是 period_timer 跨过 cacheline 边界,但作者评估这条路径本来已访问多个 cacheline,并不是热点路径。

lore
其它重要分析 success作者:Andrea Righi2026/07/31 22:023 封邮件

[PATCH v2] sched/fair: Prefer fully idle cores for NOHZ balancing

Andrea Righi 的 v2 patch 修改 find_new_ilb(),让 NOHZ idle load balancer 优先挑整核都空闲的 housekeeping CPU,避免在 NVIDIA Olympus/Vera 这种兄弟线程需要约 10 Ki cycles 恢复窗口的 SMT 上被反复短暂唤醒。找不到整核空闲时退回第一个 idle CPU,并在遍历时把部分忙核的兄弟从候选位图中剪掉。GEMM benchmark 性能从 ~6.2 TFLOP/s 提升到 ~9.4 TFLOP/s。

lore
其它重要分析 success作者:Luo Gengkun2026/07/31 16:3115 封邮件

[PATCH v8 0/2] Cache aware scheduling: Reduce the overhead of task_cache_work

Luo Gengkun 的 v8 系列为每个 mm 维护 visited_cpus cpumask,把 task_cache_work 的扫描集合从整机/整 node 收缩到近期真正跑过该 mm 且仍在线的 CPU,并用 epoch_last_visit 加 llc_epoch_affinity_timeout 淘汰冷位,同时删除了 get_scan_cpumasks()。Redis 场景扫描 CPU 数从 384 降到 16,task_cache_work 开销从 0.81% 降到 0.02%,p99 延迟劣化从 -25.68% 收敛到 -1.14%。Reviewer 主要质疑 mm->sc...

lore
其它重要分析 success作者:Shubhang Kaushik (Ampere)2026/07/30 02:178 封邮件

[PATCH v2] sched/fair: Prefer waker CPU for reciprocal sync wakeups

Shubhang 提出在 SD_WAKE_AFFINE 域内,对 reciprocal WF_SYNC 唤醒直接返回 waker CPU,避免 select_idle_sibling() 把 wakee 拉到远端空闲 CPU,Ampere Altra 上 perf bench sched pipe 提升约 30%。thread 内 Prateek、Christian、Vineeth 三位 reviewer 围绕 SMT 适用性、READ_ONCE 必要性、SIS 改造路径展开讨论,作者计划 v3 收敛清理并限定非 SMT 路径。

lore
其它重要分析 success作者:Aaron Tomlin2026/07/28 21:436 封邮件

[PATCH] sched/debug: Introduce per-CPU debugfs files

Aaron Tomlin 提交 v1 patch,在 /sys/kernel/debug/sched/cpu/cpu<N>/debug 下暴露单个 CPU 的 runqueue 视图,避免读取全量 sched/debug 时抢多把 rq 锁、产生系统噪声。Peter Zijlstra 质疑 commit message 没说明用例,Daniel Vacek 给出 DPDK/isolated CPU 调试的合理场景,作者承诺 v2 改写 rationale 并可能调整 for_each_possible_cpu 的范围。

lore
其它分析 success作者:Oleg Nesterov2026/07/28 19:236 封邮件

[PATCH -mm v2 0/1] sysctl: remove CONFIG_PROC_SYSCTL, it just mirrors CONFIG_SYSCTL

Oleg Nesterov 把与 CONFIG_SYSCTL 镜像的 CONFIG_PROC_SYSCTL 合二为一,全树替换 #ifdef,scheduler 内 6 处同步改名。Nicolas Schier 担忧用户可见 Kconfig 改名对 out-of-tree 用户与 bisect 的影响;Andrew Morton 提示 Sashiko review 工具应改用 linux-next 而非 net/HEAD 作为 base。

lore
其它分析 success作者:Kayra Cizmeci2026/07/27 00:031 封邮件

[PATCH] sched/fair: Remove unused autogroup.h include

Kayra Cizmeci 提交的单封 cleanup 补丁,在 kernel/sched/fair.c 头部删除了一行未被实际使用的 #include "autogroup.h"。作者通过在仓库中 grep autogroup 字符串确认 fair.c 中没有任何引用,并在 x86_64 defconfig + 4 CPU + QEMU/Lima 环境中进行了启动测试。整个改动只涉及 1 个文件、1 行删除,不改变任何运行期行为。

lore
其它重要分析 success作者:John Stultz2026/07/25 02:1210 封邮件

[PATCH v31 0/9] Sleeping Owner Handling for Proxy Execution (v31)

Proxy Execution v31 完成 sleeping owner handling:在 task_struct 上新增 blocked_head/blocked_node/blocked_activation_node/sleeping_owner,owner 唤醒时非递归地激活整棵等待树。同时引入 ENQUEUE_PROXY 让 sched_ext 区分捐助激活与普通 wakeup,并修复 DL yield、core-scheduling cookie 不匹配、donor 被 steal、nr_iowait 失衡等问题。整链迁移优化也在本轮重新引入。

lore
其它分析 success作者:Huang Shijie2026/07/23 19:312 封邮件

[PATCH] sched/fair: remove the wrong check is_vm_hugetlb_page

Huang Shijie 提交单行 cleanup patch,意图在 task_numa_work() 中移除对 hugetlb VMA 的额外过滤,让 vma_migratable() 的判定生效。数小时后又回复请社区忽略此 patch,承认 task_numa_work() 中保留 is_vm_hugetlb_page 是有意为之,目的是避免 hugetlb 进入自动 NUMA balancing。

lore
其它分析 success作者:Li kunyu2026/07/23 16:361 封邮件

[PATCH] kernel/sched/fair: The CPU idle check can be placed before the CPU overload check

本 patch 把 update_sg_lb_stats() 里的 cpu_overutilized(i) 检查挪到 idle_cpu()/nr_running 检查之后,让空闲 CPU 通过便宜判定直接短路,跳过昂贵的过载扫描。语义不变,纯粹是一次低风险的清理型优化,但作者也指出未覆盖 DL 任务的过载盲区。

lore
其它重要分析 success作者:John Stultz2026/07/23 12:0225 封邮件

[PATCH v30 0/7] Sleeping Owner Handling for Proxy Execution (v30)

John Stultz 发出 v30 系列共 7 个补丁,核心是当 mutex owner 自身睡眠时,把 waiter 挂到 owner 的 blocked_head 链表上,等 owner 唤醒后再在同 runqueue 上整链激活;顺带包含 Vasily Gorbik 关于 donor 被偷、cookie 不匹配的修复,以及 chain migration 优化。随后 K Prateek Nayak 提交 RFC 0/3,通过 pick-leader + core_pick_blocked_donor 机制,让 proxy execution 与 core scheduling 在 co...

lore
其它重要分析 success作者:Yangyu Chen2026/07/23 04:568 封邮件

[PATCH 1/4] sched/cache: Split llc_aggr_tolerance into nr and size tolerances

Yangyu Chen 提交 4 patch 系列,把 CONFIG_SCHED_CACHE 从单一 debugfs 全局 knob 升级为'全局 + 独立 nr/size tolerance + per-mm prctl + 溢出安全'的分层接口,并补 selftest 和文档。核心动机是 Verilator 与 EPYC Turin/Milan 这类 footprint 失真或平台敏感的负载无法用单一全局数字表达。3 封 Intel 维护者回复正文在输入中被截断,真实评审结论待跟进。

lore
其它分析 success作者:Zhongqiu Han2026/07/22 21:252 封邮件

[PATCH] cpufreq: schedutil: Replace sprintf() with sysfs_emit() in sysfs show

Zhongqiu Han 提交的单行清理补丁,将 schedutil 中 rate_limit_us_show 的 sprintf() 替换为 sysfs_emit(),目的是统一 sysfs 输出 API、获得 PAGE_SIZE 边界检查。补丁明确声明无功能变更,由 cpufreq maintainer Rafael J. Wysocki 直接回复 Applied as 7.3 material 接收,无需后续迭代。

lore
每页
上一页1 / 2下一页