[PATCH v2 0/2] sched: Enable preferred SMT siblings on NVIDIA Olympus
sched: Enable preferred SMT siblings on NVIDIA Olympus。Claude 分析失败,当前使用规则 fallback:该讨论被归为 bugfix,共 7 封邮件。
北京时间 2026-09-01 至 2026-09-07
最近同步:2026/09/07 21:14
sched: Enable preferred SMT siblings on NVIDIA Olympus。Claude 分析失败,当前使用规则 fallback:该讨论被归为 bugfix,共 7 封邮件。
syzbot 报出 IRQ 线程在 CPU 热插拔窗口内调 set_cpus_allowed_ptr,可能让任务落到 cpus_mask 之外的 CPU 并触发 affine_move_task 警告。Sebastian 提出两个备选方案:在 IRQ 侧加 cpus_read_lock,或在 migration_cpu_stop 中回填 cpus_mask。
补丁针对 d2d5c129d07e 在 cpufreq_update_pressure() 中以 cpuinfo.max_freq 作为 fallback 后,导致非 frequency-invariant 架构上 capacity 被扣减而 utilization 未同步缩放、产生 util > capacity 误判的问题。在 get_actual_cpu_capacity() 中用 arch_scale_freq_invariant() 守卫 cpufreq_get_pressure(cpu) 的合并,恢复对称缩放。讨论中作者承认首版解释错误,把根因改为 cpuinfo.max_freq...
sched: fix repeated word 'into' in comment。Claude 分析失败,当前使用规则 fallback:该讨论被归为 bugfix,共 1 封邮件。
上游清理 refactor 9650ce11f2e3 移除 preempt_dynamic_none/voluntary 两个 enum 后,未同步缩减 preempt_modes[] 数组,导致 preempt_model_str() 在 backtrace 中返回错位字符串,/sys/kernel/debug/sched/preempt 输出为空。Mark Rutland 用 +3/-9 行的最小补丁把数组和 sched_dynamic_show() 循环一起改回,并已被 tip-bot2 合入 sched/core,s390 上由 Mete Durlu 测试确认正确。
Hui Su 提交 2/2 系列 patch,修复 proxy execution 中 donor 是 RT/DL 时 task_tick_numa/task_tick_cache 不再被调用、导致 mm scan epoch 与 account_mm_sched 错位的回归。把这两个执行上下文 tick 从 task_tick_fair() 提到 sched_tick()/sched_tick_remote(),并按 rq->curr 是否 fair 触发。讨论中 Prateek、Tim Chen、Chen Yu 进一步指出 task_tick_core() 在 proxy 下 sum_ex...
scan_size_mb debugfs 节点被注册成 u32,写入 0 或 2^24 的倍数会让 task_scan_min() 和 task_nr_scan_windows() 把 0 当除数,触发内核除零 oops。补丁改用 debugfs_create_file 加自定义 write,按 NUMA_SCAN_SIZE_MB_MAX 校验范围,仿照已有的 sched_scaling_fops 把 sysctl 时代丢失的下界和上界都补回来。
select_fallback_rq() 旧实现在多 NUMA 节点系统上会按 cpumask 编号顺序扫描,挑到的 fallback CPU 拓扑距离可能比实际更远。本 patch 改用 for_each_numa_hop_mask 按拓扑距离逐跳扩搜,并用 prev 记录已考察过的 CPU,避免重复扫描;最后再用 p->cpus_ptr \ prev 兜底,处理拓扑重建期间 hop mask 尚未就绪的窗口。
v4 系列把嵌套本地中断禁用改为基于 preempt_count 的引用计数,并为 Rust 增加 LocalInterruptDisabled 和 SpinLockIrq。系列同时调整 NMI 和 reschedule 位布局、增加 KUnit 测试及架构适配。patch 07 的 cleanup guard 迁移随后被 revert,后续又出现将 local_irq 操作迁入 Rust 的新提案。
Zhan Xusheng 在 fair.c 的 alb_break_llc() 中发现 nr_pref_llc_running 与 h_nr_runnable 一个数 queued、一个数 runnable,导致等式在 DELAY_DEQUEUE 下恒假,主动负载均衡丢失 LLC 亲和性保护。Tim Chen 与 Chen Yu 推动 patch 从 account_llc_dequeue 的单点守卫扩展到 enqueue + set/clear_delayed 全路径,并最终收敛为 task_pref_llc_runnable 谓词与 pref_llc_running_inc/dec hel...