日期范围
68
重要讨论数
Bugfix重要分析 failed作者:Andrea Righi2026/09/07 17:507 封邮件

[PATCH v2 0/2] sched: Enable preferred SMT siblings on NVIDIA Olympus

sched: Enable preferred SMT siblings on NVIDIA Olympus。Claude 分析失败,当前使用规则 fallback:该讨论被归为 bugfix,共 7 封邮件。

lore
Bugfix重要分析 success作者:syzbot2026/09/07 16:582 封邮件

[syzbot] [kernel?] WARNING in __set_cpus_allowed_ptr_locked

syzbot 报出 IRQ 线程在 CPU 热插拔窗口内调 set_cpus_allowed_ptr,可能让任务落到 cpus_mask 之外的 CPU 并触发 affine_move_task 警告。Sebastian 提出两个备选方案:在 IRQ 侧加 cpus_read_lock,或在 migration_cpu_stop 中回填 cpus_mask。

lore
Bugfix重要分析 success作者:Jianyong Wu2026/09/07 16:379 封邮件

[PATCH] sched/fair: Only apply cpufreq pressure where frequency is invariant

补丁针对 d2d5c129d07e 在 cpufreq_update_pressure() 中以 cpuinfo.max_freq 作为 fallback 后,导致非 frequency-invariant 架构上 capacity 被扣减而 utilization 未同步缩放、产生 util > capacity 误判的问题。在 get_actual_cpu_capacity() 中用 arch_scale_freq_invariant() 守卫 cpufreq_get_pressure(cpu) 的合并,恢复对称缩放。讨论中作者承认首版解释错误,把根因改为 cpuinfo.max_freq...

lore
Bugfix重要分析 failed作者:Hemanth Selam2026/09/07 14:571 封邮件

[PATCH 11/14] sched: fix repeated word 'into' in comment

sched: fix repeated word 'into' in comment。Claude 分析失败,当前使用规则 fallback:该讨论被归为 bugfix,共 1 封邮件。

lore
RFC重要分析 failed作者:Shrikanth Hegde2026/09/07 11:2417 封邮件

[PATCH v12 00/13] sched, steal_governor: Introduce preferred CPUs and steal-driven vCPU backoff

sched, steal_governor: Introduce preferred CPUs and steal-driven vCPU backoff。Claude 分析失败,当前使用规则 fallback:该讨论被归为 rfc,共 17 封邮件。

lore
其它重要分析 success作者:Ye Liu2026/09/07 11:0530 封邮件

[PATCH 0/8] mm: introduce for_each_process_rcu and for_each_thread_rcu

Ye Liu 提交 8 个 patch 的 v1 系列,在 include/linux/sched/signal.h 中引入 for_each_process_rcu / for_each_thread_rcu / for_each_process_thread_rcu 三个基于 scoped_guard(rcu) 的宏,并把它们应用到 mm/、kernel/、fs/、lib/、security/ 共 17 个文件,清除大量手写 rcu_read_lock/unlock 样板。Michal Hocko、SJ Park、Miaohe Lin、Lorenzo Stoakes、Justin Sues...

lore
其它重要分析 success作者:Bradley Morgan2026/09/06 01:5727 封邮件

[PATCH v2 0/5] kthread: convert remaining users to kthread_create_worker

Bradley Morgan 的 5 patch 系列把 ivtv/encx24j600/sc16is7xx/cpufreq_schedutil 四个剩余的旧 kthread 用户迁到 kthread_create_worker* API,并删除 kthread_worker_fn() 中挂了十年的 worker->task = current 自赋值,仅留 WARN_ON 兜底。v2 已被 Jakub Kicinski 和 Greg KH 要求把 driver 改动拆成独立 series 分头发,并被 kernel test robot 抓到 ivtv-irq.c:1053 仍残留 &itv...

lore
Bugfix重要分析 success作者:Hui Su2026/09/05 22:0015 封邮件

[PATCH v2 2/2] sched/cache: Drive cache task tick from execution context

Hui Su 提交 2/2 系列 patch,修复 proxy execution 中 donor 是 RT/DL 时 task_tick_numa/task_tick_cache 不再被调用、导致 mm scan epoch 与 account_mm_sched 错位的回归。把这两个执行上下文 tick 从 task_tick_fair() 提到 sched_tick()/sched_tick_remote(),并按 rq->curr 是否 fair 触发。讨论中 Prateek、Tim Chen、Chen Yu 进一步指出 task_tick_core() 在 proxy 下 sum_ex...

lore
Bugfix重要分析 success作者:Zhan Xusheng2026/09/05 16:501 封邮件

[PATCH v2 RESEND] sched/debug: Validate writes to the scan_size_mb debugfs knob

scan_size_mb debugfs 节点被注册成 u32,写入 0 或 2^24 的倍数会让 task_scan_min() 和 task_nr_scan_windows() 把 0 当除数,触发内核除零 oops。补丁改用 debugfs_create_file 加自定义 write,按 NUMA_SCAN_SIZE_MB_MAX 校验范围,仿照已有的 sched_scaling_fops 把 sysctl 时代丢失的下界和上界都补回来。

lore
RFC重要分析 success作者:Gabriele Monaco2026/09/05 13:1748 封邮件

[RFC PATCH 00/20] rv: Add support for BPF monitors

本 RFC 把 RV 工具从只能管理内核内置 monitor 扩展为可加载 BPF monitor:通过 BPF struct_ops 把 monitor 接入 tracefs,用 ringbuf 回传 trace 事件,并扩展 rvgen 与 selftest 支持模板生成与端到端验证。共 20 个补丁、约 2770 行新增,已得到 sashiko AI 评审若干改进意见,并引发 Rostedt、Starovoitov、Glozar 等多轮 maintainer 讨论。

lore
Bugfix重要分析 success作者:Boqun Feng2026/09/05 05:2041 封邮件

[PATCH v4 00/17] Refcounted interrupt disable and SpinLockIrq for Rust

v4 系列把嵌套本地中断禁用改为基于 preempt_count 的引用计数,并为 Rust 增加 LocalInterruptDisabled 和 SpinLockIrq。系列同时调整 NMI 和 reschedule 位布局、增加 KUnit 测试及架构适配。patch 07 的 cleanup guard 迁移随后被 revert,后续又出现将 local_irq 操作迁入 Rust 的新提案。

lore
Bugfix重要分析 success作者:Zhan Xusheng2026/09/05 04:538 封邮件

sched/fair: which tasks should nr_pref_llc_running be compared against?

Zhan Xusheng 在 fair.c 的 alb_break_llc() 中发现 nr_pref_llc_running 与 h_nr_runnable 一个数 queued、一个数 runnable,导致等式在 DELAY_DEQUEUE 下恒假,主动负载均衡丢失 LLC 亲和性保护。Tim Chen 与 Chen Yu 推动 patch 从 account_llc_dequeue 的单点守卫扩展到 enqueue + set/clear_delayed 全路径,并最终收敛为 task_pref_llc_runnable 谓词与 pref_llc_running_inc/dec hel...

lore
Bugfix重要分析 success作者:Gregory Price2026/09/05 03:315 封邮件

[PATCH 0/2] sched/numa: stop VMA scan filters from gating promotion

Gregory Price 的 2 patch 系列针对 memory tiering 模式下 NUMA balancing 的 VMA 扫描过滤过严问题:per-VMA PID filter 和 read-only file mapping 排除让慢层 folio 永远进不了 promotion 候选,导致大型 shmem 把 hash table 全部堆到 CXL。新增 vma->numab_state->slow_only,在 tiering 模式下对被过滤 VMA 做受限扫描(只标慢层 folio),toptier 标记行为不变;实测 DRAM 带宽从 150GB/s 回到 200-2...

lore
Bugfix重要分析 success作者:Hui Su2026/09/05 01:175 封邮件

[PATCH v3 1/2] sched/numa: Drive NUMA task tick from execution context

v3 系列(2 个 patch)修复 proxy execution 场景下的回归:当 fair 任务替 RT/deadline donor 实际执行时,task_tick_numa() 与 task_tick_cache() 因被包在 task_tick_fair() 里而被漏掉,导致 cache scan epoch 过期、preferred LLC 失效。新增 sched_tick_exec_ctx() helper,统一在 sched_tick() 与 sched_tick_remote() 中按 rq->curr 触发执行上下文 tick,同时保留 misfit/overutiliz...

lore
Bugfix重要分析 success作者:Zhe Liu2026/09/04 17:216 封邮件

[PATCH 0/2] sched/fair: Reset incompatible burst on quota change

Zhe Liu 修复 cgroup v1/v2 CPU bandwidth 中 quota 与 burst 写入顺序耦合导致的 EINVAL 问题。v1 提出在 quota 变更时把不兼容 burst 写零;Michal Koutný 评审建议改为 clamp 以保留用户配置,v2 采纳并在 CFS runtime refill 处用 min(burst, quota) 做裁剪,新增 selftest 与文档。

lore
Bugfix重要分析 success作者:Hui Su2026/09/04 14:372 封邮件

[PATCH v2] sched: Account cgroup CPU time to the execution context

v2 patch 让 update_se() 中的 cgroup_account_cputime 跟随 rq->curr 而不是 donor,修正 proxy execution 下 cgroup CPU usage 被算到 donor cgroup 的回归。改动仅 -3 +1 行,作者补全了 cgroup v2、cgroup v1 cpuacct、RT donor、sched_proxy_exec=off 对照组等多场景验证。Tejun Heo 的回复仅引用 patch 上下文,尚未给出明确 LGTM。

lore
Bugfix重要分析 success作者:Hui Su2026/09/04 14:274 封邮件

[PATCH] sched/cputime: Account cgroup fields to the scheduling context

Hui Su 试图在 proxy execution 下让 cgroup user/system 字段跟随 donor,与 aa4f74dfd42b 引入的 donor-based 用量统计保持自洽。补丁新增 rq->cputime_donor 与若干 sched_cputime_* 接口,把 account_user_time 等拆分为 per-CPU cpustat 与 cgroup 字段两条路径。Tejun Heo 指出用户空间以 execution context 为准且 cputime_adjust 会重对齐 user/sys,cgroup 应当整体跟随 execution task...

lore
Bugfix重要分析 success作者:Sebastian Andrzej Siewior2026/09/04 14:156 封邮件

[PATCH v4 0/2] futex: Address two futex-requeue-pi issues

Sebastian Andrzej Siewior 的 v4 双 patch 系列处理 FUTEX_CMP_REQUEUE_PI 路径上两个长期被忽视的问题:futex proxy 锁路径上的 sched_rt_mutex 注解错位,以及 futex_requeue_pi_complete() 在 waiter 已退出 syscall 后仍对栈上 futex_q 调用 rcuwait_wake_up() 触发的 KASAN UAF。Patch 1 引入仅翻转断言标志、不调用 sched_submit_work() 的 rt_mutex_futex_pre/post_schedule(),并把注...

lore
其它重要分析 success作者:Andrea Righi2026/09/04 14:0010 封邮件

[PATCH 0/2] sched: Enable preferred SMT siblings on NVIDIA Olympus

Andrea Righi 为 NVIDIA Olympus 提交一个 2 patch 系列,通过 SD_ASYM_PACKING 把 PE0 标为优选 SMT 兄弟线程,并在 kernel/sched/fair.c 的所有 idle 选择路径中真正消费这个优先级,让可迁移任务固定在 PE0,避免核心反复进出 Two-Thread 模式。在 88 线程 GEMM 上吞吐从约 9.4 提升到 10.1 TFLOP/s。Christian Loehle 提出把 PE 优先级与 highest_perf 合并成单一 priority 以替代 SD_ASYM_CPUCAPACITY,Andrea 表示会...

lore
Bugfix重要分析 success作者:gregkh2026/09/03 22:321 封邮件

FAILED: patch "[PATCH] sched/core: Make core-sched flips wait for in-flight" failed to apply to 5.15-stable tree

Tejun Heo 修复 core-sched 中 __sched_core_flip 与 lock-dropping ->pick_task() 之间的竞态,避免共享锁语义在选任务窗口内被切换。新增 leader rq->core_pick_in_flight 计数器,flip 翻面前必须 wait drain,deactivate 时 move 而非 copy 以避免陈旧值永久偏置。本邮件是 Greg KH 的 stable 回信,提示 5.15-stable 自动回放失败,需要人工 cherry-pick。

lore
每页
上一页1 / 4下一页