日期范围
91
全部讨论数
Bugfix重要分析 success作者:Hui Su2026/09/04 14:274 封邮件

[PATCH] sched/cputime: Account cgroup fields to the scheduling context

Hui Su 试图在 proxy execution 下让 cgroup user/system 字段跟随 donor,与 aa4f74dfd42b 引入的 donor-based 用量统计保持自洽。补丁新增 rq->cputime_donor 与若干 sched_cputime_* 接口,把 account_user_time 等拆分为 per-CPU cpustat 与 cgroup 字段两条路径。Tejun Heo 指出用户空间以 execution context 为准且 cputime_adjust 会重对齐 user/sys,cgroup 应当整体跟随 execution task...

lore
Bugfix重要分析 success作者:Sebastian Andrzej Siewior2026/09/04 14:156 封邮件

[PATCH v4 0/2] futex: Address two futex-requeue-pi issues

Sebastian Andrzej Siewior 的 v4 双 patch 系列处理 FUTEX_CMP_REQUEUE_PI 路径上两个长期被忽视的问题:futex proxy 锁路径上的 sched_rt_mutex 注解错位,以及 futex_requeue_pi_complete() 在 waiter 已退出 syscall 后仍对栈上 futex_q 调用 rcuwait_wake_up() 触发的 KASAN UAF。Patch 1 引入仅翻转断言标志、不调用 sched_submit_work() 的 rt_mutex_futex_pre/post_schedule(),并把注...

lore
其它重要分析 success作者:Andrea Righi2026/09/04 14:0010 封邮件

[PATCH 0/2] sched: Enable preferred SMT siblings on NVIDIA Olympus

Andrea Righi 为 NVIDIA Olympus 提交一个 2 patch 系列,通过 SD_ASYM_PACKING 把 PE0 标为优选 SMT 兄弟线程,并在 kernel/sched/fair.c 的所有 idle 选择路径中真正消费这个优先级,让可迁移任务固定在 PE0,避免核心反复进出 Two-Thread 模式。在 88 线程 GEMM 上吞吐从约 9.4 提升到 10.1 TFLOP/s。Christian Loehle 提出把 PE 优先级与 highest_perf 合并成单一 priority 以替代 SD_ASYM_CPUCAPACITY,Andrea 表示会...

lore
Bugfix重要分析 success作者:gregkh2026/09/03 22:321 封邮件

FAILED: patch "[PATCH] sched/core: Make core-sched flips wait for in-flight" failed to apply to 5.15-stable tree

Tejun Heo 修复 core-sched 中 __sched_core_flip 与 lock-dropping ->pick_task() 之间的竞态,避免共享锁语义在选任务窗口内被切换。新增 leader rq->core_pick_in_flight 计数器,flip 翻面前必须 wait drain,deactivate 时 move 而非 copy 以避免陈旧值永久偏置。本邮件是 Greg KH 的 stable 回信,提示 5.15-stable 自动回放失败,需要人工 cherry-pick。

lore
Bugfix重要分析 success作者:gregkh2026/09/03 22:321 封邮件

FAILED: patch "[PATCH] sched/core: Make core-sched flips wait for in-flight" failed to apply to 6.6-stable tree

Tejun Heo 修复 core scheduling 中 pick_next_task 与 __sched_core_flip 的并发漏洞:->pick_task() drop-lock 窗口允许 flip rebind rq_lockp(),导致 selection 在错位锁上运行并泄漏锁。补丁新增 core_pick_in_flight 计数器让 flip 等待 drain,hotplug 路径 move 计数避免偏差,标记 Fixes 5.14+。本封邮件是 6.6-stable 上的回灌失败通知,需要人工 cherry-pick。

lore
Bugfix重要分析 success作者:gregkh2026/09/03 22:321 封邮件

FAILED: patch "[PATCH] sched/core: Make core-sched flips wait for in-flight" failed to apply to 6.1-stable tree

本邮件由 stable 维护机器人 gregkh 自动生成,报告 Tejun Heo 的 core scheduling 修复在 linux-6.1.y 上无法干净 cherry-pick。该修复为 rq->core_pick_in_flight 引入计数:pick_next_task() 进入时 ++、退出时 --;__sched_core_flip() 翻转前等待计数清零;sched_core_cpu_deactivate() 用 move(而非 copy)迁移到新 leader;sched_init() 初始化为 0。原 commit f3629c63a4af 已 Acked by Pe...

lore
Bugfix重要分析 success作者:gregkh2026/09/03 22:321 封邮件

FAILED: patch "[PATCH] sched/core: Make core-sched flips wait for in-flight" failed to apply to 6.18-stable tree

补丁修复 core-sched 翻转与 ->pick_task() lock drop 之间的锁重绑竞态:在 leader rq 上记录 in-flight core-wide selection 数量,让 __sched_core_flip() 在翻转前等待 selection 排空,同时在热插拔 deactivate 时 move 而不是 copy 计数,避免 stale 副本 bias。邮件由 stable 维护者 gregkh 发出,报告该补丁无法直接 cherry-pick 到 6.18.y,需要手工合并。

lore
Bugfix重要分析 success作者:gregkh2026/09/03 22:321 封邮件

FAILED: patch "[PATCH] sched/core: Make core-sched flips wait for in-flight" failed to apply to 6.12-stable tree

Tejun Heo 修复 core scheduling 中 __sched_core_flip 与 pick_next_task 的锁竞态:当 ->pick_task() 临时释放 rq 锁时,flip 可能在选择中途 rebind rq_lockp(),导致后续选择在拆分锁下触碰不再受保护的兄弟状态,并造成锁的错误释放与泄漏。补丁在 leader rq 引入 core_pick_in_flight 计数器,让 flip 等待其归零,并在 CPU deactivate 时 move 而非 copy。本邮件是 Greg KH 通知该 patch 无法干净应用到 6.12-stable 树。

lore
其它分析 success作者:Hongyan Xia2026/09/03 19:571 封邮件

[PATCH v2] sched: Convert last bits of deprecated static key usage

Hongyan Xia 把 kernel/sched/core.c 和 kernel/sched/fair.c 中最后几处 deprecated 的 static_key_* API 调用迁移到新的 static_branch_* API,包括把 __cfs_bandwidth_used 改为 DEFINE_STATIC_KEY_FALSE 并统一 helper 命名。patch 标注 No functional change,属于纯 rename/cleanup,是 sched 子系统去掉 deprecated static key 的收尾工作。v2 相对 v1 主要补充了废弃原因说明并修复...

lore
Bugfix重要分析 success作者:Peter Zijlstra2026/09/03 19:1412 封邮件

[PATCH 0/7] sched: core-sched fixes and balancing

Peter Zijlstra 发出 7 patch 系列,修 core-sched 下 pick_next_task 因 pick_task 释锁被兄弟 CPU 递归进入而 NULL deref 的 bug,并抽出 opt_update_rq_clock 统一 RQCF_UPDATED 语义。配套加 task_on_core() 让 newidle 在 core-sched 下安全启用、把 balance 逻辑从 sched_class::balance() 收敛进 pick_task,整体净删约 80~120 行。Tejun 与 Aaron 在评审中分别指出 RQCF_UPDATED 应在 ...

lore
Bugfix重要分析 success作者:Hui Su2026/09/03 19:131 封邮件

[PATCH] sched/rt: Fix RT watchdog accounting for proxy execution

修复 RT watchdog 在 proxy execution 场景下把 RLIMIT_RTTIME 计时错误归属到 donor 而非真正执行任务的问题。通过在 task_tick_rt 中将 watchdog() 的参数改为 rq->curr,并在 try_to_block_task 与 __schedule 中按 proxy 阶段切换重置 rt.timeout,使 SIGXCPU 能正确送达真正占用 CPU 的任务。覆盖嵌套 proxy 链、阻塞切换、调度抢占与 donor 取消等场景,原生 RT 任务行为不变。

lore
RFC重要分析 failed作者:Sasha Levin2026/09/03 16:09780 封邮件

[PATCH AUTOSEL 6.18-5.10] wifi: cfg80211: validate IEs in cfg80211_wext_siwgenie()

wifi: cfg80211: validate IEs in cfg80211_wext_siwgenie()。Claude 分析失败,当前使用规则 fallback:该讨论被归为 rfc,共 780 封邮件。

lore
Bugfix重要分析 success作者:Hui Su2026/09/03 10:544 封邮件

[PATCH 2/2] sched/cache: Use execution context for cache task tick

v1 系列修复 proxy execution 中 task_tick_fair() 把 curr=donor 误传给 task_tick_numa()/task_tick_cache() 的问题,改用 rq->curr 让 NUMA 扫描周期与 cache epoch 与 account_mm_sched() 记账对象一致。Reviewer Tim Chen 指出 donor 为 RT/deadline 时 task_tick_fair() 根本不被调用,tick 会全部漏掉,建议上提到 sched_tick() 并补 sched_tick_remote(),作者已确认重写为新版。

lore
RFC重要分析 success作者:Shubhang Kaushik (Ampere)2026/09/03 10:474 封邮件

[RFC PATCH 0/2] sched: Document WF_SYNC wakeup placement semantics

Shubhang Kaushik 提交 2 个 RFC 补丁,为 fair-class 下 WF_SYNC 的 CPU 选择与唤醒抢占行为新增完整文档,并修正 kernel/sched/wait.c 中"同步 wakee 不会被迁移"的错误注释。本系列不改调度行为,仅把 WF_SYNC 明确定位为非绑定 hint,列出 wake_affine()、select_idle_sibling()、preempt_sync() 实际可打破该承诺的所有路径。

lore
Bugfix重要分析 success作者:Lu Wang2026/09/03 10:071 封邮件

[PATCH v3] sched/cache: honor migrate_llc_task semantics in active load balance

Lu Wang 指出 CAS 引入的 migrate_llc_task 在被动 LB 回退到 ALB 时会丢失,导致 can_migrate_task 把 preferred LLC 不匹配的任务也一并搬走。补丁新增 LBF_ACTIVE_LB_LLC 标志与专门的 LLC stopper 回调,在 kick 时根据 migration_type 选择 stopper,从而让 ALB 沿用“只迁往 preferred LLC”的过滤。v3 仅改写注释,v4 单纯 rebase,逻辑已通过 Tim Chen 与 Chen Yu 的 Reviewed-by。

lore
RFC重要分析 success作者:Jianyong Wu2026/09/03 10:0462 封邮件

[RFC PATCH v2 00/23] sched: Scale cache-aware aggregation at LLC granularity

本系列(v2,23 个 patch)把 cache-aware 调度的聚合范围从一个 LLC 扩展到多个 LLC,通过去重 NUMA/intra-node LLC 距离矩阵构造 affinity sequence,并基于 affinity score 与线程组整体利用率估算决定扩展深度。同时把 NUMA balancing 拆分为 task migration 与 page migration 两个可独立开关的子特性,以解除与 cache-aware 调度的迁移冲突。整体改动覆盖拓扑基础设施、per-CPU 偏好统计、load balance 决策路径与 sysctl 接口。

lore
其它分析 success作者:Mark Rutland2026/09/03 09:3010 封邮件

[PATCH v2 0/6] sched: dynamic: Simplify PREEMPT_DYNAMIC

Mark Rutland v2 系列把 PREEMPT_DYNAMIC 因 v7.0 限制已无法选择 NONE/VOLUNTARY 这一现实正式化:通过让 PREEMPT_DYNAMIC 依赖 ARCH_HAS_PREEMPT_LAZY,逐 patch 删除 cond_resched/preempt_schedule/irqentry_exit_cond_resched 的 dynamic wrapper、HAVE_PREEMPT_DYNAMIC_{CALL,KEY} Kconfig 以及六个架构对应 stub,净瘦身 374 行,运行时仅剩 dynamic_preempt_lazy 一个静态...

lore
Bugfix重要分析 success作者:Hui Su2026/09/03 02:212 封邮件

[PATCH] sched/core: Call wq_worker_tick() for the execution context

修复 proxy execution 拆分后遗留的回归:sched_tick() 中的 wq_worker_tick() 应当传入实际占用 CPU 的 rq->curr(执行上下文),而不是 rq->donor(调度上下文)。错误对象会导致 kworker 的 CPU 记账缺失与 WORKER_CPU_INTENSIVE 判定延迟,间接推迟 workqueue pool 并发收缩与依赖该 worker 的内核/用户态工作。该修复已获 Tejun Heo ack,等待 Peter Zijlstra 决定通过 sched 还是 workqueue tree 合入。

lore
其它分析 success作者:Bradley Morgan2026/09/02 22:1216 封邮件

[RESEND PATCH 0/5] kthread: remove worker->task self-assignment

本系列把 ivtv、encx24j600、sc16is7xx、cpufreq_schedutil 四个驱动从老 kthread_init_worker+kthread_run(kthread_worker_fn) 迁到 kthread_run_worker/_create_worker,随后删除 kthread_worker_fn 里 worker->task = current 的自赋值 FIXME。Frederic Weisbecker 与 Peter Zijlstra 倾向保留 WARN_ON 做兜底,作者倾向彻底删除,争议尚未定论。

lore
Bugfix重要分析 success作者:Hui Su2026/09/02 19:261 封邮件

[PATCH] sched/core: fix task_sched_runtime() for proxy execution

在 proxy execution 场景下,task_sched_runtime() 旧逻辑只对 rq->donor 刷新 pending runtime,导致被代理执行的 mutex owner(作为 rq->curr)的 CPUCLOCK_SCHED 读到 stale sum_exec_runtime。补丁把判断改为 task_current 而 update_curr 仍走 rq->donor 的 sched_class,从而修复 stale 读取问题。

lore
每页
上一页2 / 5下一页