日期范围
231
全部讨论数
Bugfix分析 success作者:Fengyu Wang2026/08/04 15:083 封邮件

[PATCH] sched/topology: Free NUMA masks on topology allocation failure

sched_init_numa() 在分配 topology 数组前先通过 rcu_assign_pointer() 发布 NUMA masks;若 kzalloc 失败则提前 return,导致 masks 已发布但永远不会被释放。v1 在失败路径里 unpublish + synchronize_rcu + 三层 kfree 来回收,Tim Chen 进一步建议把 rcu_assign_pointer() 移到分配成功之后,作者将在 v2 中采用这种更简洁的 check-then-publish 写法。

lore
Bugfix重要分析 success作者:Hongling Zeng2026/08/04 14:151 封邮件

[PATCH v2] sched/numa: avoid doubling scan period for remote private faults

这个 v2 单 patch 修复了 NUMA 自动平衡里 update_task_scan_period() 的一个误判:旧代码用 local + shared == 0 判定无 fault,会把只有远程私有 fault 的工作负载误判为完全空闲,从而把扫描周期无条件翻倍。作者把判定换成 local + remote == 0,让这类负载继续走 locality-ratio 计算,同时顺手对齐 ps_ratio / lr_ratio 两个分支的注释。这是 NUMA 调度路径上的一个小但正确的修复,可能让远端私有访问为主的负载扫描变密。

lore
Bugfix分析 success作者:Hongling Zeng2026/08/04 14:093 封邮件

[PATCH] sched/numa: Fix scan period for remote private faults

Hongling Zeng 提交单封 patch 修改 update_task_scan_period() 的早返回条件,把 `local + shared == 0` 改成 `local + remote == 0`,试图让纯远程 private 工作负载进入 ratio 计算分支。但 Zhan Xusheng 评审指出,纯 remote private 场景下 ps_ratio 必为 10(>= 阈值 7),仍会落入 grow period 分支,commit message 中所谓"加速扫描"的说法不成立,实际只是把翻倍变成增长约 3 个 slot,建议补充数据并把注释修正拆成独立 pa...

lore
其它重要分析 success作者:Shubhang Kaushik (Ampere)2026/08/04 08:226 封邮件

[PATCH v3] sched/fair: Prefer waker CPU for non-SMT reciprocal sync wakeups

本系列在 select_task_rq_fair() 中新增 prefer_sync_pair_cpu(),借助 last_wakee 识别 pipe-style ping-pong WF_SYNC 唤醒,在非 SMT 平台上让 wakee 留在 waker CPU,80核 Ampere Altra 上 perf bench sched pipe 提升约 30%。线程后续由 Prateek 提议下沉到 select_idle_sibling() 以覆盖 SMT,并由 Shrikanth 质疑 sync wakeup 的整体语义,呼吁先界定策略再决定合入。

lore
Bugfix重要分析 success作者:Greg Kroah-Hartman2026/08/03 17:352 封邮件

Re: Linux 7.1.6

Greg Kroah-Hartman 在 lore.kernel.org 发布 Linux 7.1.6 稳定分支维护版本,回合了 mainline 上跨 arm64/loongarch/powerpc/riscv/s390/x86/m68k 等多个架构的 bug 修复、驱动支持、文档更新与 BPF/KVM 改进。回复截取的 hunk 显示了 cgroup-v2.rst 的格式清理 (去掉 (npn)、补充 zswap 的 amount of memory used 描述) 以及 hwmon/max34440.rst 新增 ADI ADPM12250 设备支持。公告明确要求所有 7.1 系列用户...

lore
讨论重要分析 success作者:Greg Kroah-Hartman2026/08/03 17:352 封邮件

Re: Linux 6.18.42

Greg Kroah-Hartman 发布 6.18 稳定分支的 6.18.42 小版本,要求所有 6.18 用户必须升级。本帖是 stable-announce 风格的发布公告,包含 DRM 文档、netlink yaml、各架构 DTS 与 RISC-V KVM 等多处修复片段,并非 scheduler 专题讨论。

lore
Bugfix分析 success作者:Greg Kroah-Hartman2026/08/03 17:342 封邮件

Linux 6.6.148

Greg Kroah-Hartman 发布 Linux 6.6.148 stable,要求 6.6 系列用户升级。邮件正文含跨多个子系统的 diffstat;从可读取的 patch 看,本版本把 Tegra234 SoC 的 CPU compatible 从 cortex-a78 更正为 cortex-a78ae,并 bump 了 Makefile 的 SUBLEVEL 到 148。该帖来源标记为 sched 频道,但内容并非 scheduler 专题。

lore
Bugfix分析 success作者:Eric Kim2026/08/03 15:503 封邮件

[PATCH] sched/numa: Reset NUMA fault locality after scan period update

update_task_scan_period 在放大扫描周期时没有清空 numa_faults_locality,导致旧 locality 数据影响下一次 NUMA 调度判断。v1 在早 return 前补 memset;v2 根据 Peter Zijlstra 建议改成 goto out,把清零统一到函数尾部的 out 标签,避免重复代码。

lore
其它分析 success作者:Hongling Zeng2026/08/03 15:401 封邮件

[PATCH RESEND v2] sched: adjust the layout of the cfs_bandwith structure to save memory

通过 pahole 发现 struct cfs_bandwidth 有 13 字节 padding hole,v2 RESEND 把三个 u8 标志挪到 raw_spinlock_t lock 之后,把结构体从 240 字节压到 232 字节。代价是 period_timer 跨过 cacheline 边界,但作者评估这条路径本来已访问多个 cacheline,并不是热点路径。

lore
Bugfix分析 success作者:Andrew Morton2026/08/03 14:544 封邮件

Re: [Bug 221804] New: WARNING at mm/memblock.c:904 __free_reserved_area(): "Cannot free reserved memory because of deferred initialization of the memory map" during housekeeping_init() at boot

CONFIG_DEFERRED_STRUCT_PAGE_INIT=y 时,housekeeping_init() 在 start_kernel() 早期调用 memblock_free() 释放 bootmem cpumask,因延迟内存映射尚未初始化而触发 WARNING 并污染内核。patch 将 memblock_free() 推迟到 core_initcall 执行,确保在 page_alloc_init_late() 完成后再释放。实际无内存泄漏,但 taint 标记影响生产环境。

lore
RFC重要分析 failed作者:Greg Kroah-Hartman2026/08/02 17:51768 封邮件

[PATCH 7.1 001/744] platform/x86/intel-uncore-freq: Fix current_freq_khz after CPU hotplug

platform/x86/intel-uncore-freq: Fix current_freq_khz after CPU hotplug。Claude 分析失败,当前使用规则 fallback:该讨论被归为 rfc,共 768 封邮件。

lore
RFC重要分析 failed作者:Greg Kroah-Hartman2026/08/02 16:43689 封邮件

[PATCH 6.18 001/675] platform/x86/intel-uncore-freq: Fix current_freq_khz after CPU hotplug

platform/x86/intel-uncore-freq: Fix current_freq_khz after CPU hotplug。Claude 分析失败,当前使用规则 fallback:该讨论被归为 rfc,共 689 封邮件。

lore
Bugfix重要分析 success作者:Lu Wang2026/08/01 20:171 封邮件

[PATCH] sched/cache: honor migrate_llc_task semantics in active load balance

补丁修复 migrate_llc_task 在 CPU stopper 异步 active balance 路径上语义丢失的问题:在 struct rq 上保存 active_balance_type,stopper 唤醒时回填 lb_env.migration_type,并抽出 migrate_llc_task_wrong_dst 辅助函数让 can_migrate_task 在 active 阶段也按 preferred_llc 拒绝候选。改动 2 个文件、+23/-3 行,是 Fixes: e4c9a4cb244a 引入时的遗漏修复。

lore
讨论分析 success作者:Markus Reichelt2026/07/31 22:361 封邮件

Re: [PATCH 7.1 000/744] 7.1.6-rc1 review

本邮件是 Markus Reichelt 对 Greg Kroah-Hartman 发布的 7.1.6-rc1 stable review(744 patches)的 Tested-by 回复,确认在 x86_64 Xeon E5-1620 v2 + Slackware64-15.0 上编译通过,并在 x86_64 AMD Ryzen 5 7520U + Slackware64-current 上启动并跑自定义测试未观察到 regression。邮件不涉及具体代码改动,属于 stable review QA 反馈而非 scheduler 子系统讨论。

lore
Bugfix分析 success作者:lirongqing2026/07/31 22:162 封邮件

[PATCH] sched/numa: fix stale dst_nid used in distance calculation for candidate nodes

task_numa_migrate() 遍历候选 NUMA 节点时,distance 仍使用上一次迭代留下的 env.dst_nid,导致 task_weight 评分基于陈旧距离。补丁把 node_distance(env.src_nid, env.dst_nid) 改成 node_distance(env.src_nid, nid),让评分基于真实候选节点距离。thread 仅有 patch 与作者自我 ping,没有 maintainer review。

lore
其它重要分析 success作者:Andrea Righi2026/07/31 22:023 封邮件

[PATCH v2] sched/fair: Prefer fully idle cores for NOHZ balancing

Andrea Righi 的 v2 patch 修改 find_new_ilb(),让 NOHZ idle load balancer 优先挑整核都空闲的 housekeeping CPU,避免在 NVIDIA Olympus/Vera 这种兄弟线程需要约 10 Ki cycles 恢复窗口的 SMT 上被反复短暂唤醒。找不到整核空闲时退回第一个 idle CPU,并在遍历时把部分忙核的兄弟从候选位图中剪掉。GEMM benchmark 性能从 ~6.2 TFLOP/s 提升到 ~9.4 TFLOP/s。

lore
Bugfix分析 success作者:Andrea Righi2026/07/31 20:163 封邮件

[PATCH v2] sched: Reject policy changes with SCHED_FLAG_KEEP_PARAMS

Andrea Righi 的 v2 补丁在 __sched_setscheduler() 中收紧 SCHED_FLAG_KEEP_PARAMS:持 rq 锁时若请求的 policy 与 p->policy 不同则直接返回 -EINVAL,并在该 flag 下跳过 sched_dl_overflow() 的 deadline 带宽记账与 DEQUEUE_CLASS 触发的 class 切换回调。这修复了「带宽已记账、class 回调已发出,但任务参数和 sched_class 其实没变」的不一致,附两条 Fixes 分别指向 uclamp 扩展与 switch 回调折叠两个提交。K Pratee...

lore
Bugfix重要分析 success作者:Phineas Su2026/07/31 18:313 封邮件

[PATCH] sched/fair: Skip NUMA balancing scan on memoryless nodes

Phineas Su 在 task_tick_numa 与 task_numa_work 各加一道 N_MEMORY 早返回,避免 memoryless 节点上空转造成 %sys 接近 78%。patch 仅 6 行新增,属轻量级 bugfix。Peter Zijlstra 提出反对意见,认为应让页面靠近运行节点而不是直接禁用 NUMA balancing,方案可能需要重新调整方向。

lore
其它重要分析 success作者:Luo Gengkun2026/07/31 16:3115 封邮件

[PATCH v8 0/2] Cache aware scheduling: Reduce the overhead of task_cache_work

Luo Gengkun 的 v8 系列为每个 mm 维护 visited_cpus cpumask,把 task_cache_work 的扫描集合从整机/整 node 收缩到近期真正跑过该 mm 且仍在线的 CPU,并用 epoch_last_visit 加 llc_epoch_affinity_timeout 淘汰冷位,同时删除了 get_scan_cpumasks()。Redis 场景扫描 CPU 数从 384 降到 16,task_cache_work 开销从 0.81% 降到 0.02%,p99 延迟劣化从 -25.68% 收敛到 -1.14%。Reviewer 主要质疑 mm->sc...

lore
Bugfix重要分析 success作者:Andrea Righi2026/07/30 19:4310 封邮件

[PATCH 0/2] sched: Fix SCHED_FLAG_KEEP_PARAMS side effects

Andrea Righi 提交 2 patch 修复 SCHED_FLAG_KEEP_PARAMS 模式下 __sched_setscheduler() 仍会触发 class transition 回调与 deadline 带宽记账两处副作用。Peter Zijlstra 进一步主张在 sched_setattr() syscall 入口就拒绝 KEEP_PARAMS 与策略变更的组合,返回 -EINVAL,从源头消除矛盾。讨论还涉及 SCHED_FLAG_KEEP_POLICY 的语义边界与历史 Fixes commit 的影响。

lore
每页
上一页8 / 12下一页