日期范围
160
全部讨论数
Bugfix重要分析 success作者:lirongqing2026/08/22 10:331 封邮件

[PATCH, Resend, v2] sched/debug: Reject invalid writes to numa_balancing scan_size_mb

把 debugfs 中 numa_balancing scan_size_mb 的写入路径换成自定义 file_operations,在 setter 中拒绝 0 与大于 UINT_MAX 的值,统一返回 -ERANGE,避免 task_scan_min() 与 task_nr_scan_windows() 出现除零或被静默截断。注册处选用 debugfs_create_file_unsafe() 而非 debugfs_create_file(),因为 DEFINE_DEBUGFS_ATTRIBUTE 已自带引用计数保护,无须再叠一层 full_proxy。补丁以 Fixes: 8a99b68...

lore
其它重要分析 success作者:Greg Kroah-Hartman2026/08/21 23:0114 封邮件

[PATCH 6.12 011/337] netfilter: br_netfilter: Reallocate headroom if necessary in neigh_hh_bridge()

本系列是 Greg Kroah-Hartman 发布的 Linux 6.12.103-rc1 稳定分支 review,共 337 个 patch,覆盖 netfilter、sched、scsi、drm、alsa、bluetooth、hwmon、mm、kvm、net 等 30 多个子系统的 bugfix 与少量 cleanup/feature。关键改动包括 sched/deadline 仅在 dl_server 运行中启用新唤醒规则、cpufreq/schedutil 在所有 sg_cpu 初始化后发布 util hook、neigh_hh_bridge 重新分配 headroom、SIP NA...

lore
讨论分析 success作者:syzbot2026/08/21 20:431 封邮件

Re: [syzbot] [mm?] BUG: sleeping function called from invalid context in kvm_mmu_notifier_invalidate_range_start

本邮件是 syzbot 对原始 KVM MMU notifier 'sleeping function from invalid context' 修复提议的自动测试回执。提议补丁在 include/linux/kernel.h:70 处无法 apply 到上游基线 818bebeb(drm/xe 改动),属于 patch 与 base 不对齐导致的 CI 失败,不代表补丁本身写错,需要先 rebase 再重测。

lore
Bugfix重要分析 success作者:Sebastian Andrzej Siewior2026/08/21 20:143 封邮件

[PATCH] sched: Allow sleeping spinlocks on PREEMPT_RT within non_block_start()/end block.

PREEMPT_RT 下 spinlock_t/rwlock_t 实际是 rtlock 可睡眠锁,会在 non_block_start()/end() 区间内触发 might_sleep 警告。补丁通过给 __might_resched 增加 rt_sleeping_lock 形参,仅为 rtlock_might_resched 路径打开特例放行,David Woodhouse 已 Acked,并标记 Fixes commit 312364f3534c。

lore
Bugfix重要分析 success作者:Peter Zijlstra2026/08/21 00:312 封邮件

[PATCH] futex: Fix might_sleep() warning in futex_pivot_pending()

Peter Zijlstra提交单补丁,修复私有 futex 哈希 resize 时 wait_var_event() 嵌套睡眠触发 might_sleep() 警告的问题。新增 woken_wake_bit_function 与 __var_wake_key,把 futex_hash_allocate() 中的等待改写为手写 add/sleep/wake 路径,并用 smp_mb() 配对 wait_woken() 的 smp_store_mb(),避免出现 !pending && !active 的窗口。该 patch 已被 tip-bot2 推入 tip:locking/urgent 分...

lore
其它重要分析 success作者:Luigi Rizzo2026/08/20 18:362 封邮件

[PATCH] sched/cpupri: Remove count field from struct cpupri_vec

Luigi Rizzo 提议删除 struct cpupri_vec 的 count 字段及配套的 atomic 操作与 smp_mb 屏障。动机是在 220 核 ARM 上,软中断 CPU 因 irq_thread 频繁调用 cpupri_set() 而有约 25% 时间耗在该函数;移除后该比例降至 2% 以内,且 RT 任务路由仍由 rq->lock 在 find_lock_lowest_rq 中兜底。v2 增加了 cpupri_find 的 benchmark 与无 barrier 安全性的注释。

lore
Bugfix重要分析 success作者:syzbot2026/08/20 15:358 封邮件

[PATCH] futex: Fix might_sleep() warning in futex_pivot_pending()

把 futex_pivot_pending() 从持锁版本回退到 RCU + smp_rmb() 无锁实现,消除 might_sleep() 警告。Peter Zijlstra 进一步指出 wait_var_event 内部存在 lost-wakeup 窗口,需要在 add_wait_queue 之后插 smp_mb__after_spinlock(),由 Yao Kai 采纳。最终 Peter 接受 smp_mb__after_spinlock() 方案足以覆盖所需排序。

lore
Bugfix分析 success作者:Greg Kroah-Hartman2026/08/20 12:19264 封邮件

[PATCH 6.18 001/250] KVM: s390: pci: Fix resource leak on IRQ registration failure

Linux 6.18.45-rc1 stable 回退 250 个 patch,其中 scheduler 部分重点是把 EEVDF 的 vlag/vprot 拆字段并回退先前 6d71a9c61604 的'修复',同时修 PSI cgroup 销毁时未关闭 rtpoll_timer 以及 sched_ext NUMA selftest 在任务睡眠后 affinity 变化导致的崩溃。主要作者包括 Ingo Molnar、Peter Zijlstra、Tejun Heo、Kuba Piecuch 等。

lore
Bugfix重要分析 success作者:Andrea Righi2026/08/20 01:491 封邮件

[PATCH v4] sched/fair: Prefer fully idle cores for NOHZ balancing

Andrea Righi 的 v4 patch 改写 find_new_ilb(),在 SMT 系统上优先选择整核都空闲的 housekeeping CPU 跑 idle load balancer,并以首个空闲 CPU 作为兜底。该改动修复了 NVIDIA Vera Olympus 核上 ILB 唤醒兄弟触发 10 Ki 周期 qualification 间隔、导致 CPU-bound 负载吞吐下降的性能问题,基准从约 6.2 TFLOP/s 提升到约 9.4 TFLOP/s。经 Mete Durlu、Prateek Nayak、Vincent Guittot、Shrikanth Hegde...

lore
讨论分析 success作者:Greg Kroah-Hartman2026/08/20 00:532 封邮件

Linux 7.1.9

Greg Kroah-Hartman 在 lore.kernel.org 上宣布 7.1.9 stable 内核,要求所有 7.1 用户升级。帖中可识别的关键改动包括新增 x86-64 内核参数 tlbi=ipi、hwmon 锁文档扩展(覆盖 debugfs 与 guard()/scoped_guard())以及若干 USB/驱动回归修复。两封邮件正文均在中段被截断,无法据此完整评估改动覆盖面。注意:本帖源自 sched 频道但内容并非调度器相关,应按 stable 滚动发布解读。

lore
讨论重要分析 success作者:Greg Kroah-Hartman2026/08/20 00:532 封邮件

Re: Linux 6.18.45

Greg Kroah-Hartman 发布 Linux 6.18.45 稳定内核,将近期多子系统回移修复合并进 6.18.y 分支,要求所有 6.18 用户升级。其中包含 x86-64 TLB ipi 刷新参数文档、Qualcomm ICE DT 绑定更新、MAINTAINERS NVM 条目以及新增量较大的 Hamoa/Purwa 平台 DTS。

lore
讨论重要分析 success作者:Greg Kroah-Hartman2026/08/20 00:522 封邮件

Re: Linux 6.12.104

Greg Kroah-Hartman 在 lore.kernel.org 发布 Linux 6.12.104 stable 小版本公告,跨 crypto、s390/x86 KVM、amdgpu、blk-mq、hwmon、networking、input 等多子系统集中回植一批修复并强制要求 6.12 用户升级。该 thread 与 scheduler 子系统无直接关联,且两封邮件 body 都在 diffstat 中途被截断,具体 patch 列表需到 linux-stable.git 自查。

lore
讨论分析 success作者:Greg Kroah-Hartman2026/08/20 00:522 封邮件

Re: Linux 6.6.152

Greg Kroah-Hartman 发布 stable 6.6 系列 6.6.152 公告,把上游累积的 dt-binding、s390 KVM、amdgpu TTM、parade-ps8640 bridge、Aquantia/Broadcom 网卡、bonding、mei 等多类补丁同步到 6.6.y 分支,Makefile SUBLEVEL 提升到 152,提示所有 6.6 用户必须升级。本帖不涉及 scheduler 子系统。

lore
讨论分析 success作者:Greg Kroah-Hartman2026/08/20 00:522 封邮件

Linux 6.1.183

Greg Kroah-Hartman 发布 6.1 stable 分支第 183 个点版本,强制要求 6.1 系列用户升级。本帖属于 stable 维护通告而非 scheduler 专项讨论:提交内容覆盖版本号 bump、arm64 Tegra234 DT 兼容串从 cortex-a78 改为 cortex-a78ae、arm npcm SMP 启动路径上补齐 of_node_put 引用计数、以及少量文档与 devres 补齐。整条线索只有发布公告与一份 diff 起始片段,没有针对 scheduler 子系统的具体评审或讨论。

lore
Bugfix重要分析 success作者:Greg Kroah-Hartman2026/08/20 00:522 封邮件

Linux 5.15.216

Greg Kroah-Hartman 发布 Linux 5.15.216 stable,把跨 PowerPC cputime、ARM npcm SMP boot 节点泄漏、x86 KVM nested 和多个驱动稳定分支的修复一次性 backport 到 linux-5.15.y。所有 5.15 用户必须升级。

lore
Bugfix重要分析 success作者:gregkh2026/08/19 19:152 封邮件

FAILED: patch "[PATCH] sched/psi: Shut down rtpoll_timer in psi_cgroup_free()" failed to apply to 5.10-stable tree

PSI 子系统中 psi_schedule_rtpoll_work() 在调度热路径上 lockless 调用,可能在 psi_trigger_destroy() 删除 timer 后重新 mod_timer 装弹,导致 cgroup 释放后 timer 仍在已释放内存上执行。补丁把 timer 关闭下沉到 psi_cgroup_free(),mainline 用 timer_shutdown_sync(),5.10.y 通过 timer_delete_sync() 与嵌入字段 cgroup->psi.poll_timer 做适配。

lore
Bugfix重要分析 success作者:gregkh2026/08/19 19:144 封邮件

FAILED: patch "[PATCH] sched_ext: Take cgroup_lock() first in scx_cgroup_lock()" failed to apply to 6.18-stable tree

scx_cgroup_lock() 中先取 rwsem 写锁再 cgroup_lock() 的顺序会通过 kernfs 与 enable/rmdir/cpu.weight 形成死锁闭环。修复把 cgroup_lock() 提到写锁之前断开环路,并把该 patch 连同两个 stable-dep(warning 翻转、enable/disable 路径重构)一起按 6.18-stable 的 kernel/sched/ext.c 路径回迁。

lore
Bugfix分析 success作者:Greg Kroah-Hartman2026/08/19 17:17286 封邮件

[PATCH 7.1 001/271] mount: honour SB_NOUSER in the new mount API

本 thread 是 Greg Kroah-Hartman发布的 Linux 7.1.9-rc1 stable review,271 枚 patch + 13 封 Tested-by 回复。scheduler 子树相关8 枚 patch集中修复 sched_ext sub-sched 启停 race、cgroup_lock 顺序、psi psimon kthread 与 rtpoll_timer 生命周期,以及 rqspinlock deadlock 路径的 tail 重置。整体是稳定分支的合订公告,分类为 bugfix 序列。

lore
RFC重要分析 success作者:Joshua Hahn2026/08/19 11:462 封邮件

[RFC PATCH v3 00/14] Introduce tiered memcg limits

Joshua Hahn 提出一套 14 patch 的 RFC,把 memory.{min,low,high,max} 在每个内存层级(DRAM/CXL/PMEM 等)按系统容量比例缩放,从而防止先到的 cgroup 独占高速层。在 1TB 双层机器上的测试显示,多 workload 在 DRAM/CXL 上的占用极差从 7.10x 降到 1.06x,作业完成时间极差从 54.9s 降到 26.1s。Song Hu 另指出 calculate_high_delay() 存在 pre-existing 整数溢出,建议作独立 fix。

lore
Bugfix重要分析 success作者:gregkh2026/08/19 03:302 封邮件

FAILED: patch "[PATCH] sched/psi: Shut down rtpoll_timer in psi_cgroup_free()" failed to apply to 5.15-stable tree

上游 commit 5457025fa8ca 把 psi rtpoll_timer 的关闭从 trigger 销毁路径移到 psi_cgroup_free(),用 timer_shutdown_sync() 一次性绑定 group 生命周期,消除调度器热路径 re-arm 导致的 use-after-free。该补丁 cherry-pick 到 5.15-stable 失败,Greg KH 发出 FAILED 通知。Sasha Levin 随后提交手工适配版,把 cgroup->psi-> 指针解引用改为内嵌的 cgroup->psi.,并把 rtpoll_* 成员名改回 poll_*。

lore
其它分析 success作者:Liang Hao2026/08/18 23:191 封邮件

[PATCH] sched/hrtick: Name the minimum slice and derive the rearm slack

本 patch 把 hrtick 子系统中硬编码的 10000ns floor 与 5000ns rearm 阈值抽成两个命名宏,并显式把余量定义为最小切片的一半,仅提升可读性、不改变行为。作者本人也提出疑问:5us 阈值当年是否刻意作为 10us 的一半引入,等维护者澄清历史语义后再决定是否合入。

lore
其它重要分析 success作者:Luo Gengkun2026/08/18 22:424 封邮件

[PATCH v9 1/2] sched/cache: Reduce the overhead of task_cache_work by only scan the visisted cpus

本系列补丁为 cache-aware scheduling 引入 visited_cpus cpumask,让 task_cache_work() 只扫描最近真正访问过的 CPU,把多 NUMA 系统中的扫描 CPU 数从 384 降到 16 左右,Redis p99 延迟下降约 25%。Chen Yu C 在 review 中进一步指出单线程进程 visited_cpus 位累积以及跨 NUMA 抖动两个潜在风险,作者倾向于不加 gate。

lore
RFC重要分析 success作者:Vlastimil Babka (SUSE)2026/08/18 19:404 封邮件

[PATCH RFC 0/5] allow kfree_nolock() handle kmalloc() objects

Vlastimil Babka 发布5 patch RFC,把 kfree_nolock() 从只能释放 kmalloc_nolock() 对象扩展为可释放任意 kmalloc() 对象(含 kfence、kmemleak 注册对象、large_kmalloc),必要时通过 irq_work 延迟释放。调度器据此把 set_cpus_allowed_force() 中的 kfree_rcu() 替换为 kfree_nolock(),避免 RCU grace period 延迟。Hao Li 给出 Reviewed-by;Catalin Marinas 对 kmemleak 扫描期间 defer...

lore
Bugfix分析 success作者:Eric Kim2026/08/18 11:491 封邮件

[PATCH v3] sched/fair: Reset NUMA fault locality after scan period update

Eric Kim 的 v3 patch 修复 update_task_scan_period() 在 period==0 分支提前 return 导致 numa_faults_locality 未被清零的 bug。原代码会让上一窗口的旧 locality 反复被计入下一个窗口,触发 numa_scan_period 持续翻倍直至 numa_scan_period_max,把 task 永久冻结在错误 NUMA 节点。修复方法是把 return 改为 goto out,强制所有退出路径都走尾部 memset cleanup。v2 已按 Peter Zijlstra 建议复用 out 标签,v3 ...

lore
其它重要分析 success作者:shisiyuan2026/08/17 22:543 封邮件

[PATCH] sched/psi: add cpu_prio pressure metric for high-priority task stalls

该补丁在 PSI 中新增 cpu_prio 资源,只统计静态优先级不高于阈值的任务等待 CPU 的时长,以隔离延迟敏感负载的争用信号。维护者 Peter Zijlstra 直接回 Yeah, I think not. 拒绝,Michal Koutny 进一步指出把目标任务放进独立 cgroup 后读取 cpu.pressure 已经能做到同样效果,因此没有继续迭代。

lore
RFC重要分析 success作者:Xukai Wang2026/08/16 13:174 封邮件

[PATCH RFC v2] sched/proxy: Defer donor commit until proxy resolution

Xukai Wang 提议把 pick_next_task() 的类提交语义(put_prev_set_next_task + rq_set_donor)推迟到 __schedule() 中 find_proxy_task() 解析成功之后执行,避免 proxy 解析失败时对 blocked donor 的投机性 set_next 与撤销。v2 同时把 zap_balance_callbacks() 收回 proxy_resched_idle(),并把候选与已提交 donor 在 proxy_deactivate / proxy_migrate_task 中显式区分。John Stultz 要...

lore
Bugfix重要分析 success作者:Hui Su2026/08/16 01:061 封邮件

[PATCH v3] cpufreq: schedutil: Fix rate limit overflow

schedutil governor 把 rate_limit_us 与 NSEC_PER_USEC 相乘得到 freq_update_delay_ns,但在 32 位平台上整段按 32 位无符号算术执行,会把约 4.29 s 的延迟溢出成 704 ns,导致频率更新失控。补丁抽出 sugov_update_rate_limit_us() 在乘法前显式扩到 s64,在 sysfs 写入与 governor 启动两条路径上一并修复,并 Fixes 引入该问题的 9bdcb44e391d、抄送 stable。Rafael 作为 cpufreq maintainer 已加入对话。

lore
其它重要分析 success作者:Xin Zhao2026/08/15 19:0411 封邮件

[PATCH 10/10] sched/fair: Strive to find a task to migrate if newly idle when LB_PROMOTE

Xin Zhao 提交的 10-patch 系列引入新的 SCHED_FEAT 开关 LB_PROMOTE,针对嵌入式平台(CONFIG_HZ_250)上 CFS 任务出现的不合理 CPU idle(>2.5ms 甚至 >4ms)问题,从 wake-up CPU 选择、newly idle 兜底、CFS 被 RT 抢占迁移三个场景主动出击。配套包含 rd overload 误清零、active_balance 清零时机、active_load_balance_cpu_stop 通用化等前置修复。默认关闭,开启后以 sys% 上升换取 ≤4ms 的调度延迟保证。

lore
Bugfix重要分析 success作者:Vincent Guittot2026/08/15 03:3611 封邮件

[PATCH] sched/fair: Fix flat hierarchy

EEVDF 引入 flat hierarchy 后,update_curr 走的是 cgroup 层级上的 h_curr,不会真正刷新 root cfs_rq 的 avg_vruntime,导致入队/出队时 short task 的 lag 一直累积到 clamp 上限。Vincent 首发补丁在 enqueue/dequeue 入口补一次 update_curr;维护者 Peter Zijlstra 评审后抽成 update_curr_eevdf 内联函数,并清理掉 requeue_delayed_entity 的重复调用,最终合入 tip 的 sched/core。

lore
Bugfix重要分析 success作者:tip-bot2 for Vincent Guittot2026/08/15 03:361 封邮件

[tip: sched/core] sched: Update time before requeueing delayed entities

Vincent Guittot 给 CFS 的 requeue_delayed_entity() 加上 update_curr(cfs_rq) 调用,确保 update_entity_lag() 在计算 delayed 任务的等待补偿时使用的是当前时间而非陈旧的 clock_task。少了这一行,delayed entity 会被误判为更年轻、得到更少的 vruntime 补偿,是一个隐蔽的公平性 bug。改动只有 1 个文件 +2 行,已被 Peter Zijlstra 合并进 sched/core。

lore
Bugfix分析 success作者:Fengyu Wang2026/08/14 23:543 封邮件

[PATCH v2] sched/topology: Free NUMA masks on topology allocation failure

修复 sched_init_numa() 在 sched_domain_topology_level 数组分配失败时未释放 sched_domains_numa_masks 的内存泄漏。v2 把 rcu_assign_pointer() 从 kzalloc 之前挪到之后,让错误路径上的 masks 从未被发布,避免了 v1 中 rcu_assign_pointer(NULL) + synchronize_rcu() 的复杂撤回逻辑。Tim Chen 给出反馈促使 v2 重写,Valentin Schneider 给出 Reviewed-by。

lore
Bugfix分析 success作者:K Prateek Nayak2026/08/14 22:451 封邮件

[PATCH] sched/topology: Do not override sd->shared allocation

针对 commit 9e005ed21152d 引入的 kmemleak,在 init_sched_domain_shared() 入口加 sd->shared 非空判断早返回,避免 SD_ASYM_CPUCAPACITY 与 SD_SHARE_LLC 落到同一 domain 时后一次覆盖前一次的 sched_domain_shared。同时顺手把注释里 avaialable 改成 available。

lore
Bugfix分析 success作者:monios1145142026/08/14 21:571 封邮件

[PATCH] sched/topology: fix memory leaks in allocation failure paths

patch 修复 sched_init_numa / __sdt_alloc / __sds_alloc 三个分配失败路径的内存泄漏,统一采用 goto fail + __sdt_free/__sds_free 集中清理。0day 用 clang -Wself-assign 抓到 for (i = i; ...) 的自赋值写法,需要在 v2 换循环变量后再提。

lore
其它分析 success作者:Ziyang Men2026/08/14 04:245 封邮件

[PATCH 0/2] cgroup, sched: add bpf for cgroup cpu controller

Ziyang Men 提交一个 2 patch 系列,为 cpu cgroup 暴露三个 BPF kfunc:bpf_cpu_cgroup_flush_stats、bpf_cpu_cgroup_cputime、bpf_cpu_cgroup_throttled_self,沿用 mm/bpf_memcontrol.c 的 memcg 设计思路。cputime 内部用一次 __css_rstat_lock + cputime_adjust 算齐全部基础 CPU 时间,节流总和由内核通过去除 static 的 throttled_time_self() 提供。配套 selftests/bpf 验证 B...

lore
Bugfix分析 success作者:Sebastian Andrzej Siewior2026/08/14 00:516 封邮件

[PATCH] sched/topology: Add a cpus_read_lock to partition_sched_domains()

该单 patch 修复 sysctl 写 sched_rt_runtime_us 时触发 "missing cpu_hotplug_lock" 回溯告警的问题:在 partition_sched_domains() 入口加 guard(cpus_read_lock)()。Chen Yu 与 Tim Chen 在回复中讨论是否应将锁下推到 CONFIG_CPUSETS=n 下的 rebuild_sched_domains() 等 stub 调用方,以与历史约定 "Call with hotplug lock held" 保持一致。

lore
Bugfix分析 success作者:Waiman Long2026/08/13 18:382 封邮件

[PATCH v4] sched/isolation: Defer freeing of cpumask memblock memory to initcall

带 nohz_full 启动时,housekeeping_init() 在 memory map 尚未初始化前调用 memblock_free(),触发 mm/memblock.c 的新告警。补丁把待释放的 cpumask 直接当作 llist_node 串入 __initdata 链表,改由新增的 pure_initcall housekeeping_late_init() 统一 memblock_free()。仅改 15 行,依赖 memblock 的 7c2eee9c1367 以避免 KASAN UAF,已由 Peter Zijlstra 合入 tip:sched/core(2b58c7...

lore
Bugfix重要分析 success作者:soolaugust2026/08/13 12:092 封邮件

[PATCH] sched/proxy_exec: Limit find_proxy_task() chain depth to prevent CPU hang

Proxy execution 下两个任务互相等待对方 mutex 会让 find_proxy_task() 在 blocked_on 链上无限循环,CPU 持 rq->lock spin 死。补丁用 rq 上的 proxy_pick_seq 给每次 walk 打唯一标记,重复走到同一节点时清掉 blocked_on 并 deactivate 该任务,从 v1 深度上限演进到 v5 的 per-pick seq 标记,能识别链中任意位置的循环(A→B→C→A),是 PE 走向 futex 之前的必修课。

lore
其它重要分析 success作者:Bharata B Rao2026/08/13 10:219 封邮件

[PATCH v8 0/8] mm: Hot page tracking and promotion infrastructure

Bharata B Rao 第 8 版提交 pghot 子系统,把 NUMA hint fault、AMD IBS Memory Profiler 以及未来 CXL HMU 等热页来源统一到 per-PFN hotness 记录与 per-node kmigrated 线程,并把 kernel.numa_balancing=2 的 tiering 路径从 scheduler 迁到 mm。Andrew Morton、Matthew Wilcox、SJ Park、D. Hildenbrand 等 maintainer 提出与 DAMON 重叠、diffstat 过大、未拿到任何 Acked-by ...

lore
其它分析 success作者:Kayra Cizmeci2026/08/12 23:101 封邮件

[PATCH] sched/fair: Avoid calculating curr's key twice in pick_eevdf()

本 patch 把 pick_eevdf() 中 entity_eligible()→vruntime_eligible() 这条路径里重复的 entity_key(cfs_rq, curr) 减法抽成新的 curr_eligible(),让 vruntime - min_vruntime 只算一次。无功能变化,仅做 micro-cleanup,把 curr!=NULL/on_rq 的不变量交给 caller。建议补 WARN_ON_ONCE 与 micro-bench 以便 review。

lore
其它重要分析 success作者:Boqun Feng2026/08/12 19:1820 封邮件

[PATCH v5 00/18] Refcounted interrupt disable and SpinLockIrq for Rust

Boqun Feng 主推的 v5 18 贴系列把 preempt_count 中的 NMI 嵌套迁到 per-CPU 计数器,腾出 8 bit 给新的 HARDIRQ_DISABLE 计数器,并在 64-bit 架构把 PREEMPT_NEED_RESCHED 拆到独立字。系列在 C 端新增 local_interrupt_disable/enable 以及 spin_lock_irq_disable / spin_unlock_irq_enable 三件套,并附 KUnit 测试;在 Rust 端引入 kernel::interrupt 模块的 LocalInterruptDisabled...

lore
Bugfix分析 success作者:lirongqing2026/08/12 15:281 封邮件

[PATCH v2] sched/debug: reject invalid writes to numa_balancing scan_size_mb

该 patch 用 debugfs 自定义 file_operations 替换 debugfs_create_u32,对 numa_balancing/scan_size_mb 的写入做范围校验,避免 0 与超过 UINT_MAX 的值触发 task_scan_min 与 task_nr_scan_windows 的除零。v1 到 v2 把 debugfs_create_file 换成 debugfs_create_file_unsafe 省去 full_proxy,并重写 commit message。后两封同作者的答复只是 ping 维持邮件,没有新内容。

lore
Bugfix重要分析 success作者:Lu Wang2026/08/12 00:104 封邮件

[PATCH] sched/cache: honor migrate_llc_task semantics in active load balance

Lu Wang 修复 cache-aware scheduling 中 active load balance 丢失 migrate_llc_task 语义的 bug:被动 LB 把 group_llc_balance 标成 migrate_llc_task 后,CPU stopper 重建的 lb_env 默认成 migrate_load,导致 ALB 在 src_rq 上多任务场景可能把 preferred LLC 与目标 LLC 不匹配的任务错误拉走。v2 通过挑选 stopper 回调 + 新增 LBF_ACTIVE_LB_LLC 标志,把 LLC 方向判断透传到 ALB 路径,同时避...

lore
其它重要分析 success作者:Madadi Vineeth Reddy2026/08/11 13:413 封邮件

[PATCH] sched/fair: Let sync wakeups target the waker's core

补丁在 select_idle_core() 中识别“waker 即将 sleep 且 rq 仅剩它自己”的状态,把 waker 的 CPU 视为 idle,使得 SMT 上 wakee 能落到 waker 核的兄弟线程,复用 cache 又避免 stacking。讨论中 Prateek 与 Chen Yu 提出上提到 select_idle_sibling() 或抽出 select_idle_sync_core() 的重构方案,x86 Zen 3 上 Kayra 的测试显示 cycles 下降 1.40% 但 cache-misses 上升 4.60%,收益高度依赖 SMT 编号方式。

lore
Bugfix重要分析 success作者:Aaron Tomlin2026/08/11 09:3410 封邮件

[PATCH v4 0/5] sched/debug: Introduce per-CPU debugfs files

Aaron Tomlin 发送 v4 系列补丁,修补 sched debugfs 中 print_dl_rq() 的 rq->rd UAF、print_cpu() 的 rq->curr UAF、sched_show_numa() 的 p->mm TOCTOU、print_cfs_stats() 的 leaf_cfs_rq_list RCU 遍历违规,并新增 /sys/kernel/debug/sched/cpu/cpu<N>/debug 按 CPU 视图。评审集中在 Patch 1/5 上,Prateek 与 Aaron 讨论了 rcu_dereference_all() 与 __rcu 注解...

lore
其它分析 success作者:Greg Kroah-Hartman2026/08/11 07:009 封邮件

[PATCH 7.1 001/438] net: mpls: initialize rtm_tos in mpls_getroute()

Greg Kroah-Hartman 发布 Linux 7.1.8-rc1 稳定分支的 438 个回搬补丁合入评审。涵盖 mm/slab、btrfs、netfilter、bluetooth、KVM、ALSA、drm 等子系统;其中 sched/deadline 183/438 限定 revised wakeup rule 仅在 dl_server running 时生效。窗口期截止 2026-08-09 14:33 UTC;多数回信为 Tested-by/确认收到。

lore
其它分析 success作者:Greg Kroah-Hartman2026/08/11 06:405 封邮件

[PATCH 6.18 001/396] netfilter: nf_conntrack_expect: restore helper propagation via expectation

Greg KH 发布的 6.18.44-rc1 stable review 一次拉取 396 个 patch,跨 netfilter、btrfs、mm/slab、drm、ALSA、Bluetooth、hwmon、net、scsi、can、phy 等 30+ 子系统。真正属于 scheduler 的只有 PATCH 149/396 sched/deadline: Use revised wakeup rule only for running dl_server,把 DL wakeup rule 的判定收敛到 dl_server 实际 running 时。其余 395 个均为各子系统 bugfi...

lore
Bugfix重要分析 success作者:Karl Mehltretter2026/08/11 05:571 封邮件

[PATCH 0/5] kcov: suppress timer and scheduler coverage leaks

5 patch 系列在 kcov_mode 中新增可嵌套的 KCOV_PAUSED 位,配合 __always_inline 的 kcov_pause()/kcov_resume(),在 hrtimer 延迟 rearm、__schedule()、try_to_wake_up()、wake_up_new_task() 入口抑制被插桩 callee 把非确定性 scheduler/timer 路径误记入 current。修复后 KCOV selftest 在 x86_64/s390/RISC-V/LoongArch 通过,syzkaller A/B corpus +28.8%、coverage ...

lore
讨论重要分析 success作者:Kayra Cizmeci2026/08/11 02:263 封邮件

[PATCH] sched/fair: Drop min_vruntime() call from set_protect_slice()

Kayra Cizmeci 提出在 set_protect_slice() 中直接去掉 min_vruntime() 调用以省掉一次比较,但 Zhan Xusheng 在 review 中指出:PLACE_DEADLINE_INITIAL 会让新实体的 deadline 只领先半个 slice,而 put_prev_entity() 重新入队时不续期 deadline,导致算出的 vprot 可能越过 deadline,从而让 RUN_TO_PARITY 保护超出实体的合法时间窗。作者在收到详细解释后承认疏漏,主动请求 drop patch,本 thread 以讨论形式收尾。

lore
Bugfix重要分析 success作者:Zhan Xusheng2026/08/10 22:201 封邮件

[PATCH v2] sched/debug: Validate writes to the scan_size_mb debugfs knob

扫描大小旋钮 scan_size_mb 从 sysctl 迁到 debugfs 时丢失了下界校验、上界也从未存在,导致写 0 或 2^24(4K 页 MB_TO_PAGES 回绕点)会让 fork/clone 路径在内核态除零 Oops。该 patch 把它换成自定义 write handler,校验 0 < mb <= UINT_MAX >> (20 - PAGE_SHIFT),越界返回 -EINVAL。

lore
Bugfix重要分析 success作者:Zhan Xusheng2026/08/10 21:582 封邮件

[PATCH] sched/debug: Validate writes to the scan_size_mb debugfs knob

为 debugfs 中的 scan_size_mb 写入口补上边界校验。原先 sysctl 的 .extra1=SYSCTL_ONE 在迁移到 debugfs 时被丢弃,导致写入 0 或 2^24 倍数值会让 MB_TO_PAGES() 回绕到 0,触发 task_scan_min/task_nr_scan_windows 除零内核 oops。补丁新增 write handler,拒绝非法值并在 qemu 上验证。Chen Yu 给出 Reviewed-by 并建议 kstrtouint_from_user 使用 base 0 以兼容十六进制写入。

lore
每页
上一页3 / 4下一页