日期范围
275
全部讨论数
Bugfix重要分析 success作者:Luo Gengkun2026/07/16 04:448 封邮件

[PATCH v5 linux 0/2] Cache aware scheduling: Reduce the overhead of task_cache_work

v5 为每个 mm 维护 visited_cpus,使 task_cache_work 只扫描近期实际访问且满足 NUMA/LLC 约束的 CPU。AMD Redis 测试中扫描数量由 384 降至最多约 16,task_cache_work 的 cycles 占比降至约 0.02%。评审同时指出空闲 CPU 的 cpu_epoch 可能停止推进,导致陈旧 CPU 无法从集合淘汰;由于后续邮件被截断,最终解决方案尚不能确认。

lore
其它重要分析 success作者:Shrikanth Hegde2026/07/14 21:1637 封邮件

[PATCH v7 00/12] sched, steal_monitor: Introduce cpu_preferred_mask and steal-driven vCPU backoff

Shrikanth Hegde 发布 v7 系列 [PATCH v7 00/12],引入 cpu_preferred_mask 与 drivers/virt/steal_monitor,让 guest调度器按 steal time 周期性地收缩/扩张 preferred CPU 集合,并在 wakeup、tick、load balance 路径上把任务优先放到 preferred CPU。Yury Norov 在多封回复中提出 invariant 恢复策略、Kconfig 依赖、模块参数校验、bisect 顺序、sysfs gating 等问题,作者宣布 v8 将修复文档告警、删除 patch...

lore
其它重要分析 success作者:Feng Tang2026/07/14 19:131 封邮件

[PATCH v4] sched/debug: Dump end of stack when stack corruption detected

v4 在 __schedule_bug 检测到栈末端哨兵被破坏时,于 panic 之前先用 print_hex_dump 把破坏点附近 16 个 ulong 的原始内存打到 KERN_ERR,方便和 KASAN、slub_debug 等其他 dump 对齐。背景是 suspend/resume hang 期间以太网驱动在 suspend hook 释放了 RX 缓冲区,导致硬件仍通过 DMA 写入已释放的内存并踩坏栈末端哨兵。新增 dump 让开发者能把栈破坏点和 KASAN 报告按地址对位,从而定位真凶。

lore
Bugfix分析 success作者:Wanwu Li2026/07/14 17:493 封邮件

[PATCH] sched/core: Fix stale se.load when modifying nice value under sched_ext

Wanwu Li 提交一个 patch,修复 sched_ext 调度类下任务修改 nice 后 p->se.load 未同步的问题,避免任务切回 CFS 时使用过期的 load weight。该 patch 在 set_load_weight() 中针对 task_on_scx(p) 显式刷新 se.load。但 K Prateek Nayak 在回复中指出同一问题已被更早的 patch 解决,作者随后主动撤回了本 patch。

lore
Bugfix分析 success作者:Shubhang Kaushik (Ampere)2026/07/14 03:461 封邮件

[PATCH v2] sched/core: Preserve wake flags across queued wakeups

v2 patch 将 sched_ttwu_pending() 排队的 remote wakeup 上保存的 wake flags,从「是否迁移」的 1 位布尔扩展为 WF_TTWU_QUEUE_MASK(WF_TTWU / WF_SYNC / WF_MIGRATED / WF_RQ_SELECTED)。drain 时一并回传给 ttwu_do_activate(),让 queued 与 direct wakeup 路径在非空闲目标 CPU下的抢占决策保持一致。改动仅 3 个文件 +7/-18,并在 Ampere Altra 80 CPU 系统上用 perf bench / hackbench...

lore
Bugfix重要分析 success作者:Shubhang Kaushik (Ampere)2026/07/14 02:253 封邮件

[PATCH] sched/core: Preserve wake flags across queued wakeups

补丁把 sched_remote_wakeup:1 扩展为 sched_remote_wakeup_flags:8,在 ttwu_queue_wakelist 处保存 WF_TTWU/WF_SYNC/WF_MIGRATED/WF_RQ_SELECTED 的位掩码,并在 sched_ttwu_pending 排空 wakelist 时把原始 wake flags 透传给 ttwu_do_activate,使排队唤醒与直接唤醒在抢占判断上行为一致。回复中 reviewer 与作者讨论是否改为显式 u8 字段以避免位域原子性歧义。

lore
Bugfix分析 success作者:Guopeng Zhang2026/07/13 18:581 封邮件

[RESEND PATCH] sched/deadline: Exclude special DL entities from bandwidth moves

SUGOV 特殊 DL 实体只使用假带宽,本应在所有带宽相关路径中被一致排除。dl_task_needs_bw_move() 漏掉了这一排除,导致 set_cpus_allowed_dl() 和 cpuset attach 在亲和性改变时会错误地触发 root-domain bandwidth move。补丁在入口条件中加入 dl_entity_is_special() 检查,让特殊实体直接跳过带宽搬移流程,保持与其它 SUGOV special entity 路径一致。该改动已获得 Reviewed-by 和 Acked-by。

lore
RFC重要分析 success作者:Xukai Wang2026/07/13 13:017 封邮件

[PATCH RFC] sched/proxy: Defer donor commit until proxy resolution

作者 Xukai Wang 提交 RFC v1,把 pick_next_task() 从「边选边 commit」改为「只挑不 commit」,让 __schedule() 在 find_proxy_task() 解析成功后才做唯一的 class commit,避免把最终不运行的 blocked donor 投机性切换到 class current state。patch 同步更新 proxy_deactivate() 与 proxy_migrate_task() 的 rq->donor 处理。AMD 的 K Prateek Nayak 持保留意见,认为锁内 pick 会收敛到同一 donor、...

lore
RFC重要分析 success作者:K Prateek Nayak2026/07/13 11:252 封邮件

[RFC PATCH 0/1] sched/eevdf: Curb wakeup preemption further

K Prateek Nayak 提出 RFC:在 EEVDF pick_eevdf() 唤醒抢占路径上保护正在运行的 curr 任务,避免因带正 lag 的唤醒任务拉低 avg_vruntime 导致 NGINX 等服务被频繁非自愿抢占。新增 RUN_TO_PARITY_WAKEUP sched_feat,仅当 curr 自选中起尚未耗尽 slice 时跳过 eligibility 检查。DeathStarBench 吞吐恢复至 v6.5 水平。Peter、Youssef 等围绕图示、base_slice_ns 是否已足够、是否在所有路径禁用 eligibility 展开讨论;2026 年 C...

lore
其它重要分析 success作者:Mukesh Ojha2026/07/11 23:4463 封邮件

[PATCH v3 00/26] Introduce meminspect

26 patch 跨子系统框架,把静态/动态变量登记进 .inspect_table 表,供 firmware/bootloader 在系统失能后读取。配套 Qcom Minidump 与 Pixel Kinfo 两个 backend,已在 SA8775P 验证。Lorenzo 与 Sashiko 评审同时质疑 EXPORT 语义、virt_to_phys 误用及 201 个槽位的固定表容量。

lore
每页
上一页27 / 28下一页