Re: mm: deadlock between get_online_cpus/pcpu_alloc

mm: deadlock between get_online_cpus/pcpu_alloc · Dmitry Vyukov <dvyukov@google.com> · 2017-01-29
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Vlastimil Babka <hidden> · 2017-01-29
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Dmitry Vyukov <dvyukov@google.com> · 2017-01-30
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Dmitry Vyukov <dvyukov@google.com> · 2017-02-06
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-06
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Vlastimil Babka <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Vlastimil Babka <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Vlastimil Babka <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Vlastimil Babka <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Vlastimil Babka <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Peter Zijlstra <peterz@infradead.org> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-09
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-10
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Christoph Lameter <hidden> · 2017-02-08
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Tejun Heo <tj@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Mel Gorman <hidden> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Tetsuo Handa <penguin-kernel@I-love.SAKURA.ne.jp> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Michal Hocko <mhocko@kernel.org> · 2017-02-07
Re: mm: deadlock between get_online_cpus/pcpu_alloc · Thomas Gleixner <hidden> · 2017-02-07

From: Vlastimil Babka <hidden>
Date: 2017-02-07 12:43:46
Also in: lkml

On 02/07/2017 01:37 PM, Michal Hocko wrote:

quoted

@@ -6711,7 +6714,16 @@ static int page_alloc_cpu_dead(unsigned int cpu)
 {

 	lru_add_drain_cpu(cpu);
+
+	/*
+	 * A per-cpu drain via a workqueue from drain_all_pages can be
+	 * rescheduled onto an unrelated CPU. That allows the hotplug
+	 * operation and the drain to potentially race on the same
+	 * CPU. Serialise hotplug versus drain using pcpu_drain_mutex
+	 */
+	mutex_lock(&pcpu_drain_mutex);
 	drain_pages(cpu);
+	mutex_unlock(&pcpu_drain_mutex);

You cannot put sleepable lock inside the preempt disbaled section...
We can make it a spinlock right?

Scratch that! For some reason I thought that cpu notifiers are run in an
atomic context. Now that I am checking the code again it turns out I was
wrong. __cpu_notify uses __raw_notifier_call_chain so this is not an
atomic context.

Good.

Anyway, shouldn't be it sufficient to disable preemption
on drain_local_pages_wq? The CPU hotplug callback will not preempt us
and so we cannot work on the same cpus, right?

I thought the problem here was that the callback races with the work item that 
has been migrated to a different cpu. Once we are not working on the local cpu, 
disabling preempt/irq's won't help?

--
To unsubscribe, send a message with 'unsubscribe linux-mm' in
the body to majordomo@kvack.org.  For more info on Linux MM,
see: http://www.linux-mm.org/ .
Don't email: <a href=mailto:"dont@kvack.org"> email@kvack.org </a>

`h`	back out one level
`j`	next message in thread
`k`	previous message in thread
`l`	drill in
`Esc`	close help / fold thread tree
`?`	toggle this help