sched/core: Fix TASK_DEAD race in finish_task_switch()

author Peter Zijlstra <peterz@infradead.org>

Tue, 29 Sep 2015 12:45:09 +0000 (14:45 +0200)

committer Ingo Molnar <mingo@kernel.org>

Tue, 6 Oct 2015 15:05:17 +0000 (17:05 +0200)
author Peter Zijlstra <peterz@infradead.org>
Tue, 29 Sep 2015 12:45:09 +0000 (14:45 +0200)
committer Ingo Molnar <mingo@kernel.org>
Tue, 6 Oct 2015 15:05:17 +0000 (17:05 +0200)
diff --git a/kernel/sched/core.c b/kernel/sched/core.c

index 615953141951747dba2715ac32fed23b5d256627..10a8faa1b0d4a5f737bd9008eb8f9a7e817b6ec9 100644 (file)
--- a/kernel/sched/core.c
+++ b/kernel/sched/core.c
@@ -2517,11 +2517,11 @@ static struct rq *finish_task_switch(struct task_struct *prev)
          * If a task dies, then it sets TASK_DEAD in tsk->state and calls
          * schedule one last time. The schedule call will never return, and
          * the scheduled task must drop that reference.
-        * The test for TASK_DEAD must occur while the runqueue locks are
-        * still held, otherwise prev could be scheduled on another cpu, die
-        * there before we look at prev->state, and then the reference would
-        * be dropped twice.
-        *              Manfred Spraul <manfred@colorfullife.com>
+        *
+        * We must observe prev->state before clearing prev->on_cpu (in
+        * finish_lock_switch), otherwise a concurrent wakeup can get prev
+        * running on another CPU and we could rave with its RUNNING -> DEAD
+        * transition, resulting in a double drop.
          */
         prev_state = prev->state;
         vtime_task_switch(prev);
diff --git a/kernel/sched/sched.h b/kernel/sched/sched.h

index 68cda117574c3aed0e1849a6c07eb28e1f3369c9..6d2a119c7ad9f63338ffb0e9e92efcbc269c2141 100644 (file)
--- a/kernel/sched/sched.h
+++ b/kernel/sched/sched.h
@@ -1078,9 +1078,10 @@ static inline void finish_lock_switch(struct rq *rq, struct task_struct *prev)
          * After ->on_cpu is cleared, the task can be moved to a different CPU.
          * We must ensure this doesn't happen until the switch is completely
          * finished.
+        *
+        * Pairs with the control dependency and rmb in try_to_wake_up().
          */
-       smp_wmb();
-       prev->on_cpu = 0;
+       smp_store_release(&prev->on_cpu, 0);
  #endif
  #ifdef CONFIG_DEBUG_SPINLOCK
         /* this is a valid case when another task releases the spinlock */
author	Peter Zijlstra <peterz@infradead.org>
	Tue, 29 Sep 2015 12:45:09 +0000 (14:45 +0200)
committer	Ingo Molnar <mingo@kernel.org>
	Tue, 6 Oct 2015 15:05:17 +0000 (17:05 +0200)
kernel/sched/core.c		patch \| blob \| history
kernel/sched/sched.h		patch \| blob \| history