tile: use a more conservative __my_cpu_offset in CONFIG_PREEMPT
authorChris Metcalf <cmetcalf@tilera.com>
Thu, 26 Sep 2013 17:24:53 +0000 (13:24 -0400)
committerChris Metcalf <cmetcalf@tilera.com>
Mon, 30 Sep 2013 14:34:41 +0000 (10:34 -0400)
commitf862eefec0b68e099a9fa58d3761ffb10bad97e1
treee82f50d999230deac554c91de5665a6475836243
parent3f725c5b924e14eb00c58892d21d92100121e5ce
tile: use a more conservative __my_cpu_offset in CONFIG_PREEMPT

It turns out the kernel relies on barrier() to force a reload of the
percpu offset value.  Since we can't easily modify the definition of
barrier() to include "tp" as an output register, we instead provide a
definition of __my_cpu_offset as extended assembly that includes a fake
stack read to hazard against barrier(), forcing gcc to know that it
must reread "tp" and recompute anything based on "tp" after a barrier.

This fixes observed hangs in the slub allocator when we are looping
on a percpu cmpxchg_double.

A similar fix for ARMv7 was made in June in change 509eb76ebf97.

Cc: stable@vger.kernel.org
Signed-off-by: Chris Metcalf <cmetcalf@tilera.com>
arch/tile/include/asm/percpu.h