Wie aus einer stillen Erwartung eine sichtbare Leistung wird – und warum der Ausweg eine andere Information ist und kein anderer Mensch
In fast jedem Haus gibt es eine Person, bei der es „einfach nicht passt“. Sie arbeitet nicht schlecht, aber auch nicht gut. Sie bekommt die einfacheren Aufgaben, weil man sich das Nachfragen sparen möchte. Und alle Beteiligten sind sicher, dass diese Einschätzung aus der Leistung entstanden ist. In vielen Fällen ist es umgekehrt. Dieser Artikel beschreibt, wie das passiert, woran man es erkennt und was der einzige Hebel ist, der dagegen nachweislich funktioniert.
Dienstag, 14:10 Uhr, Übergabe im Housekeeping
Die Hausdame verteilt die Etagen. Zwei Mitarbeiterinnen bekommen die Belegung mit den Abreisen und den beiden Suiten. Eine dritte bekommt die Etage mit den Bleibern.
Das ist nicht böse gemeint. Es ist praktisch. Bei den Suiten kommt es auf jedes Detail an, und bei dieser dritten Kollegin war vor einigen Monaten einmal etwas nicht in Ordnung.
Sechs Wochen später fällt in einem Gespräch der Satz: „Die kann halt keine Suiten.“
Was in diesen sechs Wochen tatsächlich passiert ist: Die Kollegin hat keine Suite mehr gemacht. Sie konnte also weder besser noch schlechter werden. Der Satz beschreibt keine Fähigkeit. Er beschreibt eine Aufgabenverteilung.
Und genau das ist der Golem-Effekt: Eine Erwartung erzeugt die Bedingungen, unter denen sie sich bestätigt. Niemand muss dafür jemanden schlecht behandeln. Es genügt, ihn anders zu behandeln.
Woher der Name kommt
Der Begriff stammt von Elisha Babad, Jacinto Inbar und Robert Rosenthal, die ihn 1982 im Journal of Educational Psychology einführten. Sie brauchten ein Wort für die dunkle Seite eines damals schon bekannten Phänomens: Wenn hohe Erwartungen die Leistung heben, was machen dann niedrige?
Der Name geht auf die Prager Sage vom Golem zurück, einer aus Lehm geformten Gestalt, die zum Schutz der jüdischen Gemeinde geschaffen wurde und am Ende unkontrollierbar wurde und Schaden anrichtete. Das Bild ist gut gewählt, weil es die Richtung des Problems trifft: Der Schaden entsteht nicht aus böser Absicht, sondern aus etwas, das man selbst in Gang gesetzt und dann nicht mehr im Blick hat.
Die freundliche Seite desselben Mechanismus ist bekannter. Robert Rosenthal und Lenore Jacobson veröffentlichten 1968 unter dem Titel „Pygmalion in the Classroom“ die Untersuchung, aus der die ganze Forschungslinie hervorging: Lehrkräften wurde mitgeteilt, bei bestimmten Kindern sei ein Entwicklungsschub zu erwarten. Die Kinder waren zufällig ausgewählt. Am Ende des Jahres unterschieden sie sich messbar von den übrigen.
Wie eine Erwartung überhaupt übertragen wird
Der interessanteste Teil der Forschung ist nicht, dass es den Effekt gibt, sondern wie er wandert. Denn niemand sagt einer Mitarbeiterin, dass man wenig von ihr hält.
Rosenthal hat dafür 1973 ein Modell mit vier Übertragungswegen beschrieben. Es stammt aus dem Unterrichtskontext und lässt sich fast eins zu eins auf den Hausalltag übertragen.
→ Klima. Der nonverbale Teil: Blickkontakt, Zuwendung, Nähe, Tonfall, wie lange jemand stehen bleibt. Im Hotel: Wer wird beim Vorbeigehen angesprochen und wer nur gegrüßt?
→ Rückmeldung. Der sprachliche Teil: Wie ausführlich, wie ermutigend, wie differenziert wird auf eine Leistung reagiert. Im Hotel: Wer bekommt zwei Sätze zur Arbeit und wer nur ein Nicken?
→ Aufgaben. Wie viel und wie Anspruchsvolles jemand überhaupt zu tun bekommt. Im Hotel: die Etagenverteilung, die Schichtbesetzung, wer beim Tagungsgeschäft mitläuft.
→ Gelegenheit. Wie oft und wie lange jemand die Möglichkeit bekommt, sich zu zeigen. Im Hotel: Wer wird in der Runde gefragt, wer darf die Übergabe leiten, wer bekommt den schwierigen Gast?
Drei dieser vier Wege sind ausdrücklich keine Frage der Freundlichkeit. Man kann eine Mitarbeiterin ausgesprochen nett behandeln und ihr trotzdem drei Jahre lang keine einzige Gelegenheit geben, an einer schwierigen Aufgabe zu wachsen.
Das ist der Grund, warum der Effekt so schwer zu bemerken ist. Er läuft über die Aufgabenverteilung, und die begründet sich immer selbst: Man gibt die Suite der Person, die Suiten kann.
Was in ganz gewöhnlichen Arbeitsgruppen messbar ist
Die meisten bekannten Studien zu diesem Thema stammen aus Schulen oder aus dem Militär. Für Betriebe ist eine neuere Arbeit aufschlussreicher, weil sie ohne jede Manipulation auskommt und in normalen Unternehmen erhoben wurde.
Thomas Sy und Alicia Leung haben 2018 in Frontiers in Psychology 101 Arbeitsgruppen untersucht: 101 Führungskräfte und 202 direkt unterstellte Mitarbeitende aus unterschiedlichen Branchen, darunter Vertrieb, Unterhaltung und Gesundheitswesen.
Erhoben wurde, welches Bild die Beteiligten vom typischen Mitglied ihrer Gruppe haben. Nicht von einer bestimmten Person, sondern vom Durchschnitt. Also die Frage: Was für Leute sind das hier eigentlich?
Das Ergebnis ist deutlich. Ein negativ getöntes Bild vom typischen Gruppenmitglied hing mit geringerer Selbstwirksamkeit der Mitarbeitenden zusammen (b = −0,27), diese wiederum mit weniger Anstrengung, und die mit schlechterer, von den Führungskräften beurteilter Leistung. Der indirekte Gesamteffekt auf die Leistung war statistisch bedeutsam.
Bemerkenswert daran ist, dass hier niemand jemandem etwas gesagt hat. Es gab keinen gefälschten Test und keine eingepflanzte Erwartung. Es genügte das vorhandene Bild von der Gruppe.
Zur Redlichkeit gehört: Das ist eine Querschnittserhebung mit Selbstauskünften zu Selbstwirksamkeit und Anstrengung. Sie zeigt Zusammenhänge, keine Ursachen, und die Wirkungsrichtung ist aus diesen Daten allein nicht zu beweisen.
Das Feldexperiment, das den Hebel zeigt
Für die Wirkungsrichtung braucht es Experimente, und davon gibt es zu diesem Thema erstaunlich wenige. Der Grund ist ethischer Natur, und wir kommen gleich darauf zurück.
Eine der wichtigsten Arbeiten stammt von Ofra Davidson und Dov Eden, veröffentlicht 2000 im Journal of Applied Psychology. Zwei Feldexperimente mit israelischen Soldatinnen in einer Förderausbildung: im ersten 360 Frauen in 30 Gruppen mit 38 Ausbildenden, im zweiten 225 Frauen in 20 Gruppen, davon 170 aus einem Programm für Jugendliche in schwierigen Lebenslagen.
Ein Teil der Ausbildenden bekam die Auskunft, ihre Gruppe habe nach einer statistischen Auswertung ein überdurchschnittliches Potenzial. Die Zuordnung war in Wirklichkeit zufällig. Verändert wurde also ausschließlich das, was die Ausbildenden über ihre eigene Gruppe glaubten.
Die Leistungsunterschiede waren erheblich. Die Autoren drücken sie über eine standardisierte Darstellung aus, den sogenannten Binomial Effect Size Display, und kommen dabei auf 79 gegenüber 21 Prozent im ersten und 82 gegenüber 17 Prozent im zweiten Experiment.
Diese Zahlen werden häufig als tatsächliche Bestehensquoten wiedergegeben. Das sind sie nicht. Der Binomial Effect Size Display ist eine Übersetzung einer Effektstärke in ein anschauliches Erfolgsquoten-Bild, kein direkt beobachteter Anteil. Die Größenordnung des Effekts ist damit eindrücklich belegt – die konkrete Prozentzahl sollte man aber nicht als gemessene Quote weitergeben.
Der eigentliche Hebel: eine andere Information, nicht ein anderer Mensch
Die praktisch wichtigste Arbeit ist eine ältere. Shoshana Oz und Dov Eden haben 1994 im Journal of Applied Psychology eine Untersuchung mit militärischen Ausbildern veröffentlicht, in der es nicht darum ging, eine hohe Erwartung zu erzeugen, sondern eine niedrige zu entschärfen.
Ein Teil der Ausbilder bekam vermittelt, dass ein niedriger Wert im Eingangstest nicht als Beleg für mangelnde Eignung zu lesen sei. Es blieben dieselben Rekruten mit denselben Testwerten. Verändert wurde nur die Deutung des Wertes.
Das ist der Kern der ganzen Sache und für Betriebe die brauchbarste Erkenntnis dieses Artikels. Der Hebel liegt nicht bei der Person, die schlecht bewertet wurde. Er liegt bei der Information, mit der die Führungskraft in die Situation geht.
Übersetzt auf den Hausalltag heißt das: Ein Fehler in der Probezeit ist ein Datenpunkt und keine Eigenschaft. Wer ihn als Datenpunkt behandelt, gibt die nächste Suite trotzdem. Wer ihn als Eigenschaft behandelt, gibt sie nicht mehr – und bekommt am Ende recht, ohne je etwas geprüft zu haben.
Warum es zu diesem Thema so wenig Experimente gibt
Ein Punkt, der in Führungsseminaren fast immer unter den Tisch fällt und für die Einordnung wichtig ist: Der Golem-Effekt ist deutlich schlechter untersucht als sein freundliches Gegenstück.
Der Grund liegt auf der Hand. Um ihn sauber experimentell zu erzeugen, müsste man Führungskräften absichtlich eine schlechte Meinung über bestimmte Menschen einpflanzen und diese Menschen dann den Folgen aussetzen. Das ist forschungsethisch nicht vertretbar.
Deshalb stützt sich vieles auf zwei Umwege: auf korrelative Befunde wie den von Sy und Leung und auf Studien, die den umgekehrten Weg gehen und eine bereits vorhandene niedrige Erwartung entschärfen, wie bei Oz und Eden.
Was daraus folgt, ist keine Entwarnung, sondern eine angemessene Formulierung. Die Wirkungsrichtung ist plausibel und in Teilen experimentell gestützt, die Größenordnung im Einzelfall ist es nicht. Wer den Golem-Effekt mit einer präzisen Prozentzahl für den eigenen Betrieb verkauft, geht über die Datenlage hinaus.
Für die Praxis ändert das wenig. Die empfohlene Maßnahme – Aufgaben und Gelegenheiten nicht dauerhaft nach einem alten Eindruck zu verteilen – ist auch dann richtig, wenn der Effekt kleiner ausfällt als in den Feldexperimenten.
Sechs Stellen im Haus, an denen der Effekt entsteht
→ Die Etagen- und Revierverteilung im Housekeeping. Wer bekommt Abreisen und Suiten, wer die Bleiber? Diese Entscheidung fällt täglich und wird nie protokolliert.
→ Die Schichtbesetzung an starken Tagen. Wer steht am Samstagabend am Empfang, wenn die Hochzeitsgesellschaft anreist? Die Antwort entscheidet, wer in einem Jahr Routine darin hat.
→ Das Tagungsgeschäft. Wer läuft bei der Firmenveranstaltung mit und wer bleibt im Tagesgeschäft? Hier entsteht der größte Erfahrungsunterschied im ganzen Haus.
→ Die Reihenfolge in der Übergabe. Wer wird gefragt und wer bekommt nur mitgeteilt?
→ Die Reaktion auf einen Fehler. Zwei Menschen machen denselben Fehler. Beim einen heißt es „Das kann passieren“, beim anderen „Ich schaue da nochmal genauer hin“. Ab da laufen zwei verschiedene Geschichten.
→ Die Sätze über Abwesende. „Bei ihr muss man nochmal drüberschauen“ ist der Satz, mit dem eine Einschätzung an die nächste Führungskraft weitergereicht wird – und die prüft sie nie, sie übernimmt sie.
Warum die ersten vier Wochen so schwer wiegen
Der Effekt entsteht selten dort, wo jemand seit Jahren arbeitet. Er entsteht in der Einarbeitung, und zwar aus einem einfachen Grund: In dieser Zeit gibt es noch keine andere Information.
Wer im dritten Jahr einen Fehler macht, hat zweieinhalb Jahre Gegenbeweis. Wer ihn in der zweiten Woche macht, hat nichts. Der Fehler ist dann nicht ein Punkt in einer Reihe, er ist die Reihe.
Dazu kommt, dass in der Einarbeitung die Aufgabenverteilung besonders beweglich ist. Genau in der Phase, in der ein einzelner Eindruck am meisten wiegt, hat er auch die größte Wirkung auf das, was jemand als Nächstes zu tun bekommt.
Praktisch folgt daraus eine unbequeme Regel, die nichts kostet: In den ersten acht Wochen wird die Aufgabenverteilung nicht nach Eindruck angepasst. Wer eingeplant war, bleibt eingeplant, auch nach einem Fehler. Erst danach wird bewertet, und dann mit mehr als einem Datenpunkt.
Die Gegenausnahme, auf die man sich nicht verlassen sollte
Es gibt Menschen, die auf spürbare Unterschätzung nicht mit Rückzug reagieren, sondern mit zusätzlichem Ehrgeiz. Samir Nurmohamed hat dieses Muster 2020 im Academy of Management Journal unter dem Namen Underdog-Effekt untersucht.
Der Befund ist real und differenziert: Ob Unterschätzung anspornt oder lähmt, hängt von der Person und von der Situation ab. Es ist also keine allgemeine Gegenkraft, sondern eine Möglichkeit unter Bedingungen.
Für Führung heißt das: Man darf sich darauf nicht verlassen. „Ein bisschen Druck hat noch keinem geschadet“ ist keine Strategie, sondern eine Wette darauf, dass man die richtige Person vor sich hat. Und die Kosten trägt im Zweifel jemand anderes.
Fünf Werkzeuge, die im Alltag funktionieren
→ Die Verteilungsliste. Vier Wochen lang aufschreiben, wer welche anspruchsvolle Aufgabe bekommen hat. Nicht bewerten, nur zählen. Meistens ist die Verteilung schiefer, als allen bewusst war, und schon die Liste verändert die nächste Woche.
→ Datenpunkt statt Eigenschaft. Eine Sprachregel für Führungsrunden: Über Menschen wird in Ereignissen gesprochen, nicht in Eigenschaften. Nicht „Sie ist unzuverlässig“, sondern „Sie war zweimal zu spät, am 4. und am 11.“ Der zweite Satz lässt sich prüfen und widerlegen, der erste nicht.
→ Die zweite Gelegenheit mit Ansage. Wer nach einem Fehler dieselbe Aufgabe ein zweites Mal bekommt, und zwar ausdrücklich, erhält damit die Information, dass der Fehler ein Punkt war und keine Einordnung. Das ist die betriebliche Fassung dessen, was Oz und Eden gemacht haben.
→ Die Übergabe ohne Etikett. Wenn eine Führungskraft wechselt, wird über Menschen nur weitergegeben, was überprüfbar ist: Aufgaben, Stand, Vereinbarungen. Keine Charakterhinweise. Das ist unbequem und beendet die Vererbung alter Einschätzungen.
→ Die Rotationspflicht bei anspruchsvollen Aufgaben. Ein fester Anteil der guten Schichten und Aufgaben wird nach Plan verteilt und nicht nach Eignung. Nicht alle, aber ein verabredeter Anteil. Sonst entsteht die Eignung nur dort, wo sie schon vermutet wird.
Wie Sie erkennen, ob es Sie selbst betrifft
Selbsteinschätzung hilft hier nicht, weil der Effekt gerade darin besteht, dass die eigene Erwartung wie eine Beobachtung aussieht. Vier Fragen sind brauchbarer.
→ Bei wem in Ihrem Team schauen Sie öfter nach als bei anderen? Und wann haben Sie das zuletzt geprüft, statt es zu tun?
→ Wenn diese Person einen Fehler macht: Denken Sie „schon wieder“? Das Wort ist das verlässlichste Anzeichen, weil es eine Reihe unterstellt, die selten gezählt wurde.
→ Wann hat diese Person zuletzt eine Aufgabe bekommen, bei der sie sich hätte auszeichnen können? Nicht: keine Fehler machen. Auszeichnen.
→ Wenn Sie beschreiben, warum es bei ihr nicht passt: Nennen Sie Ereignisse mit Datum oder Eigenschaften? Wenn Ihnen keine drei Ereignisse einfallen, ist die Einschätzung dünner, als sie sich anfühlt.
Was in den ersten Wochen passiert
→ In den ersten zwei Wochen ändert sich nichts an der Leistung, nur an Ihrer Wahrnehmung. Sie sehen die Schieflage in der Verteilung, bevor irgendjemand sie spürt.
→ Nach etwa vier Wochen kommt der unangenehme Punkt: Die Person, die lange keine anspruchsvolle Aufgabe hatte, macht bei der ersten wieder Fehler. Das ist kein Beleg für die alte Einschätzung, sondern die erwartbare Folge fehlender Übung.
→ Wer hier zurückzieht, hat die Einschätzung bestätigt und den Versuch beendet. Wer die zweite und dritte Gelegenheit trotzdem gibt, sieht meist ab der dritten eine Veränderung.
→ Nach einem Quartal verändert sich die Sprache im Team. Aus „die kann keine Suiten“ wird „die macht jetzt auch Suiten“. Das ist der Punkt, an dem die alte Erwartung ihre Grundlage verloren hat.
Drei Einwände, die berechtigt sind
„Manche Leute können bestimmte Dinge wirklich nicht.“ Vollkommen richtig, und dieser Artikel behauptet nichts anderes. Der Punkt ist ein anderer: Man kann es erst wissen, wenn die Gelegenheit mehrfach da war. Eine Einschätzung nach einem einzigen Fall ist keine Feststellung, sondern eine Vermutung mit Folgen.
„Ich kann die Suite nicht zum Üben vergeben.“ Auch das stimmt, und deshalb ist die Empfehlung nicht, Qualitätsrisiken einzugehen. Sie lautet, die Übung zu organisieren: zu zweit, mit Vorlauf, an einem ruhigen Tag. Was nicht funktioniert, ist die Aufgabe dauerhaft nicht zu vergeben und die fehlende Übung später als fehlende Eignung zu lesen.
„Das ist doch Küchenpsychologie.“ Der Einwand trifft die populäre Fassung des Themas, nicht die Forschung. Er trifft allerdings jeden, der mit präzisen Prozentzahlen für den eigenen Betrieb argumentiert. Deshalb stehen die Einschränkungen in diesem Artikel ausdrücklich mit drin.
Vier Sätze, an denen Sie es im eigenen Haus hören
Der Effekt hat keine eigene Stimme, aber er hinterlässt sprachliche Spuren. Diese vier Satztypen fallen in Übergaben, Teamrunden und Flurgesprächen und sind in der Praxis die verlässlichsten Anzeichen. Sie sind als Beobachtungshilfe gedacht und nicht als Untersuchungsergebnis.
→ Die Eigenschaftszuschreibung ohne Ereignis. „Die ist halt nicht so belastbar.“ Kein Datum, kein Vorfall, keine Aufgabe. Wenn auf die Nachfrage nach dem Woran nichts Konkretes kommt, war es nie eine Beobachtung, sondern immer schon eine Erwartung.
→ Die vorweggenommene Entlastung. „Das machen wir lieber selbst, das ist schneller.“ Stimmt oft für heute und ist über ein halbes Jahr die teuerste Entscheidung im Haus, weil sie die Person genau von dem fernhält, worin sie besser werden müsste.
→ Der Vergleich mit einer abwesenden Person. „Bei Frau K. hätte ich mir da keine Gedanken gemacht.“ Der Satz beschreibt nicht die Leistung der Anwesenden, sondern den Vertrauensvorschuss, den sie im Unterschied zu einer anderen nicht bekommt.
→ Die Bestätigung im Rückblick. „Ich hab es ja gleich gesagt.“ Der gefährlichste der vier, weil er sich wie Erfahrung anfühlt. In vielen Fällen beschreibt er nur, dass jemand seit Monaten keine Gelegenheit mehr hatte, die Aussage zu widerlegen.
Der praktische Wert liegt nicht darin, solche Sätze zu verbieten. Das funktioniert nicht und würde die Gespräche nur vorsichtiger machen, nicht ehrlicher. Der Wert liegt darin, sie zu hören und in derselben Runde nach dem Ereignis zu fragen, auf das sie sich stützen. Wer das ein halbes Jahr lang konsequent tut, verändert die Art, wie im Haus über Abwesende gesprochen wird, ohne ein einziges Mal jemanden zurechtweisen zu müssen.
Fazit
Der Golem-Effekt ist keine Frage von Sympathie und kein Zeichen schlechter Führung. Er entsteht aus lauter vernünftigen Einzelentscheidungen: Man gibt die schwierige Aufgabe der Person, von der man weiß, dass sie sie kann.
Teuer wird er, weil er sich selbst bestätigt. Wer keine Suiten mehr bekommt, wird darin nicht besser. Wer öfter kontrolliert wird, arbeitet angespannter. Und wer nie gefragt wird, sagt irgendwann auch nichts mehr, wenn er etwas wüsste.
Der Hebel liegt nach der überzeugendsten Untersuchung zu diesem Thema nicht bei der beurteilten Person, sondern bei der Information, mit der die Führungskraft in die Situation geht. Ein Fehler ist ein Datenpunkt. Vier Wochen ohne anspruchsvolle Aufgabe sind kein Eignungsbefund. Und die Frage, die alles in Bewegung bringt, passt in eine Zeile: Wann hatte diese Person zuletzt die Gelegenheit, mich zu überraschen?
Quellen und Anmerkungen
· Babad, E. Y., Inbar, J. & Rosenthal, R. (1982). Pygmalion, Galatea, and the Golem: Investigations of biased and unbiased teachers. Journal of Educational Psychology, 74(4), 459–474. — Einführung des Begriffs Golem-Effekt.
· Rosenthal, R. & Jacobson, L. (1968). Pygmalion in the Classroom. New York: Holt, Rinehart & Winston. — Ursprungsstudie der gesamten Forschungslinie.
· Rosenthal, R. (1973). Vier-Faktoren-Modell der Erwartungsübertragung (Klima, Rückmeldung, Aufgaben/Input, Gelegenheit/Output), veröffentlicht in Psychology Today. — Aus dem Unterrichtskontext; die Übertragung auf den Hotelalltag in diesem Artikel ist eine Analogie und kein Studienergebnis.
· Sy, T. & Leung, A. (2018). I Am as Incompetent as the Prototypical Group Member: An Investigation of Naturally Occurring Golem Effects in Work Groups. Frontiers in Psychology, 9, Artikel 1581. — 101 Arbeitsgruppen aus unterschiedlichen Branchen, 101 Führungskräfte und 202 Mitarbeitende. Negativ getöntes Bild vom typischen Gruppenmitglied und Selbstwirksamkeit b = −0,27; indirekter Effekt auf die Leistungsbeurteilung statistisch bedeutsam. Querschnittserhebung mit Selbstauskünften, daher Zusammenhänge und keine Ursachen.
· Davidson, O. B. & Eden, D. (2000). Remedial self-fulfilling prophecy: Two field experiments to prevent Golem effects among disadvantaged women. Journal of Applied Psychology, 85(3), 386–398. — Experiment 1: 360 Soldatinnen, 30 Gruppen, 38 Ausbildende; Experiment 2: 225 Soldatinnen, 20 Gruppen, davon 170 aus einem Programm für Jugendliche in schwierigen Lebenslagen. Die vielzitierten Werte 79 gegenüber 21 und 82 gegenüber 17 Prozent sind Binomial-Effect-Size-Display-Darstellungen der Effektstärke und keine beobachteten Bestehensquoten.
· Oz, S. & Eden, D. (1994). Restraining the Golem: Boosting performance by changing the interpretation of low scores. Journal of Applied Psychology, 79(5), 744–754. — Ausbildern wurde vermittelt, ein niedriger Eingangswert sei kein Beleg mangelnder Eignung. Verändert wurde ausschließlich die Deutung des Wertes.
· McNatt, D. B. (2000). Ancient Pygmalion joins contemporary management: A meta-analysis of the result. Journal of Applied Psychology, 85(2), 314–322. — Metaanalyse der Pygmalion-Feldexperimente im Arbeitskontext mit einem nach sozialwissenschaftlichen Maßstäben großen Gesamteffekt. Der genaue Effektstärkenwert konnte nur über Sekundärquellen eingesehen werden und wird deshalb in diesem Artikel bewusst nur der Größenordnung nach und nicht als exakte Zahl wiedergegeben.
· Nurmohamed, S. (2020). The Underdog Effect: When Low Expectations Increase Performance. Academy of Management Journal, 63(4). — Unterschätzung kann in Abhängigkeit von Person und Situation auch zu Mehrleistung führen; ausdrücklich keine verlässliche Gegenkraft und keine Führungsstrategie.
· Anmerkung zur Datenlage: Der Golem-Effekt ist deutlich schlechter experimentell untersucht als der Pygmalion-Effekt, weil das absichtliche Erzeugen niedriger Erwartungen forschungsethisch problematisch ist. Ein erheblicher Teil der Belege stammt daher aus korrelativen Untersuchungen oder aus Studien, die eine bereits vorhandene niedrige Erwartung entschärfen. Wirkungsrichtung und Größenordnung sind entsprechend unterschiedlich gut gesichert.
· Als Praxisableitung und nicht als Studienergebnis gekennzeichnet: die sechs Stellen im Hausalltag, die Acht-Wochen-Regel für die Einarbeitung, die fünf Werkzeuge einschließlich Verteilungsliste und Übergabe ohne Etikett, die vier Selbstfragen und der Verlauf über die ersten Wochen.