Zum Hauptinhalt springen

Dunning-Kruger-Effekt

Dienstagvormittag, 10 Uhr, Mitarbeitergespräch im Büro hinter der Rezeption. Auf dem Selbsteinschätzungsbogen steht eine einzige Frage: In welchem Viertel der Abteilung schätzen Sie Ihre eigene Leistung im Beschwerdemanagement ein? Der junge Mitarbeiter kreuzt ohne zu zögern „oberstes Viertel" an. Die Führungskraft legt daneben die Auswertung der letzten zwanzig Mystery-Guest-Bewertungen: unterstes Viertel der Abteilung.

Kein Zeichen von Unehrlichkeit, keine bewusste Übertreibung. Es ist ein Effekt, der seit über zwanzig Jahren einen eigenen Namen trägt: der Dunning-Kruger-Effekt – die Tendenz, gerade dort am meisten überzuschätzen, wo am wenigsten Kompetenz vorhanden ist, weil genau die fehlende Kompetenz auch die Fähigkeit einschränkt, die eigene Lücke überhaupt zu erkennen.

Der Ursprung: Humor, Grammatik, Logik – und ein blinder Fleck in doppelter Hinsicht

Der Effekt trägt seinen Namen seit einer Serie von Experimenten, die zu den meistzitierten der modernen Sozialpsychologie zählen. Justin Kruger und David Dunning ließen Studierende 1999 an drei unterschiedlichen Aufgaben teilnehmen: einem Humortest, dessen Antworten von professionellen Komikern bewertet wurden, einem Grammatiktest und einem Test zu logischem Schlussfolgern (Kruger & Dunning, 1999).

Nach jedem Test sollten die Teilnehmenden einschätzen, in welchem Perzentil ihrer Vergleichsgruppe sie tatsächlich abgeschnitten hatten. Im Logiktest schätzte sich das unterste Viertel im Schnitt auf rund das 62. Perzentil ein – tatsächlich lag es bei rund dem 12. Perzentil. Das oberste Viertel dagegen unterschätzte sich leicht: rund 68. Perzentil geschätzt gegenüber tatsächlich rund 86. Perzentil erreichtem Ergebnis (Kruger & Dunning, 1999).

Die Pointe der Studie liegt nicht allein in der Selbstüberschätzung der Schwächeren. Sie liegt darin, dass dieselben Fähigkeiten, die für eine gute Leistung nötig sind – Fachwissen, Urteilsvermögen, Erfahrung –, auch nötig sind, um die eigene Leistung überhaupt richtig einzuordnen. Wer wenig kann, dem fehlt doppelt: die Kompetenz selbst, und der Maßstab, um die fehlende Kompetenz zu erkennen.

Ist das wirklich ein eigenständiger Effekt? Der Blick auf die Kritik

Kaum ein sozialpsychologischer Befund wurde in den vergangenen Jahren so gründlich auf seine statistische Substanz hin geprüft wie dieser. Gilles Gignac und Marcin Zajenkowski zeigten 2020 an einer großen Stichprobe mit kontinuierlichen Fähigkeitsmaßen: Ein erheblicher Teil des typischen Kurvenverlaufs – starke Überschätzung unten, leichte Unterschätzung oben – lässt sich bereits allein durch zwei bekannte statistische Mechanismen erzeugen, unabhängig von einem echten „Kompetenz-blind-für-die-eigene-Inkompetenz"-Effekt: den allgemeinen Better-than-average-Effekt und die Regression zur Mitte bei einer verrauschten Selbsteinschätzungsmessung (Gignac & Zajenkowski, 2020).

Auch die häufig gezeigte Grafik mit den beiden sich kreuzenden Linien – gerade Selbsteinschätzung, nach oben gebogene tatsächliche Leistung – stammt in dieser plakativen Form nicht aus der Originalstudie von 1999, sondern ist eine spätere, deutlich zugespitzte Illustration, die in Vorträgen und Artikeln ein Eigenleben entwickelt hat. Die tatsächlichen Studiendaten zeigen ein unruhigeres, weniger dramatisches Bild als das inzwischen ikonische Diagramm suggeriert.

Ganz vom Tisch ist die Kritik allerdings nicht das letzte Wort. Rhona McIntosh und Kolleginnen der University of Edinburgh prüften 2019 gezielt, ob nach Herausrechnen der statistischen Artefakte noch etwas übrig bleibt – und kamen zu einem differenzierten Ergebnis: Ein Teil des Effekts lässt sich tatsächlich auf Regression zur Mitte zurückführen, ein anderer, kleinerer Teil deutet aber weiterhin auf eine echte, wenn auch bescheidenere metakognitive Lücke bei besonders schwachen Leistungsträgerinnen und -trägern hin (McIntosh, Fowler, Lyu & Della Sala, 2019).

Für die Führungspraxis heißt das: Der Dunning-Kruger-Effekt ist kein Naturgesetz, nach dem „die Unfähigen" grundsätzlich ahnungslos durchs Berufsleben gehen. Er ist ein statistisch teils erklärbares, teils aber real bestehendes Muster – am ehesten bei deutlich unterdurchschnittlicher Leistung in eng abgrenzbaren Kompetenzfeldern zu erwarten, nicht als allgemeines Etikett für „schwache Mitarbeitende" zu verwenden.

Das ist nicht dasselbe wie der Überkonfidenzeffekt

Beide Begriffe werden im Führungsalltag oft synonym verwendet, meinen aber unterschiedliche Muster. Der Überkonfidenzeffekt beschreibt eine über nahezu alle Kompetenzstufen hinweg verbreitete Tendenz, die eigene Genauigkeit zu überschätzen – das betrifft auch ausgewiesene Fachleute und erfahrene Führungskräfte, wie bereits im Artikel zum Überkonfidenzeffekt anhand von Kalibrierungsstudien gezeigt (Kruger & Dunning, 1999, dort zur ausdrücklichen Abgrenzung zitiert).

Der Dunning-Kruger-Effekt beschreibt dagegen ein spezifischeres, kompetenzabhängiges Muster: Die Größe der Selbstüberschätzung hängt systematisch vom tatsächlichen Leistungsniveau ab – am größten bei geringer Kompetenz, kaum vorhanden oder sogar umgekehrt bei hoher Kompetenz. Wer in einem Bereich tatsächlich sehr gut ist, unterschätzt sich in Studien eher leicht, oft weil er annimmt, eine für ihn einfache Aufgabe falle auch anderen leicht.

Für die Führungspraxis lohnt sich deshalb eine unterschiedliche Reaktion: Überkonfidenz bei erfahrenen Führungskräften lässt sich gut durch Kalibrierungsübungen und Pre-Mortem-Methoden abfangen. Eine ausgeprägte Selbstüberschätzung bei geringer tatsächlicher Kompetenz braucht dagegen zuerst eines: konkrete, objektive Vergleichsdaten, an denen sich die eigene Einschätzung überhaupt neu ausrichten kann.

Die gute Nachricht: Kompetenz lässt sich trainieren – und die Selbsteinschätzung mit ihr

Kruger und Dunning testeten in einer weiteren Erhebung, was mit der Selbsteinschätzung passiert, wenn schwache Leistungsträgerinnen und -träger tatsächlich in der jeweiligen Fähigkeit trainiert werden. Das Ergebnis: Mit steigender Kompetenz näherte sich auch die Selbsteinschätzung deutlich der tatsächlichen Leistung an (Kruger & Dunning, 1999).

Das ist die eigentlich praxisrelevante Erkenntnis. Der naheliegende Reflex – eine überzogene Selbsteinschätzung durch ein deutliches Feedbackgespräch zu korrigieren – wirkt oft nur kurzfristig, weil der fehlende Maßstab dieselbe Person auch beim nächsten Mal wieder betrifft. Wirksamer ist der Umweg über echten Kompetenzaufbau: Wer eine Fähigkeit tatsächlich erlernt, entwickelt dabei automatisch auch ein realistischeres Gespür für das eigene Können.

Was das für Führung im Gastgewerbe bedeutet

Erste Konsequenz: Beförderungs- und Einstellungsentscheidungen sollten sich nicht allein auf sicheres Auftreten in Gesprächen stützen. Eine große Metaanalyse von Frank Schmidt und John Hunter zu 85 Jahren Personalauswahlforschung zeigt: Unstrukturierte Interviews sagen die spätere Berufsleistung deutlich schwächer voraus (Validitätskoeffizient r = 0,38) als strukturierte Interviews mit festen Kriterien (r = 0,51) oder Arbeitsproben (r = 0,54) (Schmidt & Hunter, 1998). Wer überzeugend über die eigene Kompetenz spricht, ist damit nicht automatisch kompetent – und ein unstrukturiertes Gespräch ist genau das Format, in dem sicheres Auftreten am stärksten wirkt.

Zweite Konsequenz: Wird eine Selbstüberschätzung sichtbar, hilft selten die direkte Konfrontation mit der Formulierung „Sie überschätzen sich". Wirksamer sind konkrete, beobachtbare Vergleichsdaten – Mystery-Guest-Bewertungen, Checklisten-Erfüllungsquoten, Gästefeedback – nebeneinandergelegt mit der eigenen Einschätzung, gefolgt von einem klaren Kompetenzaufbau-Plan statt einer reinen Kritik ohne Anschlussmöglichkeit.

Dritte Konsequenz: Gerade neue oder wenig erfahrene Teammitglieder sollten nicht nach eigener Einschätzung ihrer „Einsatzbereitschaft" in anspruchsvollere Aufgaben wechseln, sondern anhand vorab festgelegter, objektiver Meilensteine – etwa eine bestimmte Anzahl selbstständig und fehlerfrei bearbeiteter Standardfälle, bevor eigenverantwortlich schwierigere Beschwerdefälle übernommen werden.

Die DEHOGA-Betriebsumfrage liefert dazu den wirtschaftlichen Rahmen: Mit einer Fluktuationsrate von 60 bis 70 Prozent liegt das Gastgewerbe weit über dem Bundesdurchschnitt von rund 33 Prozent. Wird jemand allein aufgrund selbstsicheren Auftretens zu früh in eine anspruchsvollere Rolle befördert und scheitert dort erkennbar, verstärkt das genau die Fluktuationsdynamik, die sich eine ohnehin fluktuationsstarke Branche am wenigsten leisten kann – durch Frustration auf beiden Seiten und eine erneut zu besetzende Stelle.

Ein Praxisbeispiel: Die Einarbeitungswoche an der Rezeption

Eine neue Rezeptionsmitarbeiterin fühlt sich nach der ersten Woche bereit, Nachtschichten allein zu übernehmen – sie hat die Abläufe im Tagesgeschäft souverän gemeistert und schätzt ihre Kompetenz entsprechend hoch ein. Was in der Selbsteinschätzung fehlt, ist die Erfahrung mit den seltenen, aber anspruchsvollen Ausnahmesituationen einer Nachtschicht ohne Unterstützung: ein technischer Ausfall, ein medizinischer Notfall, ein Konflikt zwischen Gästen.

Statt die Einschätzung der Mitarbeiterin infrage zu stellen, hilft ein objektiver Zwischenschritt: eine begleitete Nachtschicht mit klar dokumentierten Beobachtungspunkten, gefolgt von einem gemeinsamen Abgleich zwischen Selbsteinschätzung und beobachteten Situationen. So entsteht der fehlende Maßstab, ohne dass die Motivation der Mitarbeiterin durch pauschale Zurückhaltung ausgebremst wird.

Fünf-Fragen-Selbstcheck: Schätze ich mich hier realistisch ein?

1. In welchem Bereich meiner Arbeit habe ich zuletzt aktiv objektives Feedback eingeholt, statt mich allein auf mein eigenes Urteil zu verlassen?

2. Schätze ich meine Leistung in einem Bereich, in dem ich noch wenig Erfahrung habe, genauso sicher ein wie in einem Bereich mit langjähriger Praxis?

3. Wann habe ich zuletzt eine eigene Einschätzung mit einer objektiven Kennzahl statt mit dem eigenen Gefühl abgeglichen?

4. Wie reagiere ich, wenn eine Rückmeldung deutlich schlechter ausfällt als von mir erwartet – mit Nachfragen oder mit Abwehr?

5. Traue ich mich, in einem Bereich um Unterstützung zu bitten, in dem ich eigentlich schon kompetent sein „sollte"?

Die Führungskraft aus der Eingangsszene entscheidet sich gegen eine Konfrontation und für einen gemeinsamen Termin: Sie legt die Mystery-Guest-Auswertung neben die Selbsteinschätzung, ohne die Zahl zu kommentieren, und fragt stattdessen: „Welche drei konkreten Situationen der letzten Wochen fallen dir dazu ein?" Aus dem Gespräch entsteht ein Drei-Wochen-Plan mit klar beobachtbaren Zwischenzielen. Bei der nächsten Auswertung liegen Selbsteinschätzung und Mystery-Guest-Ergebnis deutlich näher beieinander – nicht weil die Mitarbeiterin überzeugt wurde, sondern weil sie inzwischen tatsächlich mehr kann.

Quellen

– Kruger, J. & Dunning, D. (1999). Unskilled and Unaware of It: How Difficulties in Recognizing One's Own Incompetence Lead to Inflated Self-Assessments. Journal of Personality and Social Psychology, 77(6), 1121–1134.

– Gignac, G. E. & Zajenkowski, M. (2020). The Dunning-Kruger Effect Is (Mostly) a Statistical Artefact: Valid Approaches to Testing the Hypothesis With Individual Differences Data. Intelligence, 80, 101449.

– McIntosh, R. D., Fowler, E. A., Lyu, T. & Della Sala, S. (2019). Wise Up: Clarifying the Role of Metacognition in the Dunning-Kruger Effect. Journal of Experimental Psychology: General.

– Schmidt, F. L. & Hunter, J. E. (1998). The Validity and Utility of Selection Methods in Personnel Psychology: Practical and Theoretical Implications of 85 Years of Research Findings. Psychological Bulletin, 124(2), 262–274.

– DEHOGA-Betriebsumfrage (Fluktuationsrate Gastgewerbe 60–70 % vs. 33 % Bundesdurchschnitt, Basisquelle).

Hinweis: Die in Sekundärquellen kursierenden Perzentilwerte zur Logiktest-Studie von Kruger & Dunning (1999) schwanken je nach Quelle leicht; hier verwendet: die am häufigsten zitierte Näherung (rund 62./12. Perzentil unteres Viertel, rund 68./86. Perzentil oberes Viertel), gerundet wiedergegeben. Zu McIntosh, Fowler, Lyu & Della Sala (2019) konnte die genaue Band- und Seitenangabe im Rahmen dieser Recherche nicht abschließend verifiziert werden; Journal und Kernaussage sind gesichert. Die Kritik von Gignac & Zajenkowski (2020) wird bewusst zusammen mit der differenzierenden Gegenposition von McIntosh et al. (2019) dargestellt, um den Dunning-Kruger-Effekt weder als reines Artefakt noch als unumstrittenes Naturgesetz erscheinen zu lassen.