Das Journal29. August 20267 Min. Lesezeit
54 Prozent — kaum besser als der Zufall
Blickkontakt, Mikroexpressionen, Polygraph: was davon trägt
Auf die offene Frage „Woran merken Sie, dass jemand lügt?“ antworten Menschen in 75 Ländern und 43 Sprachen zuerst dasselbe: Er schaut weg. Ein Forschungsverbund, der unter dem Namen Global Deception Research Team veröffentlichte, legte diese Frage 2006 weltweit vor und fand quer durch alle Stichproben einen einzigen beherrschenden Stereotyp — den abgewandten Blick. Es dürfte die meistgeteilte Überzeugung über Lügen sein, die es gibt.
Bella DePaulo und Kollegen hatten drei Jahre zuvor zusammengetragen, was Verhalten überhaupt über Täuschung verrät: 1.338 Einzelschätzungen zu 158 Verhaltensmerkmalen. Das Ergebnis ist eine Enttäuschung mit Struktur. Viele der geprüften Merkmale hingen gar nicht oder nur schwach mit Täuschung zusammen. Was sich zeigte, war schmal und indirekt. Lügende geben weniger preis, ihre Erzählungen sind weniger zwingend und enthalten seltener die gewöhnlichen Unebenheiten und ungewöhnlichen Einzelheiten, die echte Schilderungen auszeichnen; sie hinterlassen einen negativeren Eindruck und wirken angespannter. Deutlicher werden diese Spuren, wenn viel auf dem Spiel steht — besonders, wenn es um das eigene Ansehen geht — und wenn die Lüge eine Verfehlung verdeckt. Ein verräterisches Einzelsignal ist nicht darunter, der abgewandte Blick schon gar nicht.
Was 54 Prozent bedeuten
Die Metaanalyse von Charles Bond und Bella DePaulo fasste 206 Arbeiten mit Urteilen von 24.483 Beurteilenden zusammen. Ihre Zusammenfassung nennt beides in einem Satz — die Quote und ihre Schieflage:
people achieve an average of 54% correct lie-truth judgments, correctly classifying 47% of lies as deceptive and 61% of truths as nondeceptive
Timothy Levine hat daraus eine Theorie gemacht: Der Normalzustand zwischenmenschlicher Kommunikation ist die Wahrheitsannahme. Man glaubt zunächst, und dieser Voreinstellung verdankt sich, dass Gespräche überhaupt funktionieren. Sie ist kein Denkfehler, sondern eine gut kalibrierte Wette — die meisten Aussagen der meisten Menschen sind zutreffend. Der Preis dafür ist eine systematische Blindstelle: Lügen fallen im Mittel seltener auf als Wahrheiten bestätigt werden.
Warum es keine guten Lügenerkenner gibt
Die naheliegende Hoffnung lautet, dass es wenigstens Einzelne gibt, die es können. Bond und DePaulo haben auch das geprüft, an 247 Stichproben, in denen Menschen Fremde in Echtzeit und ohne Hilfsmittel beurteilten. Nach Korrektur für Messfehler bleibt von den Unterschieden zwischen den Urteilenden fast nichts übrig: Die Streuung der Fähigkeit liegt unter einem Prozentpunkt, und die besten Beurteilenden sind nicht treffsicherer, als ein Zufallsmechanismus es hervorbrächte. Deutlich variieren die Menschen dagegen darin, wie leichtgläubig sie sind — und wie glaubwürdig sie wirken. Der Ausgang eines Glaubwürdigkeitsurteils hängt stärker von der Person ab, die spricht, als von der Person, die zuhört.
Damit steht auch die berufliche Erfahrung in einem anderen Licht. Christian Meissner und Saul Kassin trennten in der Vernehmungsforschung zwei Größen, die umgangssprachlich verschmelzen: die Fähigkeit zu unterscheiden und die Neigung, sich in eine Richtung zu entscheiden. Weder Training noch Berufserfahrung verbesserten die Unterscheidung. Beide verschoben aber die Neigung — geschulte und erfahrene Ermittler antworteten häufiger „Täuschung“. Sie werden nicht genauer, sondern misstrauischer und sicherer.
Kein Muskel kennt die Wahrheit — auch nicht die Nervosität
Mikroexpressionen sind sehr kurze Gesichtsausdrücke. Als Erkennungsmittel ist ihre Beleglage dünn. Stephen Porter und Leanne ten Brinke fanden sie in rund zwei Prozent aller untersuchten Ausdrücke und bei etwa einem Fünftel der Teilnehmenden — und wo sie auftraten, trennten sie wahre nicht von falschen Aussagen. Dass Emotionen manchmal unterdrückte Spuren hinterlassen, macht daraus keinen universellen Lügendetektor.
Das Grundproblem ist keines der Messgenauigkeit, sondern der Zuordnung. Eine Person kann Angst zeigen, weil sie lügt, weil sie nicht geglaubt wird oder weil viel auf dem Spiel steht. Derselbe Ausdruck hat mehrere Ursachen, und keine Kamera entscheidet, welche vorliegt.
| Verfahren | Was es misst | Was es leistet |
|---|---|---|
| Mensch, unbewaffnet | Eindruck | 54 % richtig — 61 % der Wahrheiten, 47 % der Lügen |
| Geschulte Fachleute | Eindruck plus Erwartung | nicht treffsicherer, aber häufiger Lüge unterstellend |
| Polygraph | körperliche Erregung | keine Täuschung; für Reihenuntersuchungen ungeeignet |
| Test des Tatwissens | Wiedererkennen von Einzelheiten | prüfbar — fragt nach Wissen statt nach Lüge |
| Kognitive Gesprächsführung | Belastung beim Erzählen | Anspruch bestritten; der Streit ist offen |
Was der Polygraph misst
Der Polygraph verschärft das Problem technisch. Er zeichnet Atmung, Puls, Blutdruck und Hautleitfähigkeit auf. Diese Größen reagieren auf Erregung und Aufmerksamkeit, nicht spezifisch auf Täuschung. Kontrollfragen, Erwartungen und Gegenmaßnahmen beeinflussen das Ergebnis. Der Bericht des National Research Council von 2003 wertete 57 Studien aus und kam zu einem doppelten Ergebnis: Bei Tests zu einem konkreten Vorfall trennt das Verfahren Lüge und Wahrheit deutlich über dem Zufall, aber deutlich unter Perfektion; für Sicherheits-Screenings hielt das Gremium die Evidenz dagegen für unzureichend. Bei seltenen Tätern produziert selbst ein scheinbar guter Test viele falsche Verdächtigungen — man müsste Hunderte loyale Beschäftigte verdächtigen, um einen echten Fall zu treffen.
Es gibt eine Variante, die eine andere Frage stellt, und sie schneidet besser ab. Der Tatwissenstest legt keine Schuldfrage vor, sondern Einzelheiten: Unter mehreren gleich plausiblen Angaben zum Tatort ist eine die richtige. Wer sie nicht kennt, reagiert auf alle gleich; wer sie kennt, reagiert auf eine anders. Gershon Ben-Shakhar und Eitan Elaad werteten 169 Bedingungen aus 80 Laborstudien aus und fanden über die Hautleitfähigkeit eine mittlere Effektstärke von 1,55; in nachgestellten Tatszenarien 2,09, und in den zehn Studien, die realen Anwendungsbedingungen am nächsten kamen, 3,12. Der Haken liegt nicht in der Statistik, sondern in den Voraussetzungen: Es müssen nicht öffentliche Tatdetails existieren, sie dürfen nicht durch Presse oder Vernehmung durchgesickert sein, und die Befunde stammen fast durchweg aus dem Labor. Der Test misst Wiedererkennen, nicht Lügen — er kann Wissen nachweisen, nicht Schuld.
Auch Bildgebung und „KI-Lügendetektoren“ ändern die logische Lücke nicht. Ein Algorithmus kann Muster in Trainingsdaten lernen. Ohne eindeutige Verbindung zwischen Muster und Lüge lernt er womöglich Kamera, Sprache, Stress oder soziale Gruppenmerkmale.
Der Streit um das bessere Gespräch
Wenn das Verhalten wenig hergibt, bleibt die Frage, ob man mehr Verhalten erzeugen kann. Der kognitive Ansatz versucht das: Er erhöht die geistige Anforderung, ohne zu bedrohen — unerwartete Reihenfolge, räumliche Details, Skizzen, offene Nachfragen. Die Idee ist plausibel, weil Lügen mehr Arbeit macht als Erinnern. Ob sie trägt, ist eine der offeneren Fragen des Fachs.
Aldert Vrij, Ronald Fisher und Hartmut Blank berichteten aus 14 Studien mit direktem Vergleich eine deutliche Überlegenheit: 71 Prozent Gesamttrefferquote gegenüber 56 Prozent, bei Lügen 67 gegenüber 47 Prozent. Timothy Levine und Kollegen widersprachen dieser Auswertung im selben Fachblatt. Erik Mac Giolla und Timothy Luke rechneten erneut und kamen auf 60 Prozent roh, nach Korrektur für Publikationsverzerrung noch 55 Prozent; wo dieselbe Studie beide Bedingungen gegenüberstellte, unterschieden sich kognitives und übliches Interview praktisch nicht — 54,24 gegenüber 54,06 Prozent. Der Streit ist nicht entschieden, aber er zeigt, wie schmal der Spielraum ist, um den gestritten wird.
Was in jeder Variante hilft, ist unspektakulär: Entscheidend ist nicht, ob jemand „verdächtig wirkt“, sondern ob Angaben untereinander und mit unabhängigen Belegen zusammenpassen. Widersprüche sind Prüfaufträge, keine Schuldbeweise; auch ehrliche Erinnerung ist lückenhaft.
Angst ist kein Eigentum der Lüge. Eine ehrliche Person kann nervös sein, weil viel auf dem Spiel steht, sie Autorität fürchtet oder traumatische Erfahrungen aktiviert werden. Umgekehrt kann eine geübte täuschende Person ruhig wirken. Auch kulturelle Regeln beeinflussen Blickkontakt, Pausen und Ausdruck. Wer solche Signale moralisch deutet, riskiert eine Rückkopplung: Verdacht erzeugt Druck, Druck erzeugt Nervosität, und Nervosität bestätigt den Verdacht. Am Ende hat die Vernehmung genau das Verhalten hergestellt, das anschließend als Beweis gilt.
Was bleibt
Von den drei Kandidaten des Untertitels trägt keiner so, wie er beworben wird. Der Blickkontakt ist ein weltweit geglaubtes Vorurteil ohne Befund. Mikroexpressionen sind selten und trennen nicht. Der Polygraph trennt bei einer konkreten Tatfrage besser als der Zufall, taugt aber nicht zum Durchleuchten ganzer Belegschaften; die eine physiologische Methode mit ordentlichen Zahlen, der Tatwissenstest, beantwortet gar nicht die Schuldfrage, sondern die Wissensfrage — und braucht dafür Tatdetails, die niemand ausgeplaudert hat.
Woran man es im Alltag erkennt: an der Richtung, in die geprüft wird. Wer eine Person liest, sammelt Eindrücke, die sich nicht widerlegen lassen, und wird dabei immer sicherer. Wer eine Aussage prüft, sammelt Angaben, die außerhalb des Gesprächs wahr oder falsch sein können, und bleibt so lange unsicher, bis er sie nachgesehen hat. Die zweite Haltung fühlt sich schlechter an und liefert mehr. Die Sicherheit, die aus dem Gesicht des Gegenübers kommt, ist fast immer die eigene Erwartung, die zurückschaut.
Quellen und warum sie hier stehen
Bond, C. F., Jr., & DePaulo, B. M. (2006). Accuracy of deception judgments. Personality and Social Psychology Review, 10, 214–234.
Die Zahl, um die alles kreist, und die Fundstelle des Zitats: 206 Arbeiten, 24.483 Beurteilende, 54 Prozent — und die Schieflage zwischen Wahrheiten und Lügen.
Bond, C. F., Jr., & DePaulo, B. M. (2008). Individual differences in judging deception: Accuracy and bias. Psychological Bulletin, 134(4), 477–492.
Die Antwort auf die naheliegende Hoffnung, es gebe wenigstens einzelne gute Erkenner: Die Unterschiede zwischen Beurteilenden sind winzig.
DePaulo, B. M., Lindsay, J. J., Malone, B. E., Muhlenbruck, L., Charlton, K., & Cooper, H. (2003). Cues to deception. Psychological Bulletin, 129(1), 74–118.
Die Durchsicht der angeblichen Verräter — Blick, Zappeln, Stimme. Kein einziger trägt, und das ist der Grund, warum die Trefferquote so niedrig bleibt.
The Global Deception Research Team (2006). A world of lies. Journal of Cross-Cultural Psychology, 37(1), 60–74.
Dieselbe falsche Überzeugung in 58 Ländern: Der Blick werde abgewendet. Ein weltweiter Aberglaube ist keine Kulturfrage, sondern eine über das Urteilen.
Levine, T. R. (2014). Truth-default theory. Journal of Language and Social Psychology, 33, 378–392.
Die Erklärung, die aus der Schieflage eine Theorie macht: Wahrheitsannahme als Voreinstellung — kein Denkfehler, sondern eine gut kalibrierte Wette.
Meissner, C. A., & Kassin, S. M. (2002). „He's guilty!“: Investigator bias in judgments of truth and deception. Law and Human Behavior, 26(5), 469–480.
Was Ausbildung und Erfahrung tatsächlich verändern: nicht die Treffsicherheit, sondern die Neigung, Lüge zu unterstellen — und die Sicherheit im eigenen Urteil.
National Research Council (2003). The Polygraph and Lie Detection. National Academies Press.
Die maßgebliche Prüfung des Polygraphen: Er misst Erregung, nicht Täuschung — und taugt für Reihenuntersuchungen nachweislich nicht.
Ben-Shakhar, G., & Elaad, E. (2003). The validity of psychophysiological detection of information with the Guilty Knowledge Test: A meta-analytic review. Journal of Applied Psychology, 88(1), 131–151.
Das Verfahren, das im Unterschied zum klassischen Polygraphen etwas Prüfbares fragt: nicht ob jemand lügt, sondern ob er Tatwissen hat.
Vrij, A. (2008). Detecting Lies and Deceit: Pitfalls and Opportunities. Wiley.
Die Gesamtdarstellung des Feldes durch einen seiner Hauptvertreter — nötig, weil der Artikel dessen Programm anschließend bestritten wiedergibt.
Vrij, A., Fisher, R. P., & Blank, H. (2017). A cognitive approach to lie detection: A meta-analysis. Legal and Criminological Psychology, 22(1), 1–21.
Der Anspruch, mit besserer Gesprächsführung deutlich über 54 Prozent zu kommen.
Levine, T. R., Blair, J. P., & Carpenter, C. J. (2018). A critical look at meta-analytic evidence for the cognitive approach to lie detection. Legal and Criminological Psychology, 23(1), 7–19.
Die Gegenrechnung an denselben Daten. Der Streit läuft über Einschlusskriterien, nicht über Messwerte — und ist nicht entschieden.
Mac Giolla, E., & Luke, T. J. (2021). Does the cognitive approach to lie detection improve the accuracy of human observers? Applied Cognitive Psychology, 35, 385–392.
Prüft die Frage noch einmal getrennt für menschliche Beurteilende — die Lage, um die es im Vernehmungszimmer tatsächlich geht.
Porter, S., & ten Brinke, L. (2008). Reading between the lies. Psychological Science, 19, 508–514.
Der Befund zu den flüchtigen Gesichtsregungen: Sie kommen vor, aber nicht so, wie die Schulungsindustrie sie verkauft.