Zum Inhalt springen
unterHUNDs – Hundeschule und Verhaltenstherapie im Saarland Initiative für gewaltfreies Hundetraining

Hunderatgeber · Verhaltensbiologie beim Hund · Wissenschaft und Hundewissen

Der Clever-Hans-Effekt beim Hund: Wie unbewusste Signale Verhalten, Training und Forschung beeinflussen

Reagiert dein Hund auf das Wort oder auf deinen Körper? Was Studien zum Clever-Hans-Effekt, zum Schuldblick und zu Spürhunden zeigen und wie du es sauber prüfst.

Michael Sauerwein · 23. September 2024

Hund sitzt vor zwei Schalen und beobachtet aufmerksam eine Person während einer Wahlaufgabe.

Vor mehr als hundert Jahren schien ein Pferd Rechenaufgaben zu lösen, indem es mit dem Huf klopfte, bis ein Psychologe zeigte, dass es winzige, unbeabsichtigte Bewegungen der fragenden Menschen las. Hunde leben noch enger mit Menschen zusammen als Pferde und reagieren sehr fein auf Gesten, Blicke und Aufmerksamkeit. Daraus ergibt sich eine praktische Frage für alle, die trainieren, Hunde halten oder forschen: Wenn ein Hund etwas richtig macht, reagiert er auf die Aufgabe oder auf uns?

Dieser Beitrag erklärt, was der ursprüngliche Fall des Klugen Hans tatsächlich gezeigt hat, wie sich der Effekt von absichtlichen Hilfen unterscheidet, was Experimente zu Überzeugungen von Haltern, sozialem Einfluss und dem „Schuldblick“ ergeben haben, warum die Spürhundeforschung die Erwartungen der Hundeführer als wichtige Fehlerquelle behandelt, wie Gesten im Training mit Wörtern konkurrieren und wie Blindtests, Automatisierung und Studien an mehreren Standorten Ergebnisse vor unbeabsichtigten Hilfen schützen.

1. Der Kluge Hans: der ursprüngliche Fall

1.1 Ein Pferd, das zu rechnen schien

Zu Beginn des 20. Jahrhunderts erregte ein Pferd namens Hans große öffentliche Aufmerksamkeit. Sein Besitzer, Herr von Osten, präsentierte ihn als Tier, das Rechenaufgaben beantworten konnte, indem es die richtige Zahl mit dem Huf klopfte, und viele Beobachter waren überzeugt. Der Psychologe Pfungst untersuchte den Fall systematisch; sein Bericht liegt seit 1911 auch in englischer Übersetzung vor (Pfungst, 1911).

Pfungst behandelte die Leistung als Phänomen, das erklärt werden musste, und entwarf Experimente, um herauszufinden, welche Information Hans tatsächlich nutzte. Deshalb ist der Fall bis heute wichtig: Er zeigte, wie man das scheinbare Aufgabenverständnis eines Tieres von seiner Empfindlichkeit für die Menschen um es herum trennt.

1.2 Was Pfungst veränderte

Die zentrale Variation war einfach: In manchen Durchgängen kannte die fragende Person die Antwort, in anderen nicht. Pfungst nannte das Verfahren „mit Wissen“ und „ohne Wissen“. Außerdem setzte er Scheuklappen ein, um zu variieren, ob Hans die fragende Person sehen konnte, und arbeitete mit mehreren Fragenden, darunter von Osten selbst (Pfungst, 1911).

Das Ergebnis war eindeutig. In den Serien, in denen die fragende Person die Antwort kannte, waren 90 bis 100 % der Antworten von Hans richtig. In den Serien, in denen sie die Antwort nicht kannte, waren es höchstens 10 % (Pfungst, 1911). Hans brauchte nicht von Osten persönlich. Er brauchte jemanden, der die Antwort kannte und den er sehen konnte.

1.3 Das Signal, das niemand beabsichtigte

Danach suchte Pfungst nach dem Signal selbst. Wenn das Pferd die richtige Zahl erreicht hatte, machte die fragende Person eine leichte Aufwärtsbewegung mit dem Kopf, und Hans hörte auf zu klopfen. Den Fragenden war diese Bewegung nicht bewusst. Nach Pfungst wurde das Signal ohne ihr Wissen gegeben, und sie wussten nicht einmal, dass sie beobachtet wurden (Pfungst, 1911).

Nachdem er das Signal erkannt hatte, erzeugte Pfungst es absichtlich und stellte fest, dass er das Pferd durch willkürlich gegebene Zeichen nach Belieben antworten lassen konnte (Pfungst, 1911). Damit war die Beweisführung vollständig: Die Information, die Hans' Antworten steuerte, kam von den Menschen um ihn herum, nicht aus einem Verständnis von Arithmetik.

1.4 Was der Fall zeigt und was nicht

Der Fall des Klugen Hans betrifft ein einzelnes Tier, untersucht mit Methoden des frühen 20. Jahrhunderts und ohne Inferenzstatistik. Er ist kein Beleg über Hunde. Er liefert einen Mechanismus und eine Methode. Der Mechanismus: Ein Tier kann eine Aufgabe lösen, indem es auf kleine, unbeabsichtigte Bewegungen eines Menschen achtet, der die Antwort kennt. Die Methode: die Leistung vergleichen, wenn die anwesenden Menschen die Antwort kennen und wenn sie sie nicht kennen.

Hans war nicht „dumm“: Er erkannte winzige Veränderungen der menschlichen Haltung und nutzte sie, um an eine Belohnung zu kommen. Der Fehler lag bei den Beobachtern, die diese Fähigkeit als Rechnen deuteten. Der Clever-Hans-Effekt ist ein Problem der Deutung und des Versuchsaufbaus, kein Urteil über das Tier.

2. Was der Effekt ist und was nicht

2.1 Eine Arbeitsdefinition

In diesem Beitrag bedeutet Clever-Hans-Effekt, dass das Verhalten eines Tieres in einer Aufgabe von Signalen eines Menschen gesteuert wird, der ein bestimmtes Ergebnis kennt, erwartet oder sich wünscht, und dass diese Signale gegeben werden, ohne dass die Person sie beabsichtigt oder bemerkt. Zwei Elemente sind entscheidend: Die Information stammt von einem Menschen und nicht aus der Aufgabe, und die Person weiß nicht, dass sie sie liefert.

Das trennt den Effekt von absichtlichen Hilfen. Ein Halter, der auf den richtigen Becher zeigt oder den Hund in dessen Richtung schiebt, gibt Information mit Absicht. Das ist sozialer Einfluss und kann stark sein, ist aber kein Clever-Hans-Effekt im engeren Sinn. Die Unterscheidung hat eine praktische Seite: Absichtliche Hilfen lassen sich durch Anweisungen verhindern, unbeabsichtigte nicht, weil die Person, die sie erzeugt, nichts von ihnen weiß.

2.2 Überzeugung oder sichtbares Verhalten

Eine zweite Unterscheidung betrifft das, was ein Mensch glaubt, und das, was er sichtbar tut. Eine Überzeugung kann einen Hund nur beeinflussen, wenn sie etwas verändert, das der Hund wahrnehmen kann: Haltung, Blick, Bewegung, Timing, Stimme oder möglicherweise Geruch. Experimente, die Überzeugungen von Haltern verändern, prüfen daher einen indirekten Weg. Experimente, die das sichtbare Verhalten einer Person verändern, etwa eine vorgeführte Vorliebe oder Signale, die Aufmerksamkeit erzeugen, prüfen einen direkten Weg.

Wie die Abschnitte 4 und 5 zeigen, veränderten die Überzeugungen von Haltern allein die Wahlen der Hunde in zwei Zeigestudien nicht messbar, während sichtbare Wahlen und Kommunikation von Menschen die Hunde durchaus verschoben.

2.3 Die umgekehrte Richtung: Beobachterfehler

Ein verwandtes Problem verläuft in die entgegengesetzte Richtung. Im klassischen Fall liest das Tier den Menschen. Beim Beobachterfehler liest der Mensch das Tier falsch: Erwartungen bestimmen, wie ein Verhalten wahrgenommen, bewertet oder berichtet wird, unabhängig davon, was das Tier getan hat. Halter, die gefragt wurden, ob ihr Hund eine Regel gebrochen hatte, konnten das am Begrüßungsverhalten nicht erkennen (Ostojić, Tkalčić & Clayton, 2015). Hier ist die menschliche Deutung die Fehlerquelle.

Beide Richtungen können zusammen auftreten. Ein Hundeführer, der an einer bestimmten Stelle eine Anzeige erwartet, bewegt sich dort vielleicht anders und deutet ein Zögern schneller als Anzeige. Um beides zu trennen, braucht es Versuchsaufbauten, in denen weder der Hund noch die Person, die sein Verhalten bewertet, Zugang zur erwarteten Antwort hat (wie Verhalten objektiv definiert und gemessen wird).

2.4 Kanäle jenseits des Sehens

Das Signal bei Pfungst war visuell, und die meiste Forschung an Hunden konzentrierte sich auf Zeigen, Blick und Körperausrichtung. Menschen übermitteln aber auch über andere Kanäle Information. In einem Experiment erhöhte Schweiß von Menschen, die ein angstauslösendes Video sahen, die Herzfrequenz und das Stressverhalten von Hunden und veränderte ihr Verhalten gegenüber einer fremden Person, verglichen mit Geruchsproben aus fröhlichen oder neutralen Bedingungen (d'Aniello, Semin, Alterisio, Aria & Scandurra, 2018). In einem anderen verschob der Geruch einer fremden gestressten Person die Entscheidungen von Hunden in einem Kognitiven Bias-Test in eine „pessimistischere“ Richtung (Parr-Cortes et al., 2024).

Diese Studien zeigen nicht, dass Geruch Antworten in kognitiven Aufgaben steuert, aber ein menschlicher Zustand kann den Hund über einen Kanal erreichen, den die Person nicht unterdrücken kann (wie menschlicher Stress auf Hunde wirkt).

3. Wie fein Hunde auf menschliche Signale reagieren

3.1 Menschlichen Gesten folgen

Ein Clever-Hans-Effekt setzt ein Tier voraus, das Menschen aufmerksam genug beobachtet, um kleine Signale aufzunehmen. Hunde sind dafür gute Kandidaten. In einem viel zitierten Vergleich nutzten Hunde menschliche Kommunikationssignale besser als Schimpansen, um verstecktes Futter zu finden, und schon Welpen mit wenig Menschenkontakt zeigten diese Fähigkeit, während von Menschen aufgezogene Wölfe in dieser Studie das nicht taten (Hare, Brown, Williamson & Tomasello, 2002). Spätere Arbeiten zeigten, dass sozialisierte Wölfe unter anderen Testbedingungen kurzen, entfernten Zeigegesten folgen konnten (Udell, Dorey & Wynne, 2008). Das spricht dafür, dass die Empfindlichkeit für Signale von Aufzucht, Erfahrung und Testdetails abhängt und nicht allein von der Art (was die Forschung zum Gestenverständnis zeigt).

Ein Tier, das einer absichtlichen Zeigegeste folgt, bemerkt wahrscheinlich auch kleinere, unbeabsichtigte Versionen davon: einen Blick, eine Gewichtsverlagerung, eine Drehung der Schultern.

3.2 Menschliche Aufmerksamkeit lesen

Hunde verfolgen auch, ob ein Mensch aufmerksam ist. In einem Versuch mit verbotenem Futter und 12 Hunden schaute ein Mensch entweder zu oder nicht, weil er den Raum verließ, sich umdrehte, abgelenkt war oder die Augen schloss. Wenn er zuschaute, nahmen die Hunde weniger Futter, näherten sich ihm auf indirekterem Weg und setzten sich häufiger, statt sich hinzulegen, und in den meisten Bedingungen ohne Zuschauen verhielten sie sich anders (Call, Bräuer, Kaminski & Tomasello, 2003).

In einer Studie im Zuhause der Hunde bekamen 16 Hunde das Signal „Platz“, danach schaute der Halter den Hund an, las, sah fern, drehte sich weg oder verließ den Raum, jeweils in Durchgängen von 60 Sekunden. Mit Futter in der Nähe hatte die Bedingung einen signifikanten Effekt, und die Hunde standen schneller auf, wenn der Halter ihnen den Rücken zukehrte oder abwesend war, als bei Blickkontakt (Schwab & Huber, 2006). Die Hunde nutzten Blickkontakt und die Ausrichtung von Augen, Kopf und Körper; die Autoren wiesen darauf hin, dass die Ergebnisse vom Kontext abhängen können.

Eine weitere Studie fand, dass Hunde aufmerksame von unaufmerksamen Menschen anhand von Körperausrichtung, Kopfrichtung und Sichtbarkeit der Augen unterschieden, je nach Situation, und zögerten, sich Haltern mit verbundenen Augen zu nähern (Gácsi, Miklósi, Varga, Topál & Csányi, 2004).

3.3 Aufmerksamkeit verändert die Signale des Hundes

In einer Studie mit 24 Hunden zeigten die Hunde mehr Gesichtsbewegungen, wenn ein Mensch ihnen zugewandt war, als wenn er sich abwandte, und Futter machte keinen Unterschied (Kaminski, Hynds, Morris & Waller, 2017). Jede Messung, die auf der Bewertung des Ausdrucksverhaltens eines Hundes beruht, kann also davon beeinflusst werden, ob ein Mensch im Raum dem Hund Aufmerksamkeit schenkt (wie Hunde Körpersprache und Mimik einsetzen).

3.4 Ostensive Signale und emotionale Information

Auch die Art, wie ein Mensch eine Vorführung rahmt, kann eine Rolle spielen. In einer Aufgabe zum sozialen Lernen, bei der ein Gegenstand bedient werden musste, lernten Hunde mehr, wenn die Vorführung mit Blickkontakt und direkter Ansprache verbunden war, sogenannten ostensiven Signalen (Range et al., 2009). Solche Signale zeigen dem Hund, dass das Folgende ihm gilt, und sie gehören zum Trainingsalltag: der Name des Hundes, Blickkontakt, ein bestimmter Tonfall (wie Hunde von Menschen und Artgenossen lernen).

Es wurde auch gezeigt, dass Hunde emotionale Information aus menschlichem Gesicht und menschlicher Stimme zusammenführen (Albuquerque et al., 2016), und in unsicheren Situationen suchen sie solche Information aktiv. Vor einem mehrdeutigen Gegenstand, einem Ventilator, schauten 83 % der Hunde auf ihren Halter, und ob der Halter sich näherte oder zurückwich, wirkte deutlich stärker als Stimme und Gesichtsausdruck allein (Merola, Prato-Previde & Marshall-Pescini, 2012b). In einer verwandten Studie wechselten 62 % der Hunde mit dem Blick zwischen Gegenstand und informierender Person, wenn diese der Halter war, und 52 % bei einer fremden Person; die Anpassung an die emotionale Botschaft war beim Halter deutlicher (Merola, Prato-Previde & Marshall-Pescini, 2012a).

Diese Befunde zeigen den Kanal, über den unbeabsichtigte Signale wirken: Ein Hund in einer unsicheren Lage schaut zum Menschen, und Bewegung hatte eine besonders starke Wirkung (wie Hunde in unsicheren Situationen menschliche Information nutzen). Der Befund stammt aus einem Labor und mit einem einzigen Reiz, seine Verallgemeinerbarkeit ist also begrenzt.

4. Steuern die Überzeugungen von Haltern Hunde in Kognitionsexperimenten?

4.1 Das Problem für die Kognitionsforschung

In vielen Kognitionsexperimenten mit Hunden hält der Halter den Hund zu Beginn eines Durchgangs oder steht in der Nähe, also an einer Stelle, von der aus der Hund kleine Körpersignale lesen kann. Würden Halter ihre Hunde systematisch beeinflussen, stünde ein großer Teil der Literatur zum Gestenverständnis in Frage.

4.2 Die Wiener Zeigestudie

Eine Studie am Clever Dog Lab in Wien prüfte das mit einer Wahlaufgabe zwischen zwei Bechern mit 20 Durchgängen pro Hund, bei der die Versuchsleitung auf einen von zwei Bechern zeigte, während der Halter den Hund hielt (Schmidjell, Range, Huber & Virányi, 2012). Im ersten Experiment wurden 69 Familienhunde vier Gruppen zugeteilt. Halter mit verbundenen Augen konnten die Zeigegeste nicht sehen. In der Verstärkungsgruppe sahen die Halter die Geste und bekamen gesagt, der Hund solle ihr folgen. In der Abschwächungsgruppe sahen die Halter eine Zeigegeste zum leeren Becher und bekamen gesagt, der Hund solle sie ignorieren. In der Gruppe ohne Zeigen gab es keine Geste, aber der Halter wusste, wo das Futter lag.

Die Hunde in allen drei Zeigegruppen wählten überzufällig richtig, und die Veränderung der Überzeugung machte keinen messbaren Unterschied. In der Gruppe ohne Zeigen, in der nur der Halter die Information hatte, wählten die Hunde auf Zufallsniveau. Das Wissen des Halters allein lenkte die Hunde nicht (Schmidjell et al., 2012).

Das zweite Experiment mit 31 Hunden fragte, was passiert, wenn Halter helfen wollen. Wenn Halter ihren Hund aktiv lenkten, waren die Hunde überzufällig erfolgreich, 10 von 16 auch einzeln. Wenn Halter den Hund lenkten, während die Versuchsleitung in die andere Richtung zeigte, scheiterte der Einfluss der Halter, nur 2 von 15 Hunden waren einzeln erfolgreich, und die Gruppen unterschieden sich signifikant (Schmidjell et al., 2012).

4.3 Die Budapester Studie

Ein unabhängiges Labor in Budapest kam mit anderen Bedingungen zu einem übereinstimmenden Schluss (Hegedüs, Bálint, Miklósi & Pongrácz, 2013). In einer Wahlaufgabe zwischen zwei Orten mit kurzer, entfernter Zeigegeste trug eine Gruppe von Haltern undurchsichtige Brillen. In einer Gruppe „passiver Kluger Hans“ wurde den Haltern ein Geschenk und ein Eintrag in ein „Register der klügsten Hunde“ versprochen, wenn ihr Hund keine Fehler machte. In einer Gruppe „aktiver Kluger Hans“ sollten die Halter helfen, indem sie den Hund sanft zur richtigen Seite schoben. Eine weitere Kontrollgruppe vervollständigte den Aufbau; ihr genaues Vorgehen wird hier nicht beschrieben.

Die Autoren schlossen, dass die kurze Zeigegeste der Versuchsleitung für erwachsene Familienhunde ein verlässliches Signal blieb, auch wenn Halter absichtliche oder unabsichtliche Hilfen gaben, und dass die Anwesenheit von Haltern in kurzen Studien zur visuellen Kommunikation die Ergebnisse nicht zwangsläufig verzerrt (Hegedüs et al., 2013). Stichprobengröße und genaue Statistik werden hier nicht berichtet, der Vergleich mit der Wiener Studie beschränkt sich also auf die Richtung der Hauptaussage.

4.4 Was diese Ergebnisse bedeuten

Zwei Labore fanden in einer kurzen Zeigeaufgabe keinen messbaren Clever-Hans-Effekt durch die Überzeugungen von Haltern. Für dieses Paradigma ist das beruhigend, mit Grenzen. Die Zeigegeste war ein klares, auffälliges Signal; wo es ein solches Signal nicht gibt, können unbeabsichtigte Hilfen mehr Gewicht haben. Die Wiener Autoren wiesen darauf hin, dass sich ihre Ergebnisse nicht ohne Weiteres auf andere Hund-Halter-Paare übertragen lassen, dass das Verhalten der Halter nicht gemessen wurde, weil Hunde auf Signale reagieren können, die menschliche Beobachter nicht erkennen, und dass ein möglicher Effekt der zeigenden Versuchsleitung, die den richtigen Becher kannte, nicht untersucht wurde (Schmidjell et al., 2012).

Der letzte Punkt ist wichtig: Im ursprünglichen Fall war es die fragende Person, die die Antwort lieferte.

5. Wenn sichtbares menschliches Verhalten die eigene Information des Hundes übertrumpft

5.1 Weniger wählen, weil der Halter es tat

Sichtbares Verhalten ist etwas anderes. In einer Futterwahlaufgabe mit 54 Familienhunden wählten die Hunde bei eigener Entscheidung zwischen einer großen und einer kleinen Futtermenge signifikant häufiger die größere (Prato-Previde, Marshall-Pescini & Valsecchi, 2008). Nachdem sie gesehen hatten, wie ihr Halter die kleine Menge bevorzugte, wählten sie die große signifikant seltener. Waren beide Mengen gleich klein und bevorzugte der Halter eine davon, war die Anpassung an seine Wahl größer als bei unterschiedlichen Mengen.

Die Autoren schlossen, dass Halter Hunde zu nachteiligen Entscheidungen bringen können. Weil die Halter absichtlich handelten, ist das kein Clever-Hans-Effekt im engeren Sinn, aber es zeigt, dass eine sichtbare menschliche Wahl die eigene Wahrnehmung des Hundes übertrumpfen kann, am stärksten dann, wenn diese Wahrnehmung keine Option klar bevorzugt.

5.2 Halter und Fremde

Eine Folgestudie mit zwei Experimenten, eines zur Futtermenge und eines zur Schmackhaftigkeit, ließ entweder den Halter oder eine fremde, freundliche Person auf die ungünstigere Option hinweisen (Marshall-Pescini, Prato-Previde & Valsecchi, 2011). Die Hunde folgten dem Hinweis des Menschen, obwohl er sie zur schlechteren Option führte, und Halter und fremde Person unterschieden sich in ihrem Einfluss nicht. Eine unbekannte Versuchsleitung, Prüferin oder Richterin ist also nicht automatisch neutral.

5.3 Der A-nicht-B-Fehler

In einer A-nicht-B-Aufgabe wird ein Gegenstand mehrmals an Ort A versteckt und dann, für den Hund sichtbar, an Ort B. Sucht der Hund an A, obwohl er das Verstecken an B gesehen hat, ist das ein perseverativer Fehler. In einer Studie, die Hunde, von Menschen aufgezogene Wölfe und zehn Monate alte Kleinkinder verglich, machten Hunde mehr perseverative Fehler, wenn das Verstecken ostensiv-kommunikativ erfolgte, als bei nicht kommunikativem oder nicht sozialem Verstecken: in 75 % der Durchgänge gegenüber 39 % und 17 % (Topál, Gergely, Erdőhegyi, Csibra & Miklósi, 2009). Von Menschen aufgezogene Wölfe zeigten diese Abhängigkeit vom Kontext nicht.

Die ursprüngliche Deutung war, dass Hunde wie Kleinkinder besonders empfindlich für menschliche Kommunikationssignale sind. Diese Deutung ist umstritten. In veröffentlichten Kommentaren wurden einfachere Erklärungen vorgeschlagen, vor allem lokale Verstärkung: Die Handlungen des Menschen an Ort A lenkten die Aufmerksamkeit des Hundes dorthin. In ihrer Antwort räumten die ursprünglichen Autoren ein, dass Aufmerksamkeitsprozesse und lokale Verstärkung beteiligt sind, und argumentierten, dass das Verhalten der Hunde von einer Kombination von Faktoren beeinflusst wird, darunter eine besondere Empfänglichkeit für menschliche Kommunikationssignale (Topál, Miklósi, Sümegi & Kis, 2010).

5.4 Eine Replikation

Ein gemeinsames Team aus Budapest und Wien wiederholte die Aufgabe ohne Suchbewegung in den A-Durchgängen und ohne Schein-Beköderung in den B-Durchgängen (Kis et al., 2012). Die Neigung, nach ostensiv-kommunikativem Verstecken Fehler zu machen, ließ sich replizieren, und weder eine Unfähigkeit, eine belohnte Bewegung zu unterdrücken, noch Defizite im Arbeitsgedächtnis oder in der Aufmerksamkeit erklärten die Fehler. Der Fehler wurde kleiner, wenn Ort B ostensiv hervorgehoben wurde. Die Autoren schlossen, dass solche Aufgaben zeigen, wie die Empfänglichkeit für menschliche soziale Signale Hunde in die Irre führen kann.

Die Replikation ist nicht völlig unabhängig von der ursprünglichen Gruppe, und der Mechanismus bleibt umstritten. Das Ergebnis ist aber klar: Wie sich ein Mensch während einer Aufgabe verhält, kann die eigene Beobachtung des Hundes übertrumpfen.

5.5 Die Befunde zusammengeführt

In kurzen Zeigeaufgaben mit einem klaren Signal der Versuchsleitung verschoben die Erwartungen von Haltern allein die Wahlen der Hunde nicht messbar. Wenn Menschen sichtbar wählten, vorführten oder kommunizierten, verschoben sich die Wahlen der Hunde, manchmal gegen ihr eigenes Interesse und ihre eigene Wahrnehmung. Das praktische Risiko liegt weniger in dem, was ein Hundeführer insgeheim glaubt, als in dem, was er sichtbar tut, oft ohne es zu merken.

6. Deutungsfehler: der „Schuldblick“

6.1 Das klassische Experiment

Der „Schuldblick“ ist das bekannteste Alltagsbeispiel dafür, wie menschliche Überzeugungen bestimmen, was Menschen in Hunden sehen. In einem Experiment mit 14 Hunden verbot der Halter dem Hund, ein Leckerli zu fressen, und verließ den Raum (Horowitz, 2009). Die Versuchsleitung bestimmte dann, ob der Hund es fraß, und dem Halter wurde wahrheitsgemäß oder falsch mitgeteilt, ob der Hund gehorcht hatte; entsprechend begrüßte oder schimpfte er den Hund.

Das „Schuldblick“-Verhalten unterschied sich nicht danach, ob der Hund tatsächlich ungehorsam gewesen war. Es nahm zu, wenn der Halter schimpfte, und war am deutlichsten bei Hunden, die gehorcht hatten und trotzdem ausgeschimpft wurden (Horowitz, 2009). Das Verhalten folgte dem Verhalten des Halters, das wiederum seiner Überzeugung folgte, und nicht der Handlung des Hundes.

6.2 Replikation und Urteile der Halter

Eine unabhängige Studie bestätigte das Muster. Hunde, die eine Regel gebrochen hatten, zeigten das Verhalten nicht häufiger als Hunde, die das nicht getan hatten, ohne schimpfenden Halter fehlte es praktisch, und Halter konnten am Begrüßungsverhalten nicht besser als zufällig erkennen, ob ihr Hund die Regel gebrochen hatte (Hecht, Miklósi & Gácsi, 2012). Eine weitere Studie fand ebenfalls, dass Halter am Begrüßungsverhalten nicht erkennen konnten, ob der Hund eine Regel gebrochen hatte (Ostojić et al., 2015).

6.3 Warum das ein Clever-Hans-Problem ist

Der Schuldblick verbindet beide Richtungen aus Abschnitt 2: Die Überzeugung des Halters verändert sein Verhalten, der Hund reagiert darauf, und der Halter liest die Reaktion als Bestätigung der Überzeugung, die sie ausgelöst hat (was die Forschung zum Schuldblick zeigt). Er ist damit kein klassischer Clever-Hans-Effekt im engen Sinn, sondern ein verwandtes Beispiel dafür, wie menschliches Verhalten die Reaktion des Hundes verändert und menschliche Erwartungen anschließend die Interpretation dieses Verhaltens prägen.

Die Studie von Horowitz ist klein, und diese Experimente sagen nichts darüber, ob Hunde etwas wie Schuld empfinden können. Sie zeigen aber, dass das Verhalten, das gewöhnlich als Beleg für Schuld gilt, ein schlechter Hinweis darauf ist, was der Hund getan hat, und dass das Verhalten eines Hundes in Gegenwart eines Menschen, der etwas erwartet, kein neutrales Abbild seines Zustands ist (warum Verhalten kein direktes Abbild von Emotionen ist).

7. Spürhunde und der Einfluss der Hundeführer

7.1 Warum Sucharbeit anfällig ist

Bei Spürhunden hat das Clever-Hans-Problem große praktische Folgen, denn eine Anzeige kann zu einer Durchsuchung, einer Festnahme oder einer medizinischen Entscheidung führen. Die Lage ähnelt dem ursprünglichen Fall: Ein Hund arbeitet nah an einem Menschen, der weiß oder vermutet, wo das Ziel liegt, und der das Verhalten des Hundes deutet. Die Riechleistung des Hundes steht nicht in Frage (wie der Geruchssinn das Verhalten des Hundes prägt). Die Frage ist, ob eine bestimmte Anzeige den Geruch widerspiegelt oder den Hundeführer.

7.2 Überzeugungen der Hundeführer und Orte der Anzeige

Den direktesten Test bei Arbeitshunden liefert eine Studie mit 18 Teams aus Drogen- und/oder Sprengstoffspürhund und Hundeführer (Lit, Schweitzer & Oberbauer, 2011). Jedes Team absolvierte zwei Sätze von je vier kurzen Suchszenarien. Den Hundeführern wurde fälschlich gesagt, dass in zwei Bedingungen eine Papiermarkierung die Stelle des Zielgeruchs anzeige, was den menschlichen Einfluss prüfte; zwei Bedingungen enthielten Ablenkgerüche von Futter oder Spielzeug, was den Einfluss von Seiten des Hundes prüfte. Die Bedingungen waren eine Kontrolle, eine Papiermarkierung, ein Ablenkgeruch und eine Markierung an einem Ablenkgeruch. Keine enthielt Zielgeruch, jede Anzeige war also falsch.

Es gab 225 falsche Reaktionen, ohne Unterschiede in den mittleren Reaktionen zwischen den Bedingungen. In Bedingungen ohne Markierung gab es mehr korrekte Suchen, also Suchen ohne Anzeige. In den markierten Bedingungen berichteten die Hundeführer, dass die Hunde häufiger an den markierten Stellen anzeigten als anderswo. Die Autoren schlossen, dass menschliche Einflüsse die Orte der Anzeigen stärker beeinflussten als Einflüsse von Seiten des Hundes (Lit et al., 2011).

Ohne Zielgeruch kann die Studie nicht sagen, wie Überzeugungen das Finden echter Ziele beeinflussen, und sie kann nicht trennen, ob Hunde auf Signale der Hundeführer reagierten oder ob Hundeführer mehrdeutiges Verhalten als Anzeige werteten. Mit 18 Teams ist die Stichprobe überschaubar, und doch ist es der stärkste direkte Beleg dafür, dass Erwartungen von Hundeführern Suchergebnisse verändern.

7.3 Verblindung als methodischer Standard

Eine methodische Übersichtsarbeit zur Forschung mit Spürhunden behandelt die Erwartungen von Hundeführern und Versuchsleitern als große Gefahr für die Aussagekraft, weil sich Hundeführer anders bewegen können, wenn sie wissen, wo die Ziele liegen (Lazarowski et al., 2020). Am häufigsten sind einfach verblindete Tests, bei denen nur der Hundeführer das Ziel nicht kennt; doppelt verblindete Tests, bei denen niemand der anwesenden und mit dem Hund interagierenden Personen die Antwort kennt, gelten methodisch als besonders wichtiger Standard zur Kontrolle solcher Erwartungseffekte und bilden Einsatzbedingungen besser ab. Studien berichteten über Leistungseinbußen, sobald doppelt verblindet getestet wurde, und von Hundeführern ausgelöste Falschanzeigen sind eine eigene Fehlerquelle.

Eine systematische Übersichtsarbeit zu 54 Spürhundestudien fand, dass die Testmethoden uneinheitlich und anfällig für mögliche Verzerrungen waren und dass es keine anerkannten Qualitätsstandards gab (Johnen, Heuwieser & Fischer-Tenhagen, 2017). Die Autoren leiteten einen Standard guter Praxis ab, der Zielgeruch, Aufgabe, Aufbau, Proben, Testdesign, Trainer und Training sowie Rassen umfasst.

7.4 Wenn Trainingserfolg der Verblindung nicht standhält

Eine Studie zum Erkennen von Prostatakrebs zeigt, was passieren kann, wenn auf vielversprechendes Training strenge Tests folgen (Elliker et al., 2014). Zehn Hunde wurden in zwei Stufen trainiert, drei erreichten die zweite Stufe. In einem doppelt verblindeten Test mit unbekannten Urinproben hatten zwei Hunde Sensitivitäten von 0,13 und 0,25, nicht besser als Zufall. Die Autoren vermuteten, dass sich die Hunde im Training einzelne Proben gemerkt hatten.

Das ist nicht in erster Linie ein Befund zu Hilfen durch den Hundeführer, zeigt aber, dass die Leistung mit bekannten Proben im Training die Leistung unter verblindeten Bedingungen mit neuen Proben überschätzen kann.

7.5 Den Menschen aus der Entscheidung nehmen

Ein anderer Ansatz nimmt den Hundeführer ganz aus der Entscheidung. In einer Machbarkeitsstudie legte ein automatisches Olfaktometer mit drei Öffnungen die Position des Ziels per Computer zufällig fest, erfasste ein vier Sekunden langes Halten der Nase mit einem Infrarotsensor und gab die Belohnung über einen automatischen Futterspender (Aviles-Rosa, Gallegos, Prada-Tiedemann & Hall, 2021). Die Versuchsleitung konnte nicht sehen, welche Öffnung das Ziel enthielt, der Test war also doppelt verblindet.

Zwölf unerfahrene Mischlinge aus Tierheimen und Tierschutz, getestet in zwei Gruppen, lernten die Aufgabe alle innerhalb von 23 Tagen und übertrafen in ihren letzten Einheiten alle 85 % Trefferquote, mit Werten zwischen 85,00 ± 0,00 % und 98,75 ± 1,25 %. Bei abgeklemmten Geruchsleitungen fiel die Trefferquote auf 5,00 ± 3,37 %, was zeigte, dass die Hunde weder das Gerät noch andere geruchsfremde Hinweise nutzten. Der Anteil an Falschanzeigen lag im Training nie über 20 % (Aviles-Rosa et al., 2021).

Die Autoren nannten die Grenzen: nur für den Einsatz im Labor, geringere ökologische Validität als herkömmliche Suchen, Kosten von etwa 5.000 US-Dollar, nötige Programmierkenntnisse und schwankende Geruchskonzentration. Die Hunde waren eine Forschungspopulation, keine Spürhunde im Einsatz.

7.6 Objektive Maße für die Reaktion des Hundes

Ein weiterer Ansatz macht das Lesen des Hundes weniger abhängig vom Hundeführer. In 200 ausgewerteten Videos von 10 Spürhunden an einem Karussell-Aufbau war das Schnüffeln bei richtig negativen Reaktionen signifikant kürzer als bei den anderen Reaktionstypen, und richtig negative Reaktionen umfassten meist eine Schnüffelphase, die anderen häufig zwei (Concha et al., 2014). Die Autoren nannten es als eine Quelle falsch negativer Ergebnisse, wenn der Hundeführer eine positive Anzeige nicht erkennt. Solche Maße wurden bisher nur an kleinen Stichproben und in einem kontrollierten Aufbau geprüft.

7.7 Die Trefferquote im Einsatz hängt vom Kontext ab

In einer Studie mit 164 Polizeihunden in polnischen Trainings- und Prüfumgebungen und 1.219 Suchtests brauchten die Hunde im Mittel 64 Sekunden bis zur Anzeige; 87,7 % der Anzeigen waren richtig, 5,3 % falsch, und in 7,0 % der Tests wurde das Ziel nicht innerhalb von 10 Minuten gefunden (Jezierski et al., 2014). Im Freien sank die Trefferquote auf 63,5 %, in Autos auf 57,9 %. In polizeilichen Prüfungsdurchgängen machten die Hunde mehr Falschanzeigen und weniger richtige Anzeigen, und die Suchen dauerten länger als in der letzten Trainingsphase.

Ausgebildete Spürhunde liegen also weit über dem Zufall, aber ihre Trefferquote schwankt mit Rasse, Ausbildungsstand, Drogenart und Umgebung und sinkt unter Prüfungsbedingungen. Die Studie berichtete nicht, ob die Hundeführer verblindet waren, sie zeigt also keine Hilfen durch Hundeführer; sie zeigt, dass eine Trefferquote ohne ihre Bedingungen wenig aussagt.

8. Gesten und Wörter im Training

8.1 Wenn Geste und Wort sich widersprechen

Im Trainingsalltag ist die häufigste unbeabsichtigte Hilfe eine sichtbare Körperbewegung, die der Mensch nicht zum Signal zählt: sich bei „Platz“ leicht nach vorn beugen, bei „Komm“ einen Schritt zurückgehen. Der Hund lernt dann womöglich die Bewegung statt des Wortes.

Eine Studie mit Wasserrettungshunden, die gleichermaßen auf Gesten und Wörter trainiert waren, prüfte das (D'Aniello, Scandurra, Alterisio, Valsecchi & Prato-Previde, 2016). Die Halter forderten „Sitz“, „Platz“, „Bleib“ und „Komm“ nur per Geste, nur per Wort oder mit einer widersprüchlichen Kombination. Gesten wurden signifikant besser befolgt als Wörter. Hündinnen reagierten stärker auf Gesten, Rüden reagierten besser auf Wörter als Hündinnen. Bei widersprüchlichen Signalen folgten die Hunde meist der Geste, außer wenn ein gesprochenes „Komm“ mit einem gestischen „Bleib“ verbunden wurde, während sich der Halter entfernte. Die Autoren schlossen, dass Gesten auffälliger sind, der Kontext aber ebenfalls zählt, hier die Motivation, bei einem sich entfernenden Halter zu bleiben.

8.2 Vertraute und fremde Hundeführer

Eine zweite Studie mit Arbeitshunden verglich übereinstimmende und widersprüchliche Gesten und Wörter, gegeben vom Halter oder von einer fremden Person, in vier Gehorsamsaufgaben (Scandurra et al., 2017). Das geforderte Verhalten war weniger wahrscheinlich, wenn eine fremde Person Wörter benutzte, und die Reaktionszeiten stiegen bei fremden Personen mit Stimmsignalen. Bei widersprüchlichen Signalen folgten die Hunde den Gesten einer fremden Person eher als ihren Wörtern, während die Wortsignale der Halter verlässlicher waren.

Ein Wortsignal ist an eine bestimmte Stimme und einen bestimmten Kontext gebunden, eine Geste sieht dagegen ähnlich aus, egal wer sie macht. Ein Hund folgt deshalb vielleicht den Gesten einer fremden Person, aber nicht ihren Wörtern (wie Hunde gelernte Signale verallgemeinern).

8.3 Grenzen der Befunde zu Gesten

Beide Studien nutzten spezialisierte Arbeitshundepopulationen, und ihre Stichprobengrößen werden hier nicht berichtet. Aus dem Befund lässt sich keine Regel machen, dass „Hunde immer der Körpersprache folgen“: Schon bei den Wasserrettungshunden hingen die Reaktionen vom Geschlecht und von der konkreten Kombination ab. Welches Signal bei einem bestimmten Hund dominiert, hängt vermutlich von seiner Lerngeschichte ab und davon, welches Signal am verlässlichsten Verstärkung angekündigt hat.

Aus der Praxis: Es kommt häufig vor, dass ein Hund ein Wortsignal scheinbar „kann“, das sich dann als gesteuert durch eine gleichzeitige Körperbewegung herausstellt, etwa ein leichtes Vorbeugen vor „Platz“ oder eine Schulterdrehung vor „Komm“. Das ist eine Beobachtung aus der Trainingspraxis, kein Ergebnis kontrollierter Studien, passt aber zu den experimentellen Befunden zur Auffälligkeit von Gesten.

9. Versuchsaufbauten gegen den Clever-Hans-Effekt

9.1 Verblindung

Die Methode von Pfungst bestimmt bis heute die grundlegende Kontrolle: die Leistung vergleichen, wenn die Anwesenden die Antwort kennen und wenn nicht. In einem einfach verblindeten Aufbau kennt der Hundeführer die Antwort nicht, eine andere anwesende Person aber vielleicht schon. In einem doppelt verblindeten Aufbau kennt sie niemand, der während des Durchgangs mit dem Hund interagiert oder ihn beobachtet. In der Spürhundeforschung gelten doppelt verblindete Tests methodisch als besonders wichtiger Standard, um Erwartungseffekte zu kontrollieren und Einsatzbedingungen möglichst realistisch abzubilden (Lazarowski et al., 2020).

Jemand muss den Durchgang vorbereiten und danach außer Sicht des Hundes bleiben, und auch die Person, die das Verhalten bewertet, muss verblindet sein, sonst können Beobachterfehler einfließen. Eine Lösung ist die Auswertung von Videos durch Beobachter, die die Bedingung nicht kennen (wie Verhaltensbeurteilungen aufgebaut und bewertet werden).

9.2 Automatisierung und Kontrollen ohne Ziel

Automatisierung nimmt Menschen aus dem entscheidenden Moment, wie bei der oben beschriebenen automatischen Anordnung (Aviles-Rosa et al., 2021). Ebenso wichtig war ihre Kontrolle mit abgeklemmten Geruchsleitungen. Solche Kontrollen prüfen, ob der Hund die Aufgabe ohne die Information lösen kann, die er nutzen soll; bleibt die Leistung hoch, nutzt er etwas anderes. Die Studie zu den Überzeugungen der Hundeführer folgte derselben Logik, indem sie gar keinen Zielgeruch enthielt, sodass jede Anzeige etwas über geruchsfremde Einflüsse aussagte (Lit et al., 2011). Beide folgen Pfungst: die Information entfernen, die das Tier nutzen soll, und schauen, was übrig bleibt.

9.3 Den Menschen messen, nicht nur den Hund

Nur wenige Studien messen, was der Mensch tatsächlich tut. Die Wiener Studie maß das Verhalten der Halter nicht, weil Hunde auf Signale reagieren können, die Beobachter nicht erkennen (Schmidjell et al., 2012). Ein Nullergebnis bedeutet daher, dass keine Wirkung auf den Hund gefunden wurde, nicht, dass keine Signale gegeben wurden.

9.4 Replikation über Labore hinweg

Clever-Hans-Effekte sind nur ein Grund, warum einzelne Studien Effekte überschätzen können. Eine methodische Arbeit zur vergleichenden Kognitionsforschung argumentierte, dass veröffentlichte Effektgrößen überhöht sind und dass begrenzte Verfügbarkeit von Arten, Verhaltensunterschiede zwischen Standorten und kleine Stichproben viele Aussagen praktisch unwiderlegbar machen (Farrar, Boeckle & Clayton, 2020). Die Autoren schlugen eine formale Bewertung der Replizierbarkeit, bessere Statistik und eine Infrastruktur für die Zusammenarbeit zwischen Laboren vor. Eine Übersichtsarbeit zu 285 Artikeln der Hundekognitionsforschung empfahl, Studien zu wiederholen, wenn das Wissen auf wenigen Studien oder kleinen Stichproben beruht, vielfältigere Populationen zu testen und dem Geruchssinn mehr Aufmerksamkeit zu schenken (Bensky, Gosling & Sinn, 2013).

Eine kleine Studie in einem einzigen Labor, durchgeführt von Menschen, die die Hypothese und oft die richtige Antwort kennen, ist genau die Situation, in der unbeabsichtigte Hilfen und überhöhte Effekte am schwersten zu erkennen sind. Solange ein Befund nicht an mehreren Standorten repliziert wurde, gilt er am besten als vielversprechend, nicht als gesichert (was über die kognitiven Fähigkeiten von Hunden bekannt ist).

10. Was daraus für die Praxis folgt

10.1 Unbeabsichtigte Hilfen im Trainingsalltag

Die Forschung legt nahe, dass im Trainingsalltag nicht verborgene Überzeugungen die wichtigsten Signale sind, sondern sichtbares Verhalten: Körperausrichtung, Blick, Bewegung und Timing. Hunde verfolgen, ob ein Mensch aufmerksam ist (Call et al., 2003; Schwab & Huber, 2006), reagieren stärker darauf, ob der Halter sich nähert oder zurückweicht, als auf Stimme und Gesicht allein (Merola et al., 2012b), und folgten bei widersprüchlichen Signalen eher Gesten als Wörtern (D'Aniello et al., 2016).

Zwei Muster sind häufig: eine Körperbewegung, die dem Wortsignal vorausgeht oder es begleitet, und ein Blick zum richtigen Gegenstand oder Ort bei Suchspielen, beim Apportieren oder beim Unterscheiden von Gegenständen. Beides liefert Information, die der Mensch nicht zum Signal zählt.

Aus der Praxis: Bei Such- und Gegenstandsspielen drehen Menschen, die wissen, wo etwas versteckt ist, oft Kopf oder Körper leicht in diese Richtung, werden in der Nähe langsamer oder ändern ihren Tonfall, wenn der Hund sich nähert. Eine einfache Absicherung: Lass eine andere Person den Gegenstand verstecken, sodass du selbst nicht weißt, wo er liegt. Das ist eine Beobachtung aus der Praxis, kein Ergebnis einer kontrollierten Studie.

10.2 Prüfen, ob dein Hund auf das Wort reagiert

Aus der Praxis: Um zu prüfen, ob dein Hund allein auf das Wortsignal reagiert, steh still mit locker hängenden Armen, schau auf einen festen Punkt über dem Hund oder trag eine Sonnenbrille und sag das Wort einmal mit neutraler Stimme. Du kannst die Signale in zufälliger Reihenfolge mischen, damit der Hund das nächste nicht aus der Abfolge vorhersagen kann. Bei Namen von Gegenständen kannst du die Gegenstände außerhalb deines Sichtfelds platzieren, damit du nicht zum richtigen schauen kannst. Eine Videoaufnahme erlaubt es jemand anderem zu prüfen, ob sich doch eine Bewegung eingeschlichen hat. Diese Schritte stammen aus der Trainingspraxis und übertragen die Logik des Blindtests; sie sind kein geprüftes Testverfahren.

Bricht die Leistung unter diesen Bedingungen ein, ist das eine Information, kein Versagen: Ein Teil dessen, was dein Hund gelernt hat, war dein Körper, und im Training lässt sich diese Hilfe abbauen, während das Wort zum ankündigenden Signal wird.

10.3 Aussagen wie „Mein Hund versteht Wörter“ einordnen

Aussagen darüber, dass Hunde Wörter, Zahlen oder Begriffe verstehen, sind besonders anfällig, weil die Person, die sie macht, meist die Antwort kennt und bei der Vorführung anwesend ist (was über das Wortlernen bei Hunden bekannt ist). Ein Video, in dem ein Hund das genannte Spielzeug aus einem Haufen holt, belegt kein Wortverständnis, wenn der Halter die Spielzeuge sehen konnte und wusste, welches genannt wurde.

Der Mindeststandard folgt aus Pfungst: Die Person, die das Signal gibt, darf die Antwort nicht kennen oder für den Hund nicht sichtbar sein, und die Person, die die Reaktion bewertet, darf nicht wissen, welche Antwort erwartet wurde. Nur dann zeigt eine richtige Reaktion, dass der Hund die Aufgabe ohne menschliche Information gelöst hat.

10.4 Die Belege im richtigen Verhältnis sehen

Nicht jeder Erfolg ist ein Clever-Hans-Effekt. Die Überzeugungen von Haltern veränderten die Wahlen der Hunde in zwei Zeigestudien nicht messbar (Schmidjell et al., 2012; Hegedüs et al., 2013), Spürhunde lagen in Feldtests weit über dem Zufall (Jezierski et al., 2014), und Hunde in einem automatischen, doppelt verblindeten Aufbau erreichten hohe Trefferquoten ohne Menschen in der Entscheidung (Aviles-Rosa et al., 2021).

Die Belege stützen eine engere Aussage: Sichtbares menschliches Verhalten kann die Wahlen von Hunden verschieben (Prato-Previde et al., 2008; Marshall-Pescini et al., 2011; Kis et al., 2012), Erwartungen von Hundeführern können verschieben, wo Anzeigen gewertet werden (Lit et al., 2011), und Trainingserfolg kann unter doppelt verblindeten Tests scheitern (Elliker et al., 2014). Die richtige Antwort ist kein Misstrauen gegenüber den Fähigkeiten von Hunden, sondern Tests, die zeigen, welche Information der Hund tatsächlich nutzt.

11. Zusammenfassung auf einen Blick

Der Clever-Hans-Effekt beschreibt Verhalten, das von unbeabsichtigten Signalen von Menschen gesteuert wird, die die richtige Antwort kennen oder erwarten. Im ursprünglichen Fall lag ein Pferd in 90 bis 100 % der Antworten richtig, wenn die fragende Person die Antwort kannte, und in höchstens 10 %, wenn nicht; das Signal war eine leichte Aufwärtsbewegung des Kopfes, von der die Fragenden nichts wussten (Pfungst, 1911).

Hunde reagieren sehr fein auf menschliche Gesten, Aufmerksamkeit und emotionale Signale (Hare et al., 2002; Call et al., 2003; Gácsi et al., 2004; Schwab & Huber, 2006; Merola et al., 2012a, 2012b). In zwei unabhängigen Zeigestudien veränderten die Überzeugungen von Haltern allein die Wahlen der Hunde nicht messbar (Schmidjell et al., 2012; Hegedüs et al., 2013), während sichtbare menschliche Wahlen sie verschoben, und fremde Personen hatten dabei so viel Einfluss wie Halter (Prato-Previde et al., 2008; Marshall-Pescini et al., 2011). Kommunikatives Verhalten kann auch Suchfehler auslösen, wobei der Mechanismus umstritten ist (Topál et al., 2009, 2010; Kis et al., 2012).

Der „Schuldblick“ folgte dem Schimpfen der Halter und nicht der Handlung der Hunde (Horowitz, 2009; Hecht et al., 2012; Ostojić et al., 2015). Bei Spürhunden veränderten falsche Überzeugungen der Hundeführer, wo Anzeigen gewertet wurden (Lit et al., 2011), doppelt verblindete Tests sind eine besonders wichtige methodische Kontrolle von Erwartungseffekten (Lazarowski et al., 2020; Johnen et al., 2017), Trainingserfolg hielt ihnen in einer Studie nicht stand (Elliker et al., 2014), Automatisierung kann den Menschen aus der Entscheidung nehmen (Aviles-Rosa et al., 2021), und die Trefferquote im Einsatz hängt stark vom Kontext ab (Jezierski et al., 2014). Im Training dominierten Gesten oft über Wörter, besonders bei fremden Personen (D'Aniello et al., 2016; Scandurra et al., 2017).

12. Forschungslücken und kritische Einordnung

12.1 Kleine Stichproben und einzelne Labore

Viele zentrale Studien sind klein: ein Pferd (Pfungst, 1911), 14 Hunde im Schuldblick-Experiment (Horowitz, 2009), 12 in der Aufmerksamkeitsstudie (Call et al., 2003), 16 in der Studie im häuslichen Umfeld (Schwab & Huber, 2006), 12 in der automatischen Anordnung (Aviles-Rosa et al., 2021), 18 Teams in der Studie zu Überzeugungen der Hundeführer (Lit et al., 2011) und 10 Hunde in der Krebsstudie, von denen 3 die zweite Stufe erreichten (Elliker et al., 2014). Mehrere Befunde stammen aus einem einzigen Labor, und an der A-nicht-B-Replikation waren Mitglieder des ursprünglichen Teams beteiligt (Kis et al., 2012). Dem Feld insgesamt wurden überhöhte Effektgrößen und kleine Stichproben vorgeworfen (Farrar et al., 2020; Bensky et al., 2013).

12.2 Nullergebnisse gelten nur für die Aufgabe

Die beruhigenden Ergebnisse zu Überzeugungen von Haltern stammen aus kurzen Zeigeaufgaben mit zwei Wahlmöglichkeiten und einem auffälligen Signal der Versuchsleitung (Schmidjell et al., 2012; Hegedüs et al., 2013). Sie zeigen nicht, dass Halter keinen Einfluss haben, wenn es kein klares Signal gibt, bei längeren Einheiten, wenn die eigene Information des Hundes mehrdeutig ist, oder bei Beurteilungen außerhalb des Labors. Der mögliche Einfluss der zeigenden Versuchsleitung selbst wurde nicht untersucht.

12.3 Die menschliche Seite wird selten gemessen

Nur wenige Studien erfassen Blick, Haltung, Bewegung und Timing der beteiligten Menschen und setzen sie in Bezug zu den Reaktionen des Hundes. Es ist daher unklar, welche menschlichen Verhaltensweisen die Information tragen und ob Menschen lernen können, sie zu unterdrücken. Die Studie zu Überzeugungen der Hundeführer konnte nicht trennen, ob Hunde auf Signale der Hundeführer reagierten oder ob Hundeführer die Hunde falsch lasen (Lit et al., 2011).

12.4 Spezialisierte Populationen

Die Studien zu Gesten nutzten Wasserrettungs- und Arbeitshunde (D'Aniello et al., 2016; Scandurra et al., 2017); die Spürhundestudien nutzten Suchteams, Polizeihunde aus einem einzigen nationalen System oder unerfahrene Hunde aus Tierheimen und Tierschutz im Labor (Lit et al., 2011; Jezierski et al., 2014; Aviles-Rosa et al., 2021); die Kognitionsstudien nutzten Familienhunde, deren Halter sich freiwillig meldeten. Die Übertragung auf Familienhunde ist für die Mechanismen plausibel, für die Größe der Effekte aber unsicher.

12.5 Umstrittene Mechanismen

Beim A-nicht-B-Fehler ist der jeweilige Anteil kommunikativer Empfänglichkeit und einfacherer Aufmerksamkeitsprozesse weiter umstritten, und die ursprünglichen Autoren beschreiben eine Kombination von Faktoren (Topál et al., 2010). Beim Social Referencing ist unklar, wie weit Ergebnisse mit einem einzigen mehrdeutigen Gegenstand verallgemeinerbar sind (Merola et al., 2012b). Menschlicher Geruch beeinflusste Stressverhalten und kognitive Verzerrung bei Hunden (d'Aniello et al., 2018; Parr-Cortes et al., 2024), ob solche Signale aber zu Clever-Hans-Effekten in Kognitions- oder Suchaufgaben beitragen, wurde nicht geprüft.

12.6 Berichte zur Verblindung

Den Tests mit Spürhunden fehlten anerkannte Qualitätsstandards (Johnen et al., 2017), und die Feldstudie mit Polizeihunden berichtete nicht, ob die Hundeführer verblindet waren (Jezierski et al., 2014). Würde berichtet, wer was wusste, wer die Reaktionen bewertete und ob Kontrollen ohne Ziel eingesetzt wurden, ließe sich das Risiko unbeabsichtigter Hilfen leichter einschätzen.

13. Fazit

Der Fall des Klugen Hans beschrieb einen Mechanismus, der für Hunde besonders gilt: Ein Tier, das Menschen sehr aufmerksam beobachtet, kann eine Aufgabe lösen, indem es diejenigen liest, die die Antwort kennen. Hunde verfolgen menschliche Aufmerksamkeit, Gesten und Bewegungen genau, sichtbares menschliches Verhalten kann ihre eigene Information übertrumpfen, und bei Spürhunden veränderten die Erwartungen der Hundeführer, wo Anzeigen gewertet wurden.

Dennoch steuerten die Überzeugungen von Haltern allein die Hunde in zwei kontrollierten Zeigestudien nicht messbar, und Hunde in doppelt verblindeten Aufbauten und in Feldtests lagen weit über dem Zufall. Die Lehre aus dem Klugen Hans ist methodisch, nicht skeptisch: Immer wenn es darauf ankommt, was ein Hund wirklich gelernt hat, muss der Test so aufgebaut sein, dass die anwesenden Menschen die Antwort nicht liefern können.

Wichtigste Erkenntnisse im Überblick

  • Der Clever-Hans-Effekt beschreibt Verhalten, das von unbeabsichtigten Signalen von Menschen gesteuert wird, die die Antwort kennen; Hans lag in 90 bis 100 % der Antworten richtig, wenn die fragende Person die Antwort kannte, und in höchstens 10 %, wenn nicht (Pfungst, 1911).

  • Hunde verfolgen menschliche Aufmerksamkeit, Blick, Körperausrichtung und Bewegung genau (Call et al., 2003; Schwab & Huber, 2006; Merola et al., 2012b).

  • Die Überzeugungen von Haltern allein veränderten die Wahlen der Hunde in zwei Zeigestudien nicht messbar, sichtbare menschliche Wahlen dagegen schon (Schmidjell et al., 2012; Hegedüs et al., 2013; Prato-Previde et al., 2008).

  • Der „Schuldblick“ folgt dem Schimpfen des Halters, nicht der Handlung des Hundes (Horowitz, 2009; Hecht et al., 2012).

  • Ganz ohne Zielgeruch veränderten falsche Überzeugungen der Hundeführer, wo Anzeigen gewertet wurden (Lit et al., 2011); doppelt verblindete Tests sind eine besonders wichtige methodische Kontrolle von Erwartungseffekten in der Spürhundeforschung (Lazarowski et al., 2020).

  • Gesten dominierten bei Widersprüchen oft über Wörter, besonders bei fremden Personen, doch nicht jeder Hund folgt immer der Körpersprache (D'Aniello et al., 2016; Scandurra et al., 2017).

  • Aussagen wie „Mein Hund versteht Wörter“ brauchen Tests, bei denen weder die Person, die das Signal gibt, noch die Person, die bewertet, die richtige Antwort kennt.

Quellen

Albuquerque, N., Guo, K., Wilkinson, A., Savalli, C., Otta, E., & Mills, D. (2016). Dogs recognize dog and human emotions. Biology Letters, 12(1), 20150883. https://doi.org/10.1098/rsbl.2015.0883

Aviles-Rosa, E. O., Gallegos, S. F., Prada-Tiedemann, P. A., & Hall, N. J. (2021). An automated canine line-up for detection dog research. Frontiers in Veterinary Science, 8, 775381. https://doi.org/10.3389/fvets.2021.775381

Bensky, M. K., Gosling, S. D., & Sinn, D. L. (2013). The world from a dog's point of view: A review and synthesis of dog cognition research. Advances in the Study of Behavior, 45, 209–406. https://doi.org/10.1016/B978-0-12-407186-5.00005-7

Call, J., Bräuer, J., Kaminski, J., & Tomasello, M. (2003). Domestic dogs (Canis familiaris) are sensitive to the attentional state of humans. Journal of Comparative Psychology, 117(3), 257–263. https://doi.org/10.1037/0735-7036.117.3.257

Concha, A., Mills, D. S., Feugier, A., Zulch, H., Guest, C., Harris, R., & Pike, T. W. (2014). Using sniffing behavior to differentiate true negative from false negative responses in trained scent-detection dogs. Chemical Senses, 39(9), 749–754. https://doi.org/10.1093/chemse/bju045

D'Aniello, B., Scandurra, A., Alterisio, A., Valsecchi, P., & Prato-Previde, E. (2016). The importance of gestural communication: A study of human–dog communication using incongruent information. Animal Cognition, 19(6), 1231–1235. https://doi.org/10.1007/s10071-016-1010-5

d'Aniello, B., Semin, G. R., Alterisio, A., Aria, M., & Scandurra, A. (2018). Interspecies transmission of emotional information via chemosignals: From humans to dogs (Canis lupus familiaris). Animal Cognition, 21(1), 67–78. https://doi.org/10.1007/s10071-017-1139-x

Elliker, K. R., Sommerville, B. A., Broom, D. M., Neal, D. E., Armstrong, S., & Williams, H. C. (2014). Key considerations for the experimental training and evaluation of cancer odour detection dogs: Lessons learnt from a double-blind, controlled trial of prostate cancer detection. BMC Urology, 14, 22. https://doi.org/10.1186/1471-2490-14-22

Farrar, B. G., Boeckle, M., & Clayton, N. S. (2020). Replications in comparative cognition: What should we expect and how can we improve? Animal Behavior and Cognition, 7(1), 1–22. https://doi.org/10.26451/abc.07.01.02.2020

Gácsi, M., Miklósi, Á., Varga, O., Topál, J., & Csányi, V. (2004). Are readers of our face readers of our minds? Dogs (Canis familiaris) show situation-dependent recognition of human's attention. Animal Cognition, 7(3), 144–153. https://doi.org/10.1007/s10071-003-0205-8

Hare, B., Brown, M., Williamson, C., & Tomasello, M. (2002). The domestication of social cognition in dogs. Science, 298(5598), 1634–1636. https://doi.org/10.1126/science.1072702

Hecht, J., Miklósi, Á., & Gácsi, M. (2012). Behavioral assessment and owner perceptions of behaviors associated with guilt in dogs. Applied Animal Behaviour Science, 139(1–2), 134–142. https://doi.org/10.1016/j.applanim.2012.02.015

Hegedüs, D., Bálint, A., Miklósi, Á., & Pongrácz, P. (2013). Owners fail to influence the choices of dogs in a two-choice, visual pointing task. Behaviour, 150(3–4), 427–443. https://doi.org/10.1163/1568539X-00003060

Horowitz, A. (2009). Disambiguating the "guilty look": Salient prompts to a familiar dog behaviour. Behavioural Processes, 81(3), 447–452. https://doi.org/10.1016/j.beproc.2009.03.014

Jezierski, T., Adamkiewicz, E., Walczak, M., Sobczyńska, M., Górecka-Bruzda, A., Ensminger, J., & Papet, E. (2014). Efficacy of drug detection by fully-trained police dogs varies by breed, training level, type of drug and search environment. Forensic Science International, 237, 112–118. https://doi.org/10.1016/j.forsciint.2014.01.013

Johnen, D., Heuwieser, W., & Fischer-Tenhagen, C. (2017). An approach to identify bias in scent detection dog testing. Applied Animal Behaviour Science, 189, 1–12. https://doi.org/10.1016/j.applanim.2017.01.001

Kaminski, J., Hynds, J., Morris, P., & Waller, B. M. (2017). Human attention affects facial expressions in domestic dogs. Scientific Reports, 7, 12914. https://doi.org/10.1038/s41598-017-12781-x

Kis, A., Topál, J., Gácsi, M., Range, F., Huber, L., Miklósi, Á., & Virányi, Z. (2012). Does the A-not-B error in adult pet dogs indicate sensitivity to human communication? Animal Cognition, 15(4), 737–743. https://doi.org/10.1007/s10071-012-0481-2

Lazarowski, L., Krichbaum, S., DeGreeff, L. E., Simon, A., Singletary, M., Angle, C., & Waggoner, L. P. (2020). Methodological considerations in canine olfactory detection research. Frontiers in Veterinary Science, 7, 408. https://doi.org/10.3389/fvets.2020.00408

Lit, L., Schweitzer, J. B., & Oberbauer, A. M. (2011). Handler beliefs affect scent detection dog outcomes. Animal Cognition, 14(3), 387–394. https://doi.org/10.1007/s10071-010-0373-2

Marshall-Pescini, S., Prato-Previde, E., & Valsecchi, P. (2011). Are dogs (Canis familiaris) misled more by their owners than by strangers in a food choice task? Animal Cognition, 14(1), 137–142. https://doi.org/10.1007/s10071-010-0340-y

Merola, I., Prato-Previde, E., & Marshall-Pescini, S. (2012a). Dogs' social referencing towards owners and strangers. PLOS ONE, 7(10), e47653. https://doi.org/10.1371/journal.pone.0047653

Merola, I., Prato-Previde, E., & Marshall-Pescini, S. (2012b). Social referencing in dog-owner dyads? Animal Cognition, 15(2), 175–185. https://doi.org/10.1007/s10071-011-0443-0

Ostojić, L., Tkalčić, M., & Clayton, N. S. (2015). Are owners' reports of their dogs' "guilty look" influenced by the dogs' action and evidence of the misdeed? Behavioural Processes, 111, 97–100. https://doi.org/10.1016/j.beproc.2014.12.010

Parr-Cortes, Z., Müller, C. T., Talas, L., Mendl, M., Guest, C., & Rooney, N. J. (2024). The odour of an unfamiliar stressed or relaxed person affects dogs' responses to a cognitive bias test. Scientific Reports, 14(1), 15843. https://doi.org/10.1038/s41598-024-66147-1

Pfungst, O. (1911). Clever Hans (the horse of Mr. von Osten): A contribution to experimental animal and human psychology (C. L. Rahn, Trans.). Henry Holt.

Prato-Previde, E., Marshall-Pescini, S., & Valsecchi, P. (2008). Is your choice my choice? The owners' effect on pet dogs' (Canis lupus familiaris) performance in a food choice task. Animal Cognition, 11(1), 167–174. https://doi.org/10.1007/s10071-007-0102-7

Range, F., Heucke, S. L., Gruber, C., Konz, A., Huber, L., & Virányi, Z. (2009). The effect of ostensive cues on dogs' performance in a manipulative social learning task. Applied Animal Behaviour Science, 120(3–4), 170–178. https://doi.org/10.1016/j.applanim.2009.05.012

Scandurra, A., Alterisio, A., Marinelli, L., Mongillo, P., Semin, G. R., & D'Aniello, B. (2017). Effectiveness of verbal and gestural signals and familiarity with signal-senders on the performance of working dogs. Applied Animal Behaviour Science, 191, 78–83. https://doi.org/10.1016/j.applanim.2017.02.003

Schmidjell, T., Range, F., Huber, L., & Virányi, Z. (2012). Do owners have a Clever Hans effect on dogs? Results of a pointing study. Frontiers in Psychology, 3, 558. https://doi.org/10.3389/fpsyg.2012.00558

Schwab, C., & Huber, L. (2006). Obey or not obey? Dogs (Canis familiaris) behave differently in response to attentional states of their owners. Journal of Comparative Psychology, 120(3), 169–175. https://doi.org/10.1037/0735-7036.120.3.169

Topál, J., Gergely, G., Erdőhegyi, Á., Csibra, G., & Miklósi, Á. (2009). Differential sensitivity to human communication in dogs, wolves, and human infants. Science, 325(5945), 1269–1272. https://doi.org/10.1126/science.1176960

Topál, J., Miklósi, Á., Sümegi, Z., & Kis, A. (2010). Response to comments on "Differential sensitivity to human communication in dogs, wolves, and human infants." Science, 329(5988), 142. https://doi.org/10.1126/science.1184152

Udell, M. A. R., Dorey, N. R., & Wynne, C. D. L. (2008). Wolves outperform dogs in following human social cues. Animal Behaviour, 76(6), 1767–1773. https://doi.org/10.1016/j.anbehav.2008.07.028

Für Trainerinnen und Trainer

Lehrbuch Hundetraining

284 Seiten über Lernverhalten, Ausdrucksverhalten, Rassegeschichte und die Berufspraxis mit Kunden – dasselbe Fundament, auf dem unsere Trainerakademie aufbaut.

Zum Buch Alle Lernangebote