Le biais de confirmation : pourquoi nous cherchons surtout à avoir raison
Sommaire
Nous ne cherchons pas nos informations au hasard : nous allons regarder là où notre idée de départ prédit quelque chose, et nous y trouvons en général ce que nous attendions. C'est ce que recouvre le biais de confirmation, et il coûte surtout cher à ceux qui, au travail, évaluent quelqu'un, recrutent ou arbitrent un désaccord avec des informations incomplètes. Ses différentes formes n'ont pas la même solidité, et les procédés qui l'atténuent sont plus modestes que leur réputation.
Le moment où l'on cesse de chercher
Prenons un exemple fictif mais courant. Une responsable d'équipe accueille un nouveau collaborateur. La troisième semaine, il rend un dossier incomplet, et elle se forme une idée : il n'est pas très fiable. À partir de là, quelque chose change sans qu'elle en décide rien. Les retards de ce collaborateur deviennent visibles, ceux des autres restent du bruit de fond, et un travail livré à l'heure ne compte pas comme une information puisque c'était ce qui était attendu. Six mois plus tard, son dossier est solide, daté, documenté, et elle a raison. Ce qu'elle ne peut pas voir, c'est le dossier tout aussi fourni qu'elle aurait constitué si elle avait conclu, la troisième semaine, qu'il était prometteur.
Le biais de confirmation désigne la tendance à rechercher et à traiter l'information d'une manière partiale envers une croyance, une attente ou une hypothèse que l'on tient déjà. C'est la définition que retient Raymond Nickerson dans la synthèse qu'il publie en 1998 dans la Review of General Psychology, où il en recense les formes dans la science, la médecine, la justice et la vie ordinaire.
De l'intérieur, on ne se sent pas en train de filtrer : on se sent en train d'observer. C'est ce qui rend ce biais si difficile à corriger par la seule bonne volonté.
Trois nombres, et une découverte durable
En 1960, dans le Quarterly Journal of Experimental Psychology, le psychologue britannique Peter Wason publie une expérience devenue un classique. Il annonce à ses participants qu'il a en tête une règle produisant des séries de trois nombres, et leur en donne un exemple conforme : 2, 4, 6. Ils doivent deviner la règle en proposant autant de séries qu'ils veulent, et il leur dit à chaque fois si leur proposition obéit ou non à la règle. Celle-ci était très large : trois nombres croissants.
Presque tous formulent une hypothèse plus étroite (les nombres augmentent de deux en deux), puis testent des séries qui obéissent à leur propre hypothèse : 8, 10, 12, puis 20, 22, 24. Ils reçoivent des « oui » en série, se sentent confortés, et annoncent une règle fausse. Sur les vingt-neuf étudiants de l'étude, six seulement ont annoncé la bonne règle sans en avoir proposé une fausse auparavant.
Wason a poursuivi avec la tâche de sélection qui porte son nom. Quatre cartes sont posées sur une table : E, K, 4, 7. Chacune porte une lettre sur une face et un chiffre sur l'autre. La règle à tester est « si une carte porte une voyelle d'un côté, elle porte un nombre pair de l'autre », et il faut désigner les cartes à retourner, et seulement celles-là, pour savoir si la règle est fausse. La bonne réponse est E et 7 : un chiffre impair derrière le E démentirait la règle, une voyelle derrière le 7 aussi. Le K et le 4 ne peuvent rien démentir.
Dans les versions abstraites, une petite minorité de participants seulement donne cette combinaison. Mais l'erreur typique n'est pas de retourner le E, qui fait partie de la bonne réponse et sert précisément à chercher une réfutation : elle consiste à oublier le 7, et souvent à lui préférer le 4, qui ne teste rien. Le résultat ne se ramène donc pas à une recherche de confirmation. Evans et Lynch ont montré dès 1973, dans le British Journal of Psychology, qu'une partie du choix s'explique par la simple correspondance entre les termes énoncés dans la règle et les symboles visibles sur les cartes, indépendamment de toute logique. Et la performance dépend énormément de l'habillage : Richard Griggs et James Cox ont obtenu en 1982, dans la même revue, des taux de réussite bien supérieurs en habillant le même problème d'une règle familière sur l'âge autorisé pour consommer de l'alcool.
Test positif ou test négatif ? Vérifier une hypothèse en examinant les cas où elle prédit quelque chose, c'est un test positif. Aller chercher les cas où elle devrait échouer, c'est un test négatif. Le second est souvent bien plus informatif, et nettement moins spontané.
Un travail de Joshua Klayman et Young-Won Ha, publié en 1987 dans Psychological Review, a modifié la lecture de ces résultats. Selon eux, les participants de Wason ne cherchaient pas à se donner raison : ils appliquaient une stratégie de test positif, c'est-à-dire qu'ils regardaient là où leur hypothèse annonçait quelque chose. Cette stratégie n'a rien d'absurde : quand les régularités sont partielles et l'information coûteuse, elle est souvent rentable. Elle échoue dans un cas précis : quand l'hypothèse envisagée est plus étroite que la réalité, ce qui était exactement le piège tendu par 2, 4, 6.
Cette nuance oriente tout le reste. Le biais de confirmation n'est pas d'abord un défaut moral ou un manque de rigueur ; c'est la facture d'un raccourci qui rend service le reste du temps, et il opère d'autant mieux chez des gens attentifs que ceux-ci argumentent bien.

Une famille de phénomènes, pas un mécanisme unique
Parler « du » biais de confirmation au singulier entretient une confusion : l'expression recouvre au moins trois choses, dont les preuves n'ont pas la même solidité.
La recherche sélective d'information
C'est la branche la mieux documentée. Une méta-analyse conduite par William Hart et ses collègues, parue en 2009 dans Psychological Bulletin, a réuni les études où l'on laisse les participants choisir entre des documents qui soutiennent leur position et des documents qui la contestent. La préférence pour l'information favorable existe bel et bien, et son ampleur est modérée. Elle s'accentue quand l'opinion touche aux valeurs de la personne, et elle diminue quand celle-ci a une vraie raison d'être exacte plutôt que rassurée.
L'interprétation biaisée d'une preuve ambiguë
En 1979, dans le Journal of Personality and Social Psychology, Charles Lord, Lee Ross et Mark Lepper ont soumis à des partisans et à des adversaires de la peine de mort deux études fictives, l'une favorable à l'effet dissuasif, l'autre défavorable, aux méthodes équivalentes. Chaque camp a trouvé convaincante l'étude qui l'arrangeait et démonté la méthodologie de l'autre. Ce résultat, l'assimilation biaisée, a été retrouvé sur bien d'autres sujets. La seconde conclusion des auteurs, selon laquelle une preuve commune écarte encore davantage les positions, a suscité des discussions plus vives : la polarisation y était mesurée par ce que les participants déclaraient eux-mêmes de leur évolution, et elle n'apparaît pas systématiquement dans les travaux ultérieurs. La première conclusion, elle, tient : un même document ne pèse pas le même poids selon ce que l'on pensait avant de le lire.
La mémoire sélective
C'est la branche la plus fragile, et c'est précisément celle que la vulgarisation affirme le plus volontiers. Alice Eagly et ses collègues ont publié en 1999, dans le Psychological Bulletin, une méta-analyse des travaux sur la mémorisation de messages conformes ou contraires aux opinions des participants. Le résultat déçoit l'intuition : l'avantage de mémoire pour l'information favorable est faible et inconstant, et il était plus marqué dans les études anciennes, dont les méthodes contrôlaient moins bien le codage des réponses. Une explication avancée est que l'on traite parfois plus profondément ce qui nous contrarie, justement parce qu'on cherche à le réfuter.
Quand votre collègue et vous vous souvenez différemment d'une réunion, l'explication la mieux étayée n'est donc pas que chacun a retenu ce qui l'arrangeait. C'est que chacun a écouté, compris et jugé cette réunion à partir de ce qu'il croyait avant d'y entrer.
Où on le rencontre vraiment au travail
Trois situations professionnelles concentrent l'essentiel des dégâts.
L'évaluation d'une personne, d'abord, comme dans l'exemple d'ouverture : la logique du test positif s'y déploie sans effort, on ne ment pas et on ne cherche pas non plus. Le même mécanisme joue à l'envers avec quelqu'un que l'on apprécie, et produit une indulgence tout aussi peu fondée.
Le recrutement, ensuite. Un entretien libre ne commence jamais à zéro : il commence après la lecture du CV, avec une impression déjà constituée. Mark Snyder et William Swann ont montré dès 1978, dans le Journal of Personality and Social Psychology, que des participants chargés de vérifier si leur interlocuteur était extraverti choisissaient surtout des questions dont une réponse positive confirmerait l'extraversion, et l'inverse quand l'hypothèse portait sur l'introversion. L'interprétation a été contestée : Gün Semin et Fritz Strack ont objecté en 1980, dans l'European Journal of Social Psychology, que choisir une question assortie à l'hypothèse relève peut-être d'une convention de conversation plus que d'un biais, et Yaacov Trope et Miriam Bassok ont montré en 1982, dans la même revue que Snyder et Swann, que les participants préfèrent les questions capables de départager deux hypothèses quand on les leur propose. La leçon pratique se déplace plus qu'elle ne s'affaiblit : c'est le format de l'entretien qui décide, davantage que la bonne volonté de qui le mène.
Les études de Jason Dana, Robyn Dawes et Nathanial Peterson, publiées en 2013 dans Judgment and Decision Making, l'illustrent durement. Des étudiants devaient prédire la moyenne du semestre suivant d'autres étudiants, à partir de leurs résultats passés, avec ou sans entretien préalable. Dans l'une des conditions, la personne interrogée répondait au hasard, selon un procédé que l'interviewer ignorait. Ceux qui avaient mené ces entretiens dépourvus de sens les ont jugés aussi instructifs que les vrais, sans écart mesurable ; leurs prédictions, elles, étaient plus justes sans entretien qu'avec. Dans une autre étude, un nouvel échantillon, à qui les auteurs décrivaient simplement les conditions de l'expérience, a classé l'entretien aléatoire devant l'absence d'entretien, à une courte majorité. Le constat rejoint la ré-estimation des outils de sélection publiée par Paul Sackett et ses collègues en 2022 dans le Journal of Applied Psychology : l'entretien structuré, avec des questions fixées à l'avance et une grille commune, s'y classe nettement devant l'entretien libre.
Le désaccord, enfin. Dans un conflit d'équipe, chacun arrive avec une lecture des faits et trouve dans la réunion de quoi la soutenir : le même événement, lu depuis deux hypothèses différentes.

Ce que le biais de confirmation n'est pas
Deux précisions évitent d'en faire un mot passe-partout.
Ce n'est pas toujours un défaut. Une organisation où chacun remettrait tout en question en permanence ne produirait rien. Le test positif fait gagner du temps dans la plupart des situations ; il coûte cher dans une minorité d'entre elles, celles où l'on juge une personne, où la décision engage longtemps, et où l'information contraire ne viendra pas d'elle-même se signaler.
Ce n'est pas non plus l'explication de tous les désaccords. Attribuer au biais de confirmation l'avis d'un collègue est un moyen commode de ne pas examiner son argument, et c'est encore une manière de se donner raison. Ce biais s'observe utilement sur soi, rarement sur autrui.
Ce qui réduit l'effet, et dans quelle mesure
Les procédés qui fonctionnent un peu ont un point commun : ils ne demandent pas d'être objectif, ils changent la question que l'on se pose.
Le premier consiste à chercher explicitement ce qui vous donnerait tort. Charles Lord, Mark Lepper et Elizabeth Preston ont montré en 1984, dans le Journal of Personality and Social Psychology, que demander à des participants d'envisager le résultat opposé réduisait l'assimilation biaisée, là où la consigne d'être juste et impartial n'y parvenait pas. La version professionnelle du procédé est simple : avant de valider une décision, écrivez ce qu'il faudrait observer pour y renoncer. Sa variante la plus utile consiste à traiter l'hypothèse inverse comme une candidate sérieuse, non pas « suis-je certaine qu'il n'est pas fiable ? », mais « si je devais démontrer qu'il est fiable, quels éléments aurais-je déjà sous la main ? ». Ce que ces exercices donnent hors du laboratoire est moins assuré : la revue systématique de Ramona Ludolph et Peter Schulz, parue en 2018 dans Medical Decision Making, recense quatre-vingt-sept études de débiaisage, dont une majorité obtient au moins un résultat partiel, et désigne le transfert aux décisions réelles comme la principale faiblesse de cette littérature.
Le deuxième consiste à écrire ses critères avant de voir les candidats, les offres ou les résultats. Un critère formulé après coup s'ajuste à ce que l'on avait déjà envie de conclure ; écrit avant, il devient une contrainte que l'on peut encore contourner, mais plus sans le remarquer.
Le troisième consiste à faire juger indépendamment. Deux personnes qui évaluent séparément puis comparent produisent de l'information ; deux personnes qui évaluent ensemble produisent un accord. Dans un recrutement, cela veut dire poser les mêmes questions à tout le monde, noter chaque réponse avant de passer à la suivante, et ne discuter qu'ensuite.

En résumé
- Le biais de confirmation désigne une façon partiale de chercher, de lire et de retenir l'information, sans intention de tromper.
- Depuis Klayman et Ha, on l'explique surtout par une stratégie de test positif : nous vérifions là où notre hypothèse prédit quelque chose, ce qui marche souvent et échoue quand l'hypothèse est trop étroite.
- Ses trois branches n'ont pas la même solidité : la recherche sélective d'information est bien établie, l'interprétation biaisée aussi, la mémoire sélective est faible et inconstante.
- Les remèdes efficaces sont procéduraux : critères écrits avant, questions identiques pour tous, évaluations indépendantes, recherche explicite de ce qui vous donnerait tort.
- L'exercice a du sens appliqué à soi ; utilisé pour disqualifier l'avis d'autrui, il devient une forme de plus du même biais.
Et si vous êtes concerné(e) ?
Repérer ses propres angles morts se fait mal seul, puisqu'ils sont aveugles de l'intérieur. Si vous encadrez une équipe, que vous recrutez ou que vous arbitrez des désaccords, un regard extérieur aide à distinguer ce que vous avez observé de ce que vous aviez décidé d'avance. C'est un des axes d'un coaching en leadership et management.
Pour aller plus loin, vous pouvez lire L'effet Dunning-Kruger : comment la surestimation de ses compétences peut nuire à votre carrière, qui traite d'un autre écart entre ce que l'on croit savoir et ce que l'on sait, et Pourquoi résistons-nous au changement : les mécanismes psychologiques en jeu, où l'on voit comment une conviction installée organise la lecture de ce qui arrive.
Aucun des procédés décrits ici ne demande de changer d'avis : ils demandent seulement d'écrire ce que l'on attend avant d'aller regarder.