Sycophantie : pourquoi votre IA est trop d'accord avec vous
Faites le test : exposez une opinion discutable à votre chatbot préféré et demandez-lui ce qu'il en pense. Il validera, reformulera votre position en mieux, et glissera une micro-nuance par politesse. Ce comportement porte un nom, la sycophantie, et il coûte cher aux entreprises qui utilisent l'IA pour préparer leurs décisions. Voici comment le neutraliser avec une simple skill Claude d'une centaine de lignes.
Votre IA est de votre avis (et c'est un problème)
Un LLM utilisé comme interlocuteur de réflexion devient une chambre d'écho de luxe : vos idées vous reviennent, mieux formulées, avec un vernis d'objectivité qui les rend encore plus convaincantes. Pour vous.
Le danger est là. Vous prenez de l'assurance sans prendre de la justesse. Pour un dirigeant de PME qui teste une stratégie de prix, prépare une négociation ou valide un investissement avec ChatGPT ou Claude, ce biais transforme un outil d'aide à la décision en machine à confirmer ses intuitions.
J'avais posé le socle du problème dans une précédente édition de la newsletter : la facilité des réponses immédiates affaiblit notre jugement personnel. Mais il y a un étage de plus : ce n'est pas seulement qu'on délègue trop. C'est que ce à quoi on délègue nous renvoie notre propre reflet.
La sycophantie, un biais documenté depuis 2023
La sycophantie, c'est la tendance d'un modèle à dire à l'utilisateur ce qu'il veut entendre plutôt que ce qui est juste : valider ses opinions, s'ajuster au point de vue détecté dans la question, abandonner une réponse correcte dès qu'on la conteste.
Ce n'est pas un bug. C'est une conséquence directe de l'entraînement par préférences humaines (RLHF) : les évaluateurs préfèrent les réponses agréables, le modèle apprend que flatter rapporte. Anthropic l'a documenté dès 2023 sur tous les assistants de l'époque.
L'épisode le plus parlant : en avril 2025, OpenAI a dû retirer en urgence une mise à jour de GPT-4o devenue si flagorneuse qu'elle félicitait chaleureusement des décisions absurdes. Le correctif a pris quelques jours ; le biais de fond, lui, est toujours là, partout, à un niveau plus discret.
Et l'actualité récente le rappelle : avec le lancement de Claude Fable 5, le débat sur les comportements invisibles des modèles a repris de plus belle. Flatter ou filtrer silencieusement, la question est la même : le modèle a des comportements que vous ne voyez pas.
Rodin : transformer Claude en sparring partner intellectuel
Rendons à César : Rodin est l'œuvre de Benjamin Code, qui l'a présenté dans cette vidéo et partagé le fichier complet en gist.
Concrètement, c'est une skill Claude d'environ 100 lignes qui transforme l'IA en sparring partner intellectuel : pas un assistant, pas un coach, pas un thérapeute. Quelqu'un qui vous respecte assez pour vous contredire. La règle fondatrice tient en une phrase : « Tu ne dois JAMAIS valider une position simplement parce que l'utilisateur la défend. »
Trois mécanismes structurent la skill :
1. L'anti-complaisance. D'accord avec vous ? Rodin doit le justifier avec des arguments indépendants des vôtres. Pas d'accord ? Il le dit frontalement. Avec un garde-fou élégant : après trois validations de suite, il doit s'arrêter et chercher activement ce qui cloche.
2. Le steelmanning systématique. Avant de critiquer une position, Rodin la reconstruit dans sa version la plus forte et la plus charitable. Si vous caricaturez un argument adverse, il vous le dit : « Tu attaques un homme de paille. »
3. La classification des affirmations. Chaque point important reçoit sa catégorie : juste, contestable, simplification, angle mort, ou faux. Vous ne recevez plus un avis global flou, mais une cartographie de votre raisonnement, point par point.
Comment l'installer en 5 minutes
Le fichier complet est sur le gist de Benjamin Code : un clic sur « Raw », copiez tout. Créez un dossier rodin dans votre répertoire de skills Claude, collez le contenu dans un fichier SKILL.md, c'est tout. Si la mécanique des skills est nouvelle pour vous, notre guide complet des skills vous prend par la main.
Pas sur Claude ? Le fichier fonctionne presque tel quel ailleurs : collez son contenu dans les instructions d'un GPT personnalisé (ChatGPT) ou d'un agent Copilot. L'esprit survit très bien au déménagement.
Pour aller plus loin, ajoutez une section décrivant vos biais connus et vos schémas récurrents. Rodin l'utilisera quand un biais semble déguisé en raisonnement objectif. C'est la partie la plus inconfortable, et la plus utile.
Et si vous ne voulez pas installer de skill, retenez au moins ce prompt d'une ligne, à glisser dans toute conversation où vous défendez une position : « Steelmane la position adverse avant de me répondre. »
Ce que ça change concrètement en entreprise
Chez MAIjin, nous avons intégré ce type de dispositif dans nos formations. Lors d'un récent mandat pour les cadres d'une entreprise industrielle, la démo en live a fait son effet : la même question posée à Claude standard, puis avec Rodin. D'un côté la validation enthousiaste habituelle ; de l'autre, une reformulation de la thèse, la meilleure version de la position adverse, et deux angles morts pointés. C'est le moment où les participants comprennent physiquement ce que « biais de complaisance » veut dire.
Les trois familles d'usage qui reviennent le plus souvent chez les 150+ organisations que nous avons accompagnées : préparer une conversation difficile ou une négociation, tester une conviction avant d'y investir du temps ou de l'argent, et relire une décision quand quelque chose gratte.
Trois limites à garder en tête, honnêtement. La sycophantie est dans les poids du modèle, pas seulement dans le prompt : Rodin la réduit fortement, il ne l'élimine pas. La contradiction n'est pas la vérité : Rodin peut contredire avec aplomb et se tromper, il teste votre raisonnement mais ne remplace pas la vérification des faits. Et c'est exigeant : ce n'est pas l'outil pour brainstormer un nom de produit, c'est l'outil pour les sujets où se tromper coûte cher.
🔑 Ce qu'il faut retenir
- •Par défaut, un LLM est une chambre d'écho : il valide, reformule, et vous renvoie vos idées en mieux dit.
- •Ce biais s'appelle la sycophantie ; il est documenté depuis 2023 et touche tous les modèles du marché.
- •Pour les décisions à fort enjeu, c'est un risque réel : vous prenez de l'assurance sans prendre de la justesse.
- •Une skill gratuite d'une centaine de lignes, Rodin, suffit à inverser la posture : anti-complaisance, steelmanning, classification des affirmations.
- •Le seul coût, c'est l'inconfort. C'est aussi le produit.
Envie de garder une longueur d'avance sur l'IA en entreprise ?
Chaque semaine, je décortique un outil, une notion et un cas d'usage concret dans L'hebdo de MAIjin, déjà suivi par 5 800+ abonnés.
Articles recommandés
AI brain fry : pourquoi j'éteins l'IA le matin (méthode)
AI brain fry : 14 % d'effort mental en plus, productivité en chute. Ma méthode en 3 règles pour rester efficace avec l'IA en 2026.
Skills IA : le guide complet pour automatiser vos tâches métier
Découvrez comment créer des skills IA pour automatiser vos tâches métier. Guide complet avec exemples concrets pour PME suisses et françaises.