Qu’est-ce que le raisonnement en chaîne ?
Le Chain-of-Thought est une technique de prompting qui incite le modèle à produire une séquence d’étapes intermédiaires de raisonnement avant d’arriver à sa réponse finale. Plutôt que de demander directement « quelle est la réponse ? », vous demandez au modèle de montrer son cheminement. Cette approche a été formalisée dans un article de recherche de Google en 2022 (Chain-of-Thought Prompting Elicits Reasoning in Large Language Models), qui a démontré des améliorations spectaculaires sur des benchmarks de raisonnement mathématique et logique.Pourquoi “réfléchis étape par étape” améliore les réponses
Un LLM génère du texte token par token. Lorsqu’il produit directement une réponse chiffrée ou une conclusion, il n’a pas de « brouillon » : il s’engage sur une trajectoire dès le premier token. Le CoT change cela : en produisant un raisonnement intermédiaire visible, le modèle crée lui-même le contexte qui guide ses prochains tokens vers une conclusion plus juste.Le Chain-of-Thought est particulièrement efficace sur les grands modèles (GPT-4, Claude 3, Gemini Ultra…). Sur les modèles plus petits, il peut produire des raisonnements plausibles mais incorrects, ce qu’on appelle le « raisonnement confiant mais faux ». Vérifiez toujours les étapes intermédiaires sur les tâches critiques.
- Décomposer les problèmes multi-étapes en sous-problèmes gérables.
- Repérer ses propres erreurs en relisant son raisonnement au fil de la génération.
- Justifier ses conclusions, rendant les erreurs plus faciles à identifier et corriger.
CoT standard vs Zero-shot CoT
Il existe deux manières principales d’activer le raisonnement en chaîne.CoT standard (few-shot)
Vous fournissez des exemples qui incluent explicitement le raisonnement intermédiaire :Zero-shot CoT
Il suffit d’ajouter une phrase déclencheur à la fin de votre question. Les formulations les plus efficaces sont :Exemple pas à pas : résolution d’un problème
Voici comment un modèle guidé par CoT déroule un raisonnement logique. Prompt :1
Lister les informations connues
Le modèle identifie les relations explicites :
- Sophie < Thomas (Sophie est plus jeune que Thomas)
- Lucas < Thomas (Thomas est plus vieux que Lucas)
- Sophie < Lucas (Lucas est plus vieux que Sophie)
2
Établir un ordre partiel
En combinant les deux premières relations, on sait que Thomas est plus vieux à la fois que Sophie et que Lucas.
La troisième relation précise la position relative de Sophie et Lucas : Sophie < Lucas.
3
Reconstruire l'ordre complet
En combinant toutes les relations :
Sophie < Lucas < ThomasL’ordre complet du plus jeune au plus vieux est : Sophie, puis Lucas, puis Thomas.
4
Formuler la réponse finale
Thomas est le plus vieux des trois.Le raisonnement intermédiaire a permis d’éviter une erreur classique : confondre “Thomas est plus vieux que Lucas” avec “Lucas est le deuxième”.
Tree of Thought : aller au-delà du CoT linéaire
Le Tree of Thought (ToT) est une extension du CoT qui explore plusieurs branches de raisonnement en parallèle avant de choisir la plus prometteuse. Plutôt qu’une chaîne linéaire A → B → C, le modèle génère des alternatives à chaque étape et évalue leur pertinence.Self-consistency : voter entre plusieurs raisonnements
La self-consistency pousse le CoT encore plus loin : au lieu de demander un seul raisonnement, vous en demandez plusieurs (en relançant plusieurs fois la même requête avec une température élevée), puis vous sélectionnez la réponse finale par vote majoritaire.Quand utiliser le Chain-of-Thought ?
Le CoT n’est pas toujours nécessaire. Voici un guide pratique :
Le Chain-of-Thought est votre allié dès que la tâche requiert plusieurs étapes de déduction, de calcul ou d’analyse. Pour les tâches simples, la verbosité qu’il génère est souvent contre-productive.
