Skip to main content
Niveau : Intermédiaire · Prérequis : Modèles de langage · Temps de lecture : ~4 min
Le context engineering est l’art de composer, organiser et optimiser toutes les informations transmises à un modèle de langage afin d’obtenir les réponses les plus pertinentes, cohérentes et utiles possible. Là où le prompt engineering se concentre sur la formulation d’une instruction précise, le context engineering adopte une vision plus large : il s’intéresse à l’ensemble de ce que le modèle perçoit à chaque appel, et donc à tout ce qui influence sa réponse.

Prompt engineering vs context engineering

Ces deux disciplines sont complémentaires mais distinctes. Le prompt engineering vous apprend à formuler une bonne question ; le context engineering vous apprend à préparer le bon environnement dans lequel cette question sera posée.

Ce qui compose le contexte

Le contexte d’un modèle n’est pas uniquement votre dernière question : c’est un assemblage structuré de plusieurs couches d’information, chacune jouant un rôle précis dans la compréhension du modèle.

Instructions système

Le message système (ou system prompt) définit le rôle, le ton, les contraintes et les objectifs permanents du modèle. C’est la fondation de tout contexte bien conçu.

Historique des messages

L’ensemble des échanges précédents dans la conversation en cours. Le modèle s’y réfère pour assurer la cohérence et éviter les répétitions.

Données injectées

Documents, extraits de bases de données, résultats de recherche ou sorties d’outils introduits dynamiquement dans le contexte pour enrichir la réponse.

Message utilisateur actuel

La requête immédiate de l’utilisateur. Elle prend tout son sens lorsqu’elle s’appuie sur les trois autres couches ci-dessus.
Ces quatre couches s’empilent dans la fenêtre de contexte avant chaque appel au modèle :
Les données injectées dans le contexte (documents, extraits de base de données, résultats d’outils) sont transmises telles quelles au fournisseur du modèle. Ne placez jamais d’informations confidentielles, de données personnelles sensibles ou de secrets (clés d’API, mots de passe) dans un contexte sans avoir vérifié au préalable la politique de traitement des données de votre fournisseur : ce qui entre dans la fenêtre de contexte peut, selon les conditions d’usage, être conservé au-delà de votre seule requête.

Le bureau de travail mental du modèle

Imaginez que la fenêtre de contexte est le bureau de travail du modèle. Tout ce qui n’est pas posé sur ce bureau est, pour lui, inexistant. Chaque token que vous placez sur ce bureau occupe de l’espace, et cet espace est limité. Un bon context engineer choisit soigneusement ce qu’il pose sur ce bureau : les documents vraiment pertinents, les instructions claires, l’historique utile, et laisse de côté tout ce qui encombre sans apporter de valeur.
Le contexte est une ressource partagée entre vous et le modèle. L’espace occupé par vos instructions et vos données est autant d’espace en moins pour la réponse générée. Concevoir un contexte efficace, c’est aussi préserver de la place pour que le modèle s’exprime pleinement.

Pourquoi le contexte est votre ressource la plus précieuse

La qualité d’une réponse générée par un LLM dépend directement de la qualité du contexte fourni. Un modèle ne peut pas inventer ce qu’il ne sait pas, mais il peut synthétiser, raisonner et adapter ce que vous lui donnez avec une remarquable efficacité. Voici pourquoi le contexte mérite toute votre attention :
  • Il détermine ce que le modèle “sait” pour la durée de l’échange
  • Il conditionne le ton et le style de la réponse via les instructions système
  • Il permet la continuité en maintenant l’historique des décisions et des échanges
  • Il injecte la connaissance métier que le modèle ne possède pas par défaut
Privilégiez toujours la qualité à la quantité. Un contexte de 500 tokens précis et bien structuré surpasse presque systématiquement un contexte de 5 000 tokens mal organisé. Supprimez ce qui est redondant, reformulez ce qui est ambigu, et structurez ce qui est complexe.

En résumé

Le context engineering est la discipline qui vous permet de tirer le meilleur parti des LLM en production. En maîtrisant ce qui entre dans la fenêtre de contexte (et en quelle proportion), vous passez de simples expériences en chat à de véritables systèmes d’IA fiables, cohérents et maintenables. Les sections suivantes vous guideront à travers les mécanismes concrets : la fenêtre de contexte, la gestion de la mémoire, et les stratégies d’injection de connaissances.

Testez vos connaissances

Non. Même si l’espace technique est suffisant, chaque token superflu dilue les informations réellement importantes et complique le travail du modèle pour identifier ce qui compte. C’est le principe du “bureau de travail” : un contexte encombré nuit à la clarté, même s’il tient sur le bureau. Mieux vaut un contexte court et pertinent qu’un contexte volumineux et bruité.