Niveau : Avancé · Prérequis : RAG et retrieval · Temps de lecture : ~7 min
Qu’est-ce qu’un agent IA ?
Un agent IA est un système dans lequel un modèle de langage orchestre une séquence d’actions pour accomplir un objectif. Contrairement à une simple inférence, l’agent :- Perçoit son environnement (texte, données, résultats d’outils)
- Raisonne sur l’état actuel et les prochaines étapes à effectuer
- Agit en appelant des outils ou en prenant des décisions
- Observe les résultats et ajuste son plan en conséquence
La boucle agent : percevoir → raisonner → agir → observer
1
Percevoir
L’agent reçoit son entrée initiale : l’objectif défini par l’utilisateur, l’état actuel de l’environnement, les résultats des actions précédentes, et les outils disponibles avec leur description.
2
Raisonner
Le modèle analyse la situation et détermine l’action suivante. Cette étape peut inclure un raisonnement explicite (chain-of-thought) : l’agent explique son plan avant d’agir, ce qui améliore la fiabilité.
3
Agir
L’agent sélectionne un outil et formule un appel de fonction structuré (nom de l’outil + paramètres en JSON). Ce n’est pas encore une exécution : c’est une intention d’action que le système externe interprète et exécute.
4
Observer
Le résultat de l’exécution de l’outil est renvoyé au modèle sous forme de message. L’agent intègre cette nouvelle information dans son contexte et recommence la boucle jusqu’à ce que l’objectif soit atteint, ou jusqu’à ce qu’il décide de s’arrêter.
Function calling : comment le modèle appelle des fonctions
Le function calling (ou tool use) est le mécanisme technique qui permet à un modèle de signaler qu’il souhaite appeler une fonction externe. Voici comment cela fonctionne en pratique : 1. Définition des outils (envoyée au modèle avec le prompt) :MCP : le standard qui connecte les agents à leurs outils
Le function calling que vous venez de voir fonctionne, mais il a une limite pratique : chaque fournisseur de modèle définit son propre format de JSON pour décrire ses outils, et chaque connexion à une source de données externe (fichiers, base de données, dépôt Git, CRM) doit être recodée à la main pour chaque combinaison modèle/outil. Le Model Context Protocol (MCP) répond à ce problème. Lancé par Anthropic en novembre 2024, il s’est imposé en un peu plus d’un an comme le standard de facto pour connecter les modèles de langage à des outils et des sources de données externes : OpenAI, Google DeepMind, Microsoft et AWS l’ont tous adopté dans leurs propres produits. En décembre 2025, Anthropic en a transféré la gouvernance à l’Agentic AI Foundation, une fondation neutre hébergée par la Linux Foundation et co-fondée avec Block et OpenAI, pour que le protocole reste ouvert plutôt que contrôlé par une seule entreprise. Le 28 juillet 2026, l’équipe du protocole a publié la révision de spécification la plus importante depuis son lancement : le cœur du MCP devient stateless (la poignée de main d’initialisation et l’identifiant de session disparaissent, chaque requête se suffit désormais à elle-même), et l’autorisation s’aligne plus strictement sur les standards OAuth 2.1 et OpenID Connect. Vous pouvez voir le MCP comme un connecteur universel : plutôt que de développer une intégration sur mesure entre chaque modèle et chaque outil, un serveur MCP expose une seule fois ses fonctions, et n’importe quel client compatible (Claude, ChatGPT, un agent que vous construisez vous-même) peut s’y brancher sans code spécifique. Un serveur MCP peut exposer trois types de ressources à un agent :- des outils, des fonctions appelables comme celles vues dans le function calling (rechercher, écrire un fichier, interroger une API)
- des ressources, des données consultables (le contenu d’un fichier, les lignes d’une base de données, une page de documentation)
- des prompts prédéfinis, des modèles de requêtes réutilisables fournis par le serveur pour guider certaines tâches
Types d’outils disponibles
Recherche et information
Recherche web (Tavily, Brave Search), requêtes SQL, lecture de fichiers, appels d’APIs REST. Permettent à l’agent d’accéder à des informations en temps réel ou dans des systèmes externes.
Exécution de code
Interpréteur Python, exécution de scripts, calculs complexes, manipulation de données. L’agent peut écrire du code, l’exécuter et analyser les résultats, idéal pour l’analyse de données.
Actions système
Gestion de fichiers (lire, écrire, créer), navigation web (browser automation), envoi d’emails ou messages. Permettent à l’agent d’agir directement dans un environnement informatique.
Mémoire et contexte
Bases de données vectorielles (RAG), mémoire persistante entre sessions, gestion de l’état. Permettent à l’agent de mémoriser des informations sur le long terme et d’accéder à une base de connaissances.
Exemples d’agents en production
Assistant de recherche : reçoit une question complexe, décompose en sous-questions, effectue plusieurs recherches web, synthétise les résultats et rédige un rapport structuré avec sources. Agent de codage : lit un repository GitHub, comprend une issue, écrit le code de correction, exécute les tests unitaires, corrige les erreurs détectées et propose une pull request. Agent d’automatisation : reçoit un email client, classifie la demande, consulte le CRM, génère une réponse personnalisée, l’envoie et met à jour le ticket de support.Frameworks d’agents
- LangGraph (LangChain) : modélise les agents comme des graphes d’état, excellent pour les workflows complexes avec conditions et boucles
- Microsoft Agent Framework : SDK de Microsoft pour construire des agents et des workflows multi-agents, disponible en version stable depuis avril 2026. Il unifie et remplace AutoGen et Semantic Kernel, deux anciens frameworks de Microsoft désormais en mode maintenance
- CrewAI : orchestration d’équipes d’agents spécialisés avec rôles définis, particulièrement lisible et intuitif
Risques et précautions avec les agents autonomes
La puissance des agents est proportionnelle à leurs risques. Une architecture d’agent bien conçue commence toujours par définir explicitement ce que l’agent ne peut pas faire, avant de définir ce qu’il peut faire.Essayez maintenant : simulez une boucle d’agent
Copiez ce prompt dans votre outil IA préféré pour observer comment un modèle planifie une séquence d’appels d’outils, sans les exécuter réellement :Testez vos connaissances
Quiz : Le MCP remplace-t-il le function calling ?
Quiz : Le MCP remplace-t-il le function calling ?
Non. Le function calling reste le mécanisme bas niveau qui permet à un modèle de formuler un appel d’outil structuré. Le MCP est une couche de standardisation posée par-dessus : il définit comment un serveur d’outils expose ses fonctions de façon uniforme, pour qu’un même agent puisse se connecter à de nombreuses sources sans intégration sur mesure. Un client MCP utilise le function calling en coulisses, il ne s’y substitue pas.