La plupart des outils présentés ci-dessous proposent un niveau gratuit (free tier) suffisant pour expérimenter et apprendre. Vérifiez les conditions d’utilisation de chaque plateforme, car les offres gratuites évoluent régulièrement. Pour un usage intensif ou en production, des abonnements payants sont généralement nécessaires.
Interfaces conversationnelles
Ces interfaces vous permettent d’interagir directement avec les grands modèles de langage sans écrire une seule ligne de code. Elles sont idéales pour explorer les capacités des LLM, tester des prompts et comprendre les comportements des modèles.ChatGPT
L’interface conversationnelle d’OpenAI, donnant accès aux modèles GPT-6 Astra et GPT-5.6, avec un niveau gratuit et des abonnements Plus/Team pour les fonctionnalités avancées.
Claude
L’assistant d’Anthropic basé sur les modèles Claude Fable 5.1, Opus 5, Sonnet 5 et Haiku 4.5, reconnu pour ses longues fenêtres de contexte et sa sécurité renforcée.
Gemini
L’interface conversationnelle de Google donnant accès aux modèles Gemini, avec des capacités multi-modales natives et une intégration à l’écosystème Google.
Mistral Le Chat
Le chatbot de Mistral AI, startup française proposant des modèles ouverts et fermés compétitifs, particulièrement performants en français.
APIs et modèles
Pour intégrer les capacités des LLM directement dans vos applications, scripts ou expérimentations techniques, ces APIs offrent un accès programmatique aux modèles les plus puissants.OpenAI API
L’API d’OpenAI donne accès à GPT-6 Astra, GPT-5.6, Whisper et DALL·E, avec une documentation complète et une large communauté de développeurs.
Anthropic API
L’API d’Anthropic expose les modèles Claude Fable 5.1, Opus 5, Sonnet 5 et Haiku 4.5, avec des capacités de contexte étendu (jusqu’à 1 million de tokens pour Fable 5.1, Opus 5 et Sonnet 5) et un focus sur la sécurité et l’alignement.
Google AI Studio
Plateforme de prototypage gratuite de Google permettant d’accéder aux modèles Gemini, de tester des prompts et d’obtenir des clés API pour intégration.
Mistral API
L’API de Mistral AI propose des modèles ouverts et optimisés (Mistral Small, Mistral Large 3, Devstral), avec une tarification compétitive et une conformité RGPD.
Groq
Groq propose une inférence ultra-rapide de modèles open-source (Llama, Mixtral, Gemma) grâce à ses puces LPU dédiées, idéale pour des prototypes nécessitant de la réactivité.
DeepSeek API
L’API de DeepSeek donne accès à DeepSeek V4, un modèle à poids ouverts publié sous licence MIT, avec une fenêtre de contexte native d’1 million de tokens et une tarification très compétitive.
Moonshot AI (Kimi)
L’API de Moonshot AI donne accès à Kimi K3, un modèle chinois à poids ouverts publié sous licence Modified MIT en juillet 2026, avec une fenêtre de contexte native de 1 048 576 tokens et une vision native.
Hugging Face Inference API
La plateforme Hugging Face permet d’accéder à des milliers de modèles open-source via une API unifiée, avec hébergement, fine-tuning et déploiement intégrés. Elle héberge par exemple les poids de Muse Glimmer, le modèle local ouvert publié par Meta en août 2026.
Frameworks de développement IA
Ces bibliothèques et frameworks facilitent la construction d’applications complexes basées sur les LLM, en fournissant des abstractions pour les chaînes de prompts, la mémoire, les outils et les agents.LangChain
Le framework le plus populaire pour construire des applications LLM : chaînes de prompts, agents, mémoire, intégration d’outils et connecteurs pour des dizaines de providers.
LlamaIndex
Spécialisé dans l’ingestion, la structuration et l’interrogation de données pour les LLM, LlamaIndex est la référence pour construire des pipelines RAG robustes.
Haystack
Framework open-source de deepset pour construire des pipelines NLP et RAG modulaires, avec un fort accent sur la recherche d’information et les applications en production.
Microsoft Agent Framework
Le SDK de Microsoft pour construire des agents et des workflows multi-agents en .NET ou en Python, en version stable depuis avril 2026. Il unifie et remplace Semantic Kernel et AutoGen, désormais en mode maintenance.
Outils RAG et bases vectorielles
Les bases de données vectorielles stockent les embeddings et permettent des recherches de similarité sémantique à grande échelle, composante indispensable des architectures RAG.Pinecone
Base de données vectorielle cloud managée, reconnue pour sa scalabilité et sa facilité d’intégration, avec un niveau gratuit pour les projets exploratoires.
Weaviate
Base vectorielle open-source avec capacités de recherche hybride (vectorielle + BM25), proposant des versions cloud managée et auto-hébergée.
Chroma
Base vectorielle open-source légère et simple à utiliser, idéale pour le prototypage local de systèmes RAG avec Python sans infrastructure complexe.
Qdrant
Moteur de recherche vectorielle open-source haute performance écrit en Rust, offrant des filtres avancés, une API REST/gRPC et un déploiement cloud ou on-premise.
Plateformes d’évaluation et de testing
Tester, surveiller et évaluer les performances de vos pipelines LLM en production est essentiel. Ces outils vous aident à observer, déboguer et améliorer vos applications.Microsoft Foundry
La plateforme de Microsoft (ex-Azure AI Foundry) pour développer, évaluer et déployer des agents et applications LLM. Elle prend le relais de PromptFlow, dont les nouvelles fonctionnalités se sont arrêtées en avril 2026 avant un retrait complet prévu en 2027.
LangSmith
Plateforme de débogage et d’observabilité de LangChain permettant de tracer, évaluer et monitorer les chaînes et agents LLM en développement comme en production.
Helicone
Proxy d’observabilité open-source pour les APIs LLM offrant logging, monitoring des coûts, analyse des performances et gestion du cache en quelques lignes de code.
Braintrust
Plateforme d’évaluation continue pour les applications LLM, permettant de comparer des prompts, modèles et pipelines sur des jeux de données métier réels.
Environnements de développement
Ces environnements facilitent l’expérimentation avec les LLM, que vous préfériez les notebooks interactifs ou les éditeurs de code augmentés par l’IA.Google Colab
Environnement de notebooks Jupyter hébergé dans le cloud par Google, offrant un accès gratuit à des GPU et pré-installant la plupart des bibliothèques Python IA.
Jupyter
L’environnement de notebooks interactifs de référence pour la data science et l’expérimentation IA, disponible localement ou via JupyterHub en entreprise.
Cursor
Éditeur de code basé sur VS Code intégrant nativement des LLM pour la complétion, l’explication et la modification du code, idéal pour développer des applications IA.
VS Code + GitHub Copilot
L’extension GitHub Copilot transforme VS Code en environnement de développement assisté par IA, avec complétion de code, génération de tests et chat contextuel.