ai-agents-for-beginners

Agentic RAG

(Cliquez sur l’image ci-dessus pour voir la vidéo de cette leçon)

Agentic RAG

Cette leçon offre un aperçu complet de l’Agentic Retrieval-Augmented Generation (Agentic RAG), un paradigme émergent de l’IA où de grands modèles de langage (LLM) planifient de manière autonome leurs prochaines étapes tout en extrayant des informations de sources externes. Contrairement aux modèles statiques de récupération-puis-lecture, l’Agentic RAG implique des appels itératifs au LLM, entrecoupés d’appels à des outils ou fonctions et de sorties structurées. Le système évalue les résultats, affine les requêtes, sollicite des outils supplémentaires si nécessaire, et poursuit ce cycle jusqu’à obtenir une solution satisfaisante.

Introduction

Cette leçon couvrira

Objectifs d’apprentissage

Après avoir terminé cette leçon, vous saurez/comment comprendre :

Qu’est-ce que l’Agentic RAG ?

L’Agentic Retrieval-Augmented Generation (Agentic RAG) est un paradigme émergent de l’IA où de grands modèles de langage (LLM) planifient de manière autonome leurs prochaines étapes tout en extrayant des informations de sources externes. Contrairement aux schémas statiques de récupération-puis-lecture, l’Agentic RAG implique des appels itératifs au LLM, entrecoupés d’appels à des outils ou fonctions et de sorties structurées. Le système évalue les résultats, affine les requêtes, sollicite des outils supplémentaires si nécessaire, et poursuit ce cycle jusqu’à obtenir une solution satisfaisante. Ce style itératif de type « maker-checker » améliore la justesse, gère les requêtes mal formées, et garantit des résultats de haute qualité.

Le système maîtrise activement son processus de raisonnement, réécrivant les requêtes échouées, choisissant différentes méthodes de récupération et intégrant plusieurs outils — tels que la recherche vectorielle dans Azure AI Search, les bases de données SQL, ou des API personnalisées — avant de finaliser sa réponse. Ce qui distingue un système agentic est sa capacité à maîtriser son propre raisonnement. Les mises en œuvre traditionnelles de RAG reposent sur des chemins pré-définis, mais un système agentic détermine de façon autonome la séquence des étapes en fonction de la qualité des informations qu’il trouve.

Définition de l’Agentic Retrieval-Augmented Generation (Agentic RAG)

L’Agentic Retrieval-Augmented Generation (Agentic RAG) est un paradigme émergent dans le développement de l’IA où les LLM non seulement extraient des informations de sources de données externes, mais planifient également de manière autonome leurs prochaines étapes. Contrairement aux schémas statiques de récupération-puis-lecture ou aux séquences de prompts soigneusement scriptées, l’Agentic RAG implique une boucle d’appels itératifs au LLM, entrecoupés d’appels à des outils ou fonctions et de sorties structurées. À chaque étape, le système évalue les résultats obtenus, décide s’il faut affiner ses requêtes, fait appel à des outils supplémentaires si nécessaire, et poursuit ce cycle jusqu’à atteindre une solution satisfaisante.

Ce style itératif d’opération « maker-checker » est conçu pour améliorer la justesse, gérer les requêtes mal formées vers des bases de données structurées (ex. NL2SQL), et garantir des résultats équilibrés et de haute qualité. Plutôt que de se fier uniquement à des chaînes de prompts soigneusement conçues, le système maîtrise activement son processus de raisonnement. Il peut réécrire les requêtes qui échouent, choisir différentes méthodes de récupération, et intégrer plusieurs outils — tels que la recherche vectorielle dans Azure AI Search, les bases de données SQL, ou des API personnalisées — avant de finaliser sa réponse. Cela élimine le besoin de cadres d’orchestration excessivement complexes. À la place, une boucle relativement simple de « appel LLM → utilisation d’outil → appel LLM → … » peut produire des résultats sophistiqués et bien étayés.

Agentic RAG Core Loop

Maîtriser le processus de raisonnement

Ce qui distingue un système « agentic » est sa capacité à maîtriser son processus de raisonnement. Les implémentations traditionnelles de RAG dépendent souvent d’un chemin pré-défini par des humains pour le modèle : une chaîne de pensée qui indique quoi récupérer et quand. Mais lorsqu’un système est vraiment agentic, il décide en interne comment aborder le problème. Il n’exécute pas simplement un script ; il détermine de manière autonome la séquence des étapes en fonction de la qualité des informations qu’il trouve. Par exemple, si on lui demande de créer une stratégie de lancement de produit, il ne se fie pas uniquement à un prompt qui détaille tout le processus de recherche et de prise de décision. Au lieu de cela, le modèle agentic décide de manière indépendante de :

  1. Récupérer des rapports actuels sur les tendances du marché en utilisant Bing Web Grounding
  2. Identifier les données pertinentes des concurrents via Azure AI Search.
  3. Corréler les métriques internes historiques de ventes via Azure SQL Database.
  4. Synthétiser les résultats dans une stratégie cohérente orchestrée via Azure OpenAI Service.
  5. Évaluer la stratégie pour détecter des lacunes ou incohérences, puis lancer un autre cycle de récupération si nécessaire. Toutes ces étapes — affiner les requêtes, choisir les sources, itérer jusqu’à être « satisfait » de la réponse — sont décidées par le modèle, pas scriptées à l’avance par un humain.

Boucles itératives, intégration d’outils, et mémoire

Tool Integration Architecture

Un système agentic repose sur un modèle d’interaction bouclée :

Au fil du temps, cela crée une compréhension évolutive, permettant au modèle de gérer des tâches complexes en plusieurs étapes sans qu’un humain doive constamment intervenir ou reformuler le prompt.

Gestion des modes d’échec et autocorrection

L’autonomie de l’Agentic RAG inclut aussi des mécanismes robustes d’autocorrection. Lorsque le système rencontre des impasses — comme récupérer des documents non pertinents ou rencontrer des requêtes mal formées — il peut :

Cette approche itérative et dynamique permet au modèle de s’améliorer continuellement, assurant qu’il ne s’agit pas simplement d’un système à exécution unique mais d’un système apprenant de ses erreurs durant une session donnée.

Self Correction Mechanism

Limites de l’agence

Malgré son autonomie dans une tâche, l’Agentic RAG n’est pas équivalent à une Intelligence Artificielle Générale. Ses capacités « agentic » se limitent aux outils, sources de données et politiques fournies par des développeurs humains. Il ne peut pas inventer ses propres outils ni sortir des limites du domaine définies. Au contraire, il excelle à orchestrer dynamiquement les ressources disponibles. Les différences clés avec des formes d’IA plus avancées incluent :

  1. Autonomie spécifique au domaine : Les systèmes Agentic RAG sont axés sur la réalisation d’objectifs définis par l’utilisateur dans un domaine connu, employant des stratégies telles que la réécriture de requêtes ou la sélection d’outils pour améliorer les résultats.
  2. Dépendance à l’infrastructure : Les capacités du système dépendent des outils et des données intégrés par les développeurs. Il ne peut pas dépasser ces limites sans intervention humaine.
  3. Respect des garde-fous : Les lignes directrices éthiques, les règles de conformité et les politiques d’entreprise restent très importantes. La liberté de l’agent est toujours contrainte par des mesures de sécurité et des mécanismes de supervision (espérons-le ?)

Cas d’usage pratiques et valeur

L’Agentic RAG brille dans les scénarios nécessitant un affinage itératif et de la précision :

  1. Environnements axés sur la justesse : Lors de vérifications de conformité, analyses réglementaires ou recherches juridiques, le modèle agentic peut vérifier les faits à plusieurs reprises, consulter plusieurs sources, et réécrire les requêtes jusqu’à fournir une réponse rigoureusement validée.
  2. Interactions complexes avec des bases de données : Lorsqu’il s’agit de données structurées où les requêtes échouent souvent ou nécessitent des ajustements, le système peut affiner de manière autonome ses requêtes avec Azure SQL ou Microsoft Fabric OneLake, garantissant que la récupération finale correspond à l’intention de l’utilisateur.
  3. Flux de travail étendus : Les sessions de longue durée peuvent évoluer à mesure que de nouvelles informations apparaissent. L’Agentic RAG peut intégrer continuellement de nouvelles données, ajustant ses stratégies à mesure qu’il en apprend davantage sur le problème.

Gouvernance, transparence et confiance

À mesure que ces systèmes deviennent plus autonomes dans leur raisonnement, la gouvernance et la transparence sont cruciales :

Disposer d’outils offrant un enregistrement clair des actions est essentiel. Sans cela, déboguer un processus en plusieurs étapes peut être très difficile. Voici un exemple tiré de Literal AI (l’entreprise derrière Chainlit) pour une exécution d’agent :

AgentRunExample

Conclusion

L’Agentic RAG représente une évolution naturelle dans la façon dont les systèmes d’IA gèrent des tâches complexes et gourmandes en données. En adoptant un modèle d’interaction bouclée, en sélectionnant de manière autonome des outils, et en affinant les requêtes jusqu’à obtenir un résultat de haute qualité, le système dépasse le simple suivi statique de prompts pour devenir un décideur plus adaptatif et conscient du contexte. Bien qu’encore limité par des infrastructures et des directives éthiques définies par l’humain, ces capacités agentic permettent des interactions IA plus riches, plus dynamiques et au final plus utiles tant pour les entreprises que pour les utilisateurs finaux.

Vous avez d’autres questions sur l’Agentic RAG ?

Rejoignez le Microsoft Foundry Discord pour rencontrer d’autres apprenants, assister aux heures de bureau et obtenir des réponses à vos questions sur les agents IA.

Ressources supplémentaires

Articles académiques

Test rapide de cet agent (optionnel)

Après avoir appris à déployer des agents dans Leçon 16, vous pouvez faire un test rapide du TravelRAGAgent de cette leçon — en vérifiant que ses réponses restent bien ancrées dans la base de connaissances — avec tests/lesson-05-smoke-tests.json. Voir tests/README.md pour comment l’exécuter.

Leçon précédente

Modèle d’utilisation d’outil

Leçon suivante

Construire des agents IA fiables


Avertissement : Ce document a été traduit à l’aide du service de traduction automatique Co-op Translator. Bien que nous nous efforçions d’assurer l’exactitude, veuillez noter que les traductions automatisées peuvent contenir des erreurs ou des inexactitudes. Le document original dans sa langue native doit être considéré comme la source faisant autorité. Pour les informations critiques, il est recommandé de recourir à une traduction professionnelle réalisée par un humain. Nous ne saurions être tenus responsables des malentendus ou erreurs d’interprétation découlant de l’utilisation de cette traduction.