ai-agents-for-beginners

Agentic RAG

(Klicka på bilden ovan för att se videon av denna lektion)

Agentic RAG

Den här lektionen ger en omfattande översikt över Agentic Retrieval-Augmented Generation (Agentic RAG), ett framväxande AI-paradigm där stora språkmodeller (LLMs) självständigt planerar sina nästa steg medan de hämtar information från externa källor. Till skillnad från statiska mönster med hämtning-och-läs, innebär Agentic RAG iterativa anrop till LLM, växlat med verktygs- eller funktionsanrop och strukturerade utgångar. Systemet utvärderar resultat, förfinar frågor, anropar ytterligare verktyg vid behov och fortsätter denna cykel tills en tillfredsställande lösning nås.

Introduktion

Den här lektionen kommer att täcka

Lärandemål

Efter att ha slutfört denna lektion kommer du att kunna/förstå:

Vad är Agentic RAG?

Agentic Retrieval-Augmented Generation (Agentic RAG) är ett framväxande AI-paradigm där stora språkmodeller (LLMs) självständigt planerar sina nästa steg samtidigt som de hämtar information från externa källor. Till skillnad från statiska mönster med hämtning-och-läs, innebär Agentic RAG iterativa anrop till LLM, växlat med verktygs- eller funktionsanrop och strukturerade utgångar. Systemet utvärderar resultat, förfinar frågor, anropar ytterligare verktyg vid behov och fortsätter denna cykel tills en tillfredsställande lösning nås. Denna iterativa “maker-checker”-stil förbättrar korrekthet, hanterar felaktiga frågor och säkerställer högkvalitativa resultat.

Systemet äger aktivt sitt resonemangsprocess, skriver om misslyckade frågor, väljer olika hämtmetoder och integrerar flera verktyg – såsom vektorsökning i Azure AI Search, SQL-databaser eller anpassade API:er – innan det slutgiltiga svaret fastställs. Det som särskiljer ett agentiskt system är dess förmåga att äga sitt resonemangsprocess. Traditionella RAG-implementeringar förlitar sig på fördefinierade vägar, men ett agentiskt system bestämmer självständigt stegens ordning baserat på kvaliteten på informationen det hittar.

Definition av Agentic Retrieval-Augmented Generation (Agentic RAG)

Agentic Retrieval-Augmented Generation (Agentic RAG) är ett framväxande paradigm inom AI-utveckling där LLM inte bara hämtar information från externa datakällor utan även självständigt planerar sina nästa steg. Till skillnad från statiska mönster med hämtning-och-läs eller noggrant skriptade promptsekvenser, involverar Agentic RAG en loop av iterativa anrop till LLM, växlat med verktygs- eller funktionsanrop och strukturerade utdata. Vid varje steg utvärderar systemet de resultat det fått, beslutar om det ska förfina sina frågor, anropar ytterligare verktyg vid behov och fortsätter denna cykel tills det uppnår en tillfredsställande lösning.

Denna iterativa “maker-checker”-driftsstil är utformad för att förbättra korrekthet, hantera felaktiga frågor till strukturerade databaser (t.ex. NL2SQL) och säkerställa balanserade, högkvalitativa resultat. Istället för att enbart förlita sig på noggrant konstruerade promptkedjor, äger systemet aktivt sitt resonemangsprocess. Det kan skriva om frågor som misslyckas, välja olika hämtmetoder och integrera flera verktyg – såsom vektorsökning i Azure AI Search, SQL-databaser eller anpassade API:er – innan det slutgiltiga svaret fastställs. Detta eliminerar behovet av alltför komplexa orkestrationsramverk. Istället kan en relativt enkel loop av ”LLM-anrop → verktygsanvändning → LLM-anrop → …” ge sofistikerade och välgrundade utdata.

Agentic RAG Core Loop

Äga resonemangsprocessen

Den avgörande egenskapen som gör ett system “agentiskt” är dess förmåga att äga sitt resonemangsprocess. Traditionella RAG-implementeringar bygger ofta på att människor fördefinierar en väg för modellen: en tankekedja som beskriver vad som ska hämtas och när. Men när ett system verkligen är agentiskt, bestämmer det internt hur problem ska närmas. Det följer inte bara ett skript; det bestämmer självständigt sekvensen av steg baserat på kvaliteten på den information det hittar. Till exempel, om det blir ombett att skapa en produktlanseringsstrategi, förlitar det sig inte enbart på en prompt som beskriver hela forsknings- och beslutsgången. Istället bestämmer den agentiska modellen självständigt att:

  1. Hämta aktuella marknadstrendrapporter med hjälp av Bing Web Grounding
  2. Identifiera relevant konkurrentdata med Azure AI Search.
  3. Korrelera historiska interna försäljningsmått med Azure SQL Database.
  4. Syntetisera fynden till en sammanhängande strategi orkestrerad via Azure OpenAI Service.
  5. Utvärdera strategin för luckor eller inkonsekvenser, och om nödvändigt initiera en ny hämtning. Alla dessa steg — att förfina frågor, välja källor, iterera tills man är “nöjd” med svaret — beslutas av modellen, inte förhands-skriptade av en människa.

Iterativa loopar, verktygsintegration och minne

Tool Integration Architecture

Ett agentiskt system förlitar sig på ett loopat interaktionsmönster:

Över tid skapar detta en känsla av en utvecklande förståelse, vilket gör det möjligt för modellen att navigera komplexa, flerstegsuppgifter utan att en människa ständigt behöver ingripa eller omformulera prompten.

Hantering av felättestillstånd och självkorrektion

Agentic RAG:s autonomi innefattar också robusta självkorrektionsmekanismer. När systemet når återvändsgränder — till exempel att hämta irrelevanta dokument eller stöta på felaktiga frågor — kan det:

Detta iterativa och dynamiska tillvägagångssätt gör att modellen kan förbättras kontinuerligt, vilket säkerställer att det inte bara är ett engångssystem utan ett som lär sig av sina misstag under en session.

Self Correction Mechanism

Agentgränser

Trots sin autonomi inom en uppgift är Agentic RAG inte analogt med artificiell generell intelligens. Dess “agentiska” förmågor är begränsade till verktygen, datakällorna och policys som tillhandahålls av mänskliga utvecklare. Det kan inte uppfinna egna verktyg eller gå utanför de domängränser som satts upp. I stället utmärker det sig i att dynamiskt orkestrera de resurser som finns till hands. Viktiga skillnader från mer avancerade AI-former inkluderar:

  1. Domänspecifik autonomi: Agentic RAG-system är fokuserade på att uppnå användardefinierade mål inom en känd domän, och använder strategier som omskrivning av frågor eller val av verktyg för att förbättra resultat.
  2. Infrastrukturbunden: Systemets kapaciteter är beroende av de verktyg och data som integrerats av utvecklare. Det kan inte överskrida dessa gränser utan mänskligt ingripande.
  3. Respekt för skyddsbarriärer: Etiska riktlinjer, efterlevnadsregler och företagsregler är fortsatt mycket viktiga. Agentens frihet är alltid begränsad av säkerhetsåtgärder och övervakningsmekanismer (förhoppningsvis?).

Praktiska användningsfall och värde

Agentic RAG utmärker sig i scenarion som kräver iterativ förfining och precision:

  1. Miljöer med fokus på korrekthet: Vid efterlevnadskontroller, regulatorisk analys eller juridisk forskning kan den agentiska modellen upprepade gånger verifiera fakta, konsultera flera källor och skriva om frågor tills den producerar ett noga granskat svar.
  2. Komplexa databasintegrationer: Vid hantering av strukturerad data där frågor ofta kan misslyckas eller behöva justeras kan systemet självständigt förfina sina frågor med Azure SQL eller Microsoft Fabric OneLake, vilket säkerställer att slutlig hämtning stämmer överens med användarens avsikt.
  3. Förlängda arbetsflöden: Längre sessioner kan utvecklas efterhand som ny information dyker upp. Agentic RAG kan kontinuerligt införliva nya data och justera strategier när den lär sig mer om problemområdet.

Styrning, transparens och förtroende

Eftersom dessa system blir mer autonoma i sitt resonemang är styrning och transparens avgörande:

Att ha verktyg som ger en tydlig redovisning över åtgärder är avgörande. Utan dem kan det vara mycket svårt att felsöka en flerstegsprocess. Se följande exempel från Literal AI (företaget bakom Chainlit) för en Agentkörning:

AgentRunExample

Slutsats

Agentic RAG representerar en naturlig utveckling i hur AI-system hanterar komplexa, dataintensiva uppgifter. Genom att anta ett loopat interaktionsmönster, självständigt välja verktyg och förfina frågor tills ett högkvalitativt resultat uppnås rör sig systemet bortom statiskt promptföljande till en mer adaptiv, kontextmedveten beslutsfattare. Trots att den fortfarande är bunden av mänskligt definierade infrastrukturer och etiska riktlinjer, möjliggör dessa agentiska förmågor rikare, mer dynamiska och i slutändan mer användbara AI-interaktioner för både företag och slutanvändare.

Fler frågor om Agentic RAG?

Gå med i Microsoft Foundry Discord för att träffa andra elever, delta i office hours och få svar på dina frågor om AI-agenter.

Ytterligare resurser

Akademiska artiklar

Röktesta denna agent (valfritt)

Efter att du lärt dig att distribuera agenter i Lektion 16, kan du röktesta denna lektions TravelRAGAgent — för att kontrollera att dess svar förblir förankrade i kunskapsbasen — med tests/lesson-05-smoke-tests.json. Se tests/README.md för hur man kör det.

Föregående lektion

Designmönster för verktygsanvändning

Nästa lektion

Bygga pålitliga AI-agenter


Ansvarsfriskrivning: Detta dokument har översatts med hjälp av AI-översättningstjänsten Co-op Translator. Även om vi strävar efter noggrannhet, var vänlig notera att automatiska översättningar kan innehålla fel eller brister. Det ursprungliga dokumentet på dess modersmål bör betraktas som den auktoritativa källan. För kritisk information rekommenderas professionell mänsklig översättning. Vi ansvarar inte för några missförstånd eller feltolkningar som uppstår till följd av användningen av denna översättning.