ai-agents-for-beginners

Agentic RAG

(Klikk på bildet ovenfor for å se video av denne leksjonen)

Agentic RAG

Denne leksjonen gir en omfattende oversikt over Agentic Retrieval-Augmented Generation (Agentic RAG), et nytt AI-paradigme der store språkmodeller (LLMs) selvstendig planlegger sine neste steg mens de henter informasjon fra eksterne kilder. I motsetning til statiske hent-og-les-mønstre involverer Agentic RAG iterative kall til LLM, blandet med verktøy- eller funksjonskall og strukturerte utdata. Systemet evaluerer resultater, forbedrer spørsmål, kaller opp flere verktøy ved behov og fortsetter denne syklusen til en tilfredsstillende løsning er oppnådd.

Introduksjon

Denne leksjonen vil dekke

Læringsmål

Etter å ha fullført denne leksjonen vil du kunne/forstå:

Hva er Agentic RAG?

Agentic Retrieval-Augmented Generation (Agentic RAG) er et nytt AI-paradigme der store språkmodeller (LLMs) selvstendig planlegger sine neste steg mens de henter informasjon fra eksterne kilder. I motsetning til statiske hent-og-les-mønstre involverer Agentic RAG iterative kall til LLM, blandet med verktøy- eller funksjonskall og strukturerte utdata. Systemet evaluerer resultater, forbedrer spørsmål, kaller opp flere verktøy ved behov og fortsetter denne syklusen til en tilfredsstillende løsning er oppnådd. Denne iterative “maker-checker”-stilen forbedrer korrekthet, håndterer feilformulerte spørsmål og sikrer høy kvalitet på resultatene.

Systemet eier aktivt sin resonneringsprosess, omskriver mislykkede spørsmål, velger andre hente-metoder og integrerer flere verktøy—slik som vektorsøk i Azure AI Search, SQL-databaser eller tilpassede API-er—før det avslutter svaret. Den avgjørende kvaliteten til et agentisk system er dets evne til å eie sin resonneringsprosess. Tradisjonelle RAG-implementasjoner er avhengige av forhåndsdefinerte veier, men et agentisk system bestemmer sekvensen av steg autonomt basert på kvaliteten av informasjonen det finner.

Definere Agentic Retrieval-Augmented Generation (Agentic RAG)

Agentic Retrieval-Augmented Generation (Agentic RAG) er et nytt paradigme innen AI-utvikling hvor LLM-er ikke bare henter informasjon fra eksterne datakilder, men også autonomt planlegger sine neste steg. I motsetning til statiske hent-og-les-mønstre eller nøye skriptede promptsekvenser involverer Agentic RAG en løkke av iterative kall til LLM, blandet med verktøy- eller funksjonskall og strukturerte utdata. Ved hvert steg evaluerer systemet resultatene det har fått, bestemmer om det skal forbedre spørsmålene, kaller opp flere verktøy ved behov og fortsetter denne syklusen til en tilfredsstillende løsning er oppnådd.

Denne iterative “maker-checker”-operasjonen er designet for å forbedre korrekthet, håndtere feilformulerte spørsmål mot strukturerte databaser (f.eks. NL2SQL), og sikre balanserte, høykvalitetsresultater. Istedenfor å bare stole på nøye konstruerte promptkjeder eier systemet aktivt sin resonneringsprosess. Det kan omskrive spørsmål som mislykkes, velge ulike hente-metoder og integrere flere verktøy—som vektorsøk i Azure AI Search, SQL-databaser eller tilpassede API-er—før det avslutter svaret. Dette fjerner behovet for overkompliserte orkestreringsrammeverk. Isteden kan en relativt enkel løkke av “LLM-kall → verktøybruk → LLM-kall → …” gi sofistikerte og godt funderte utdata.

Agentic RAG Core Loop

Eie resonnementprosessen

Den avgjørende kvaliteten som gjør et system “agentisk” er dets evne til å eie sin resonneringsprosess. Tradisjonelle RAG-implementasjoner er ofte avhengige av at mennesker forhåndsdefinerer en sti for modellen: en kjede av tanker som beskriver hva som skal hentes og når. Men når et system er virkelig agentisk, bestemmer det internt hvordan det skal nærme seg problemet. Det utfører ikke bare et skript; det bestemmer autonomt sekvensen av steg basert på kvaliteten av informasjonen det finner. For eksempel, hvis det blir bedt om å lage en produktlanseringsstrategi, stoler det ikke bare på en prompt som forklarer hele forsknings- og beslutningsprosessen. Isteden bestemmer den agentiske modellen selvstendig å:

  1. Hente oppdaterte markedsrapportrapporter ved bruk av Bing Web Grounding
  2. Identifisere relevant konkurrentdata ved bruk av Azure AI Search.
  3. Korrelere historiske interne salgsmetrikker ved bruk av Azure SQL Database.
  4. Syntetisere funnene til en sammenhengende strategi orkestrert via Azure OpenAI Service.
  5. Evaluere strategien for hull eller inkonsistenser, og eventuelt initiere en ny runde med søk. Alle disse stegene—forbedring av spørsmål, valg av kilder, iterering til den er “fornøyd” med svaret—bestemmes av modellen, ikke forhåndsskriptet av et menneske.

Iterative løkker, verktøyintegrasjon og minne

Tool Integration Architecture

Et agentisk system baserer seg på et løkkebasert interaksjonsmønster:

Over tid skaper dette en følelse av utviklende forståelse, som gjør at modellen kan navigere komplekse, flerstegsoppgaver uten at et menneske trenger å gripe inn eller omforme prompten konstant.

Håndtering av feilmoduser og selvkorrigering

Agentisk RAGs autonomi inkluderer også robuste selvkorrigeringsmekanismer. Når systemet støter på blindveier—som å hente irrelevante dokumenter eller møte feilformulerte spørsmål—kan det:

Denne iterative og dynamiske tilnærmingen gjør at modellen kontinuerlig kan forbedre seg, og sikrer at den ikke bare er et engangssystem, men et som lærer av sine feil under en gitt økt.

Self Correction Mechanism

Agentgrensesnitt

Til tross for sin autonomi innen en oppgave, er Agentic RAG ikke analogt til kunstig generell intelligens. Dets “agentiske” egenskaper er begrenset til verktøyene, datakildene og retningslinjene som er gitt av menneskelige utviklere. Det kan ikke oppfinne egne verktøy eller gå utenfor domenets grenser som er satt. Det utmerker seg heller i dynamisk orkestrering av ressursene det har. Viktige forskjeller fra mer avanserte AI-former inkluderer:

  1. Domenespesifikk autonomi: Agentic RAG-systemer fokuserer på å oppnå brukerdefinerte mål innenfor et kjent domene, og benytter strategier som omskriving av spørsmål eller valg av verktøy for å forbedre resultater.
  2. Infrastrukturavhengighet: Systemets evner er avhengig av verktøyene og dataene utviklerne har integrert. Det kan ikke overskride disse grensene uten menneskelig inngripen.
  3. Respekt for sikkerhetsrammer: Etiske retningslinjer, samsvarsregler og bedriftsretningslinjer er fortsatt svært viktige. Agentens frihet er alltid begrenset av sikkerhetstiltak og overvåkningsmekanismer (forhåpentligvis?)

Praktiske bruksområder og verdi

Agentic RAG utmerker seg i situasjoner som krever iterativ forbedring og presisjon:

  1. Korrekthet-først-miljøer: I samsvarssjekker, regulatoriske analyser eller juridisk forskning kan den agentiske modellen gjentatte ganger verifisere fakta, konsultere flere kilder og omskrive spørsmål til den leverer et grundig gjennomgått svar.
  2. Komplekse databaseinteraksjoner: Når man håndterer strukturerte data hvor spørringer ofte kan feile eller trenge justering, kan systemet selvstendig forbedre sine spørringer ved bruk av Azure SQL eller Microsoft Fabric OneLake, og sikre at endelig henting stemmer med brukerens intensjon.
  3. Utvidede arbeidsflyter: Lengre økter kan utvikle seg ettersom ny informasjon dukker opp. Agentic RAG kan kontinuerlig inkorporere ny data, skifte strategier etter hvert som det lærer mer om problemområdet.

Styring, transparens og tillit

Ettersom disse systemene blir mer autonome i sitt resonnement, er styring og transparens avgjørende:

Å ha verktøy som gir klar oversikt over handlinger er avgjørende. Uten dem kan det være svært vanskelig å feilsøke en flerstegsprosess. Se følgende eksempel fra Literal AI (selskapet bak Chainlit) for en Agent-kjøring:

AgentRunExample

Konklusjon

Agentic RAG representerer en naturlig utvikling i hvordan AI-systemer håndterer komplekse, dataintensive oppgaver. Ved å adoptere et løkkebasert interaksjonsmønster, autonomt velge verktøy og forbedre spørsmål til et høykvalitetsresultat oppnås, beveger systemet seg utover statisk følg-prompt inn i en mer adaptiv, kontekstbevisst beslutningstaker. Selv om det fortsatt er bundet av menneskeskapt infrastruktur og etiske retningslinjer, gir disse agentiske evnene rikere, mer dynamiske og i siste instans mer nyttige AI-interaksjoner for både virksomheter og sluttbrukere.

Har du flere spørsmål om Agentic RAG?

Bli med i Microsoft Foundry Discord for å møte andre lærende, delta på kontortid og få svar på dine spørsmål om AI-agenter.

Tilleggsressurser

Akademiske Artikler

Røyk-testing av denne agenten (valgfritt)

Etter at du har lært å distribuere agenter i Lesson 16, kan du røyk-teste TravelRAGAgent i denne leksjonen — for å sjekke at svarene holder seg forankret i kunnskapsbasen — med tests/lesson-05-smoke-tests.json. Se tests/README.md for hvordan du kjører det.

Forrige leksjon

Designmønster for verktøybruk

Neste leksjon

Bygge pålitelige AI-agenter


Ansvarsfraskrivelse: Dette dokumentet er oversatt ved hjelp av AI-oversettelsestjenesten Co-op Translator. Selv om vi streber etter nøyaktighet, vær oppmerksom på at automatiske oversettelser kan inneholde feil eller unøyaktigheter. Det opprinnelige dokumentet på originalspråket skal betraktes som den autoritative kilden. For kritisk informasjon anbefales profesjonell menneskelig oversettelse. Vi er ikke ansvarlige for eventuelle misforståelser eller feiltolkninger som oppstår ved bruk av denne oversettelsen.