ai-agents-for-beginners

Agentic RAG

(Klik på billedet ovenfor for at se videoen til denne lektion)

Agentic RAG

Denne lektion giver en omfattende gennemgang af Agentic Retrieval-Augmented Generation (Agentic RAG), et fremvoksende AI-paradigme, hvor store sprogmodeller (LLM’er) autonomt planlægger deres næste skridt, mens de henter information fra eksterne kilder. I modsætning til statiske retrieval-then-read mønstre involverer Agentic RAG iterative kald til LLM’en, krydret med værktøjs- eller funktionskald og strukturerede output. Systemet evaluerer resultater, forfiner forespørgsler, aktiverer yderligere værktøjer efter behov og fortsætter denne cyklus, indtil en tilfredsstillende løsning er opnået.

Introduktion

Denne lektion vil dække

Læringsmål

Efter at have gennemført denne lektion vil du vide hvordan og forstå:

Hvad er Agentic RAG?

Agentic Retrieval-Augmented Generation (Agentic RAG) er et fremvoksende AI-paradigme, hvor store sprogmodeller (LLM’er) autonomt planlægger deres næste skridt, mens de henter information fra eksterne kilder. I modsætning til statiske retrieval-then-read mønstre involverer Agentic RAG iterative kald til LLM’en, krydret med værktøjs- eller funktionskald og strukturerede output. Systemet evaluerer resultater, forfiner forespørgsler, aktiverer yderligere værktøjer efter behov og fortsætter denne cyklus, indtil en tilfredsstillende løsning er opnået. Denne iterative “maker-checker” stil forbedrer korrekthed, håndterer fejlformulerede forespørgsler og sikrer resultater af høj kvalitet.

Systemet ejer aktivt sin ræsonneringsproces, omskriver fejlede forespørgsler, vælger forskellige hentemetoder og integrerer flere værktøjer – såsom vektorsøgning i Azure AI Search, SQL-databaser eller brugerdefinerede API’er – før det færdiggør sit svar. Den afgørende egenskab ved et agentisk system er dets evne til selvstændigt at eje sin ræsonneringsproces. Traditionelle RAG-implementeringer er afhængige af foruddefinerede veje, men et agentisk system bestemmer autonomt rækkefølgen af trin baseret på kvaliteten af den fundne information.

Definition af Agentic Retrieval-Augmented Generation (Agentic RAG)

Agentic Retrieval-Augmented Generation (Agentic RAG) er et fremvoksende paradigme inden for AI-udvikling, hvor LLM’er ikke kun henter information fra eksterne datakilder, men også autonomt planlægger deres næste skridt. I modsætning til statiske retrieval-then-read mønstre eller omhyggeligt udformede prompt-sekvenser involverer Agentic RAG en løkke af iterative kald til LLM’en, krydret med værktøjs- eller funktionskald og strukturerede output. Ved hvert trin evaluerer systemet de opnåede resultater, beslutter, om det skal forfine sine forespørgsler, aktiverer yderligere værktøjer efter behov og fortsætter denne cyklus, indtil det opnår en tilfredsstillende løsning.

Denne iterative “maker-checker” driftsstil er designet til at forbedre korrekthed, håndtere fejlformulerede forespørgsler til strukturerede databaser (fx NL2SQL) og sikre afbalancerede, resultater af høj kvalitet. I stedet for kun at stole på omhyggeligt designede promptkæder ejer systemet aktivt sin ræsonneringsproces. Det kan omskrive forespørgsler, der fejler, vælge forskellige hentemetoder og integrere flere værktøjer – såsom vektorsøgning i Azure AI Search, SQL-databaser eller brugerdefinerede API’er – før det færdiggør sit svar. Dette fjerner behovet for alt for komplekse orkestreringsrammer. I stedet kan en forholdsvis enkel løkke af “LLM-kald → værktøjsbrug → LLM-kald → …” skabe sofistikerede og godt funderede output.

Agentic RAG Core Loop

Eje ræsonneringsprocessen

Den afgørende egenskab, der gør et system “agentisk”, er dets evne til at eje sin ræsonneringsproces. Traditionelle RAG-implementeringer er ofte afhængige af, at mennesker foruddefinerer en sti for modellen: en tænke-kæde, der skitserer, hvad der skal hentes og hvornår. Men når et system er virkelig agentisk, beslutter det internt, hvordan det skal gribe problemet an. Det udfører ikke bare et script; det bestemmer autonomt rækkefølgen af trin baseret på kvaliteten af den information, det finder. For eksempel, hvis det bliver bedt om at skabe en produktlanceringsstrategi, stoler det ikke kun på en prompt, der beskriver hele forsknings- og beslutningsworkflowet. I stedet beslutter den agentiske model selvstændigt at:

  1. Hente aktuelle markedsrapportmaterialer via Bing Web Grounding
  2. Identificere relevante konkurrentdata via Azure AI Search.
  3. Koble historiske interne salgstal sammen via Azure SQL Database.
  4. Syntetisere fundene til en sammenhængende strategi orkestreret via Azure OpenAI Service.
  5. Evaluere strategien for mangler eller uoverensstemmelser, og starte endnu en runde med hentning om nødvendigt. Alle disse trin – forfine forespørgsler, vælge kilder, iterere indtil “tilfreds” med svaret – besluttes af modellen, ikke forudskrevet af et menneske.

Iterative løkker, værktøjsintegration og hukommelse

Tool Integration Architecture

Et agentisk system er afhængigt af et loopet interaktionsmønster:

Over tid skaber dette en følelse af udviklende forståelse, som gør det muligt for modellen at navigere komplekse, flertrinsopgaver uden konstant menneskelig indgriben eller omskrivning af prompten.

Håndtering af fejlsituationer og selvkorrektion

Agentic RAG’s autonomi involverer også robuste selvkorrektionsmekanismer. Når systemet rammer blindgyder – såsom at hente irrelevante dokumenter eller støde på fejlformulerede forespørgsler – kan det:

Denne iterative og dynamiske tilgang gør det muligt for modellen at forbedre sig kontinuerligt, hvilket sikrer, at det ikke blot er et one-shot system, men et der lærer af sine fejltrin under en given session.

Self Correction Mechanism

Agentgrænser

På trods af autonomien inden for en opgave er Agentic RAG ikke analog til Artificial General Intelligence. Dets “agentiske” evner er begrænset til de værktøjer, datakilder og politikker, som menneskelige udviklere stiller til rådighed. Det kan ikke opfinde sine egne værktøjer eller træde uden for de domænegrænser, der er sat. I stedet excellerer det i dynamisk orkestrering af de ressourcer, der er til rådighed. Vigtige forskelle fra mere avancerede AI-former inkluderer:

  1. Domænespecifik autonomi: Agentic RAG-systemer er fokuseret på at opnå brugerdefinerede mål inden for et kendt domæne ved at anvende strategier som forespørgselsomskrivelse eller værktøjsvalg for at forbedre resultater.
  2. Infrastrukturafhængighed: Systemets kapaciteter afhænger af de værktøjer og data, som udviklerne integrerer. Det kan ikke overskride disse grænser uden menneskelig indgriben.
  3. Respekt for sikkerhedsforanstaltninger: Etiske retningslinjer, overholdelsesregler og forretningspolitikker forbliver meget vigtige. Agentens frihed er altid begrænset af sikkerhedsforanstaltninger og overvågningsmekanismer (forhåbentlig?).

Praktiske anvendelsestilfælde og værdi

Agentic RAG skiller sig ud i scenarier, der kræver iterativ forfining og præcision:

  1. Korrekthed-først miljøer: Ved compliance-tjek, regulatorisk analyse eller juridisk research kan den agentiske model gentagne gange verificere fakta, konsultere flere kilder og omskrive forespørgsler, indtil den leverer et grundigt gennemgået svar.
  2. Komplekse databaseinteraktioner: Når man arbejder med strukturerede data, hvor forespørgsler ofte kan fejle eller kræve justering, kan systemet autonomt forfine sine forespørgsler vha. Azure SQL eller Microsoft Fabric OneLake, så den endelige hentning stemmer overens med brugerens hensigt.
  3. Udvidede workflows: Længerevarende sessioner kan udvikle sig, efterhånden som ny information dukker op. Agentic RAG kan løbende inkorporere nye data og justere strategier, efterhånden som det lærer mere om problemfeltet.

Styring, gennemsigtighed og tillid

Efterhånden som disse systemer bliver mere autonome i deres ræsonnering, er styring og gennemsigtighed afgørende:

At have værktøjer, der leverer en klar oversigt over handlinger, er afgørende. Uden dem kan det være meget vanskeligt at fejlfinde en flertrinsproces. Se følgende eksempel fra Literal AI (selskabet bag Chainlit) for et Agent-run:

AgentRunExample

Konklusion

Agentic RAG repræsenterer en naturlig udvikling i, hvordan AI-systemer håndterer komplekse, dataintensive opgaver. Ved at anvende et loopet interaktionsmønster, autonomt vælge værktøjer og forfine forespørgsler, indtil et resultat af høj kvalitet opnås, bevæger systemet sig ud over statisk prompt-udførelse til en mere adaptiv, kontekstbevidst beslutningstager. Mens det stadig er begrænset af menneskeskabte infrastrukturer og etiske retningslinjer, muliggør disse agentiske evner rigere, mere dynamiske og i sidste ende mere nyttige AI-interaktioner for både virksomheder og slutbrugere.

Har du flere spørgsmål om Agentic RAG?

Deltag i Microsoft Foundry Discord for at møde andre elever, deltage i kontortimer og få svar på dine spørgsmål om AI-agenter.

Yderligere ressourcer

Akademiske Artikler

Røgtestning af Denne Agent (Valgfrit)

Efter du har lært at implementere agenter i Lesson 16, kan du røgteste denne lektions TravelRAGAgent — for at kontrollere at dens svar forbliver funderet i vidensbasen — med tests/lesson-05-smoke-tests.json. Se tests/README.md for hvordan du kører den.

Forrige Lektion

Mønster for Værktøjsbrug

Næste Lektion

Bygning af Pålidelige AI-agenter


Ansvarsfraskrivelse: Dette dokument er blevet oversat ved hjælp af AI-oversættelsestjenesten Co-op Translator. Selvom vi bestræber os på nøjagtighed, skal du være opmærksom på, at automatiserede oversættelser kan indeholde fejl eller unøjagtigheder. Det originale dokument på dets oprindelige sprog bør betragtes som den autoritative kilde. For kritisk information anbefales professionel menneskelig oversættelse. Vi påtager os intet ansvar for misforståelser eller fejltolkninger, der opstår som følge af brugen af denne oversættelse.