ai-agents-for-beginners

Agentic RAG

(Klikněte na obrázek výše pro zobrazení videa této lekce)

Agentic RAG

Tato lekce nabízí komplexní přehled o Agentic Retrieval-Augmented Generation (Agentic RAG), novém paradigmatickém přístupu v AI, kde velké jazykové modely (LLM) autonomně plánují své další kroky při získávání informací z externích zdrojů. Na rozdíl od statických vzorců „nejprve vyhledat a potom číst“ zahrnuje Agentic RAG iterativní volání LLM, prokládané voláními nástrojů nebo funkcí a strukturovanými výstupy. Systém vyhodnocuje výsledky, zpřesňuje dotazy, v případě potřeby vyvolává další nástroje a tento cyklus opakuje, dokud není dosaženo uspokojivého řešení.

Úvod

Tato lekce pokrývá

Výukové cíle

Po dokončení této lekce budete schopni/porušíte:

Co je Agentic RAG?

Agentic Retrieval-Augmented Generation (Agentic RAG) je nově vznikající paradigmatický přístup v AI, kde velké jazykové modely (LLM) autonomně plánují své další kroky při získávání informací z externích zdrojů. Na rozdíl od statických vzorců „nejprve vyhledat a potom číst“ zahrnuje Agentic RAG iterativní volání LLM, prolínané voláními nástrojů či funkcí a strukturovanými výstupy. Systém vyhodnocuje výsledky, zpřesňuje dotazy, v případě potřeby vyvolává další nástroje a tento cyklus opakuje, dokud není dosaženo uspokojivého řešení. Tento iterativní styl „maker-checker“ zlepšuje správnost, zvládá chybné dotazy a zajišťuje vysoce kvalitní výsledky.

Systém aktivně ovládá svůj proces uvažování, přepisuje neúspěšné dotazy, vybírá jiné metody vyhledávání a integruje různé nástroje – například vektorové vyhledávání v Azure AI Search, SQL databáze či vlastní API – než dospěje ke konečné odpovědi. Rozlišující vlastností agentního systému je jeho schopnost vlastnit svůj proces uvažování. Tradiční implementace RAG spoléhají na předem definované cesty, zatímco agentní systém autonomně určuje posloupnost kroků na základě kvality nalezených informací.

Definice Agentic Retrieval-Augmented Generation (Agentic RAG)

Agentic Retrieval-Augmented Generation (Agentic RAG) je nově vznikající paradigmatický přístup v oblasti vývoje AI, kde LLM nejen získávají informace z externích datových zdrojů, ale také autonomně plánují své další kroky. Na rozdíl od statických vzorců „nejprve vyhledat a poté číst“ nebo pečlivě skriptovaných sekvencí promptů zahrnuje Agentic RAG smyčku iterativních volání LLM, prokládaných voláními nástrojů či funkcí a strukturovanými výstupy. Systém vždy vyhodnocuje získané výsledky, rozhoduje se, zda dotazy zpřesnit, v případě potřeby vyvolává další nástroje a tento cyklus pokračuje, dokud není dosaženo uspokojivého řešení.

Tento iterativní styl „maker-checker“ je navržen ke zvýšení správnosti, zvládání chybně formovaných dotazů do strukturovaných databází (např. NL2SQL) a zajištění vyvážených, vysoce kvalitních výsledků. Místo spoléhání se výhradně na pečlivě navržené řetězce promptů systém aktivně vlastní svůj proces uvažování. Může přepisovat neúspěšné dotazy, volit jiné metody vyhledávání a integrovat více nástrojů – například vektorové vyhledávání v Azure AI Search, SQL databáze nebo vlastní API – než dospěje ke konečné odpovědi. Odpadá potřeba příliš složitých orchestracích frameworků. Místo toho relativně jednoduchá smyčka „volání LLM → použití nástroje → volání LLM → …“ může přinést sofistikované a solidní výstupy.

Agentic RAG Core Loop

Vlastnictví procesu uvažování

Rozlišující vlastností, která dělá systém „agentní“, je jeho schopnost vlastnit svůj proces uvažování. Tradiční implementace RAG často závisí na tom, že lidé předem definují modelu cestu: řetězec myšlenek, který stanovuje, co se má kdy vyhledávat. Ale když je systém skutečně agentní, rozhoduje interně, jak přistoupit k problému. Nejenže vykonává skript, ale autonomně určuje posloupnost kroků na základě kvality nalezených informací. Například pokud má vytvořit strategii uvedení produktu na trh, nespoléhá se pouze na prompt, který přesně popisuje celý výzkumný a rozhodovací proces. Agentní model místo toho nezávisle rozhoduje, že:

  1. Získá aktuální zprávy o trendech na trhu pomocí Bing Web Grounding
  2. Identifikuje relevantní data o konkurentech pomocí Azure AI Search.
  3. Koreluje historické interní prodejní metriky pomocí Azure SQL Database.
  4. Syntetizuje zjištění do soudržné strategie, kterou orchestruje přes Azure OpenAI Service.
  5. Vyhodnotí strategii na mezery nebo rozporuplnosti a v případě potřeby vyvolá další kolo vyhledávání. Všechny tyto kroky – zpřesnění dotazů, volba zdrojů, iterace dokud není „spokojený“ s odpovědí – jsou rozhodovány modelem, nikoli předem skriptovány člověkem.

Iterativní smyčky, integrace nástrojů a paměť

Tool Integration Architecture

Agentní systém spoléhá na vzor interakce ve smyčce:

Postupem času to vytváří dojem vyvíjejícího se porozumění, což modelu umožňuje zvládat složité úkoly zahrnující více kroků bez nutnosti soustavného zásahu člověka nebo přepisování promptu.

Zvládání režimů selhání a samoopravování

Autonomie Agentic RAG zahrnuje také robustní mechanismy samoopravování. Když systém narazí na slepé uličky – například nalezení nerelevantních dokumentů nebo setkání s chybnými dotazy – může:

Tento iterativní a dynamický přístup umožňuje modelu se neustále zlepšovat a zajistit, že nejde o systém jednorázový, ale o systém, který se učí ze svých chyb během dané relace.

Self Correction Mechanism

Meze agentnosti

Přestože má autonomii v rámci úkolu, Agentic RAG není ekvivalentem Umělé obecné inteligence. Jeho „agentní“ schopnosti jsou omezeny na nástroje, datové zdroje a politiky poskytované lidskými vývojáři. Nemůže si vymýšlet vlastní nástroje ani opustit hranice domény, které byly nastaveny. Místo toho vyniká v dynamické orchestraci dostupných zdrojů. Klíčové rozdíly od pokročilejších forem AI zahrnují:

  1. Doménově specifická autonomie: Agentic RAG systémy se zaměřují na dosahování uživatelem definovaných cílů v rámci známé domény, využívající strategie jako přepisování dotazů nebo výběr nástrojů ke zlepšení výsledků.
  2. Závislost na infrastruktuře: Schopnosti systému závisí na nástrojích a datech integrováných vývojáři. Nemůže tyto hranice překročit bez lidského zásahu.
  3. Respektování bezpečnostních opatření: Etické směrnice, pravidla souladu a obchodní politiky zůstávají velmi důležité. Svoboda agenta je vždy omezena bezpečnostními opatřeními a dozorovými mechanismy (doufejme?).

Praktické případy použití a hodnota

Agentic RAG vyniká v scénářích vyžadujících iterativní zpřesňování a přesnost:

  1. Prostředí kladoucí důraz na správnost: Při kontrolách souladu, regulačních analýzách nebo právním výzkumu může agentní model opakovaně ověřovat fakta, konzultovat více zdrojů a přepisovat dotazy, dokud nevytvoří důkladně ověřenou odpověď.
  2. Složité databázové interakce: Při práci se strukturovanými daty, kde se dotazy často nedaří nebo je potřeba je upravovat, může systém autonomně zpřesňovat dotazy pomocí Azure SQL nebo Microsoft Fabric OneLake, aby zajistil, že výsledné získání odpovídá záměru uživatele.
  3. Rozšířené pracovní postupy: Dlouhotrvající relace se mohou vyvíjet s tím, jak se objevují nové informace. Agentic RAG může kontinuálně začleňovat nová data, měnit strategie podle toho, jak se učí více o problematickém prostoru.

Řízení, transparentnost a důvěra

Jak tyto systémy získávají více autonomie ve svém uvažování, je řízení a transparentnost klíčové:

Mít nástroje, které poskytují jasný záznam akcí, je nezbytné. Bez nich může být ladění vícekrokového procesu velmi náročné. Viz následující příklad od Literal AI (společnosti za Chainlit) pro běh agenta:

AgentRunExample

Závěr

Agentic RAG představuje přirozený vývoj v tom, jak AI systémy zvládají složité, datově náročné úkoly. Přijetím smyčkového vzoru interakce, autonomním výběrem nástrojů a zpřesňováním dotazů dokud nedosáhne vysoce kvalitního výsledku, systém přechází od statického následování promptů k adaptivnějšímu, kontextově uvědomělému rozhodovacímu procesu. Přestože je stále omezen lidsky definovanou infrastrukturou a etickými zásadami, tyto agentní schopnosti umožňují bohatší, dynamičtější a konečně užitečnější AI interakce jak pro podniky, tak koncové uživatele.

Máte další otázky ohledně Agentic RAG?

Připojte se k Microsoft Foundry Discord, kde se setkáte s dalšími studenty, zúčastníte se konzultací a získáte odpovědi na své otázky týkající se AI agentů.

Další zdroje

Akademické články

Smoke-testování tohoto agenta (volitelné)

Poté, co se naučíte nasazovat agenty v Lekci 16, můžete smoke-testovat TravelRAGAgent z této lekce — kontrolovat, že jeho odpovědi zůstávají založeny na znalostní bázi — pomocí tests/lesson-05-smoke-tests.json. Viz tests/README.md pro instrukce, jak test spustit.

Předchozí lekce

Designový vzor používání nástrojů

Následující lekce

Budování důvěryhodných AI agentů


Prohlášení o omezení odpovědnosti: Tento dokument byl přeložen pomocí AI překladatelské služby Co-op Translator. Přestože usilujeme o co největší přesnost, mějte prosím na paměti, že automatizované překlady mohou obsahovat chyby nebo nepřesnosti. Originální dokument v jeho mateřském jazyce by měl být považován za autoritativní zdroj. Pro kritické informace se doporučuje profesionální lidský překlad. Nejsme odpovědní za jakékoli nedorozumění nebo nesprávné interpretace vzniklé použitím tohoto překladu.