ai-agents-for-beginners

Agentic RAG

(Klik gambar di atas untuk menonton video pelajaran ini)

Agentic RAG

Pelajaran ini memberikan gambaran menyeluruh tentang Agentic Retrieval-Augmented Generation (Agentic RAG), sebuah paradigma AI yang sedang berkembang di mana model bahasa besar (LLM) secara autonomi merancang langkah seterusnya sambil menarik maklumat dari sumber luar. Tidak seperti pola pemulihan-statik kemudian-baca, Agentic RAG melibatkan panggilan berulang ke LLM, berselang-seli dengan panggilan alat atau fungsi dan keluaran berstruktur. Sistem menilai hasil, memperhalusi pertanyaan, memanggil alat tambahan jika perlu, dan meneruskan kitaran ini sehingga penyelesaian yang memuaskan dicapai.

Pengenalan

Pelajaran ini akan merangkumi

Matlamat Pembelajaran

Selepas menamatkan pelajaran ini, anda akan mengetahui cara/memahami:

Apa itu Agentic RAG?

Agentic Retrieval-Augmented Generation (Agentic RAG) adalah paradigma AI yang sedang berkembang di mana model bahasa besar (LLM) secara autonomi merancang langkah seterusnya sambil menarik maklumat dari sumber luar. Tidak seperti pola pemulihan-statik kemudian-baca, Agentic RAG melibatkan panggilan berulang ke LLM, berselang-seli dengan panggilan alat atau fungsi dan keluaran berstruktur. Sistem menilai hasil, memperhalusi pertanyaan, memanggil alat tambahan jika perlu, dan meneruskan kitaran ini sehingga penyelesaian yang memuaskan dicapai. Gaya “pembuat-pemeriksa” berulang ini meningkatkan ketepatan, mengendalikan pertanyaan tidak sempurna, dan memastikan hasil berkualiti tinggi.

Sistem ini secara aktif memiliki proses penalarannya, menulis semula pertanyaan yang gagal, memilih kaedah pemulihan berbeza, dan mengintegrasi pelbagai alat—seperti pencarian vektor dalam Azure AI Search, pangkalan data SQL, atau API tersuai—sebelum memuktamadkan jawapannya. Kualiti yang membezakan sistem agentic ialah keupayaannya memiliki proses penalarannya sendiri. Pelaksanaan RAG tradisional bergantung pada laluan yang telah ditakrifkan, tetapi sistem agentic secara autonomi menentukan urutan langkah berdasarkan kualiti maklumat yang ditemuinya.

Mendefinisikan Agentic Retrieval-Augmented Generation (Agentic RAG)

Agentic Retrieval-Augmented Generation (Agentic RAG) adalah paradigma baru dalam pembangunan AI di mana LLM bukan sahaja menarik maklumat dari sumber data luar tetapi juga secara autonomi merancang langkah seterusnya. Berbeza dengan pola pemulihan-statik kemudian-baca atau urutan arahan prompt yang disusun rapi, Agentic RAG melibatkan kitaran panggilan berulang ke LLM, berselang-seli dengan panggilan alat atau fungsi dan keluaran berstruktur. Pada setiap giliran, sistem menilai hasil yang diperolehi, memutuskan sama ada untuk memperhalusi pertanyaan, memanggil alat tambahan jika perlu, dan meneruskan kitaran ini sehingga mencapai solusi yang memuaskan.

Gaya operasi “pembuat-pemeriksa” berulang ini direka untuk meningkatkan ketepatan, mengendalikan pertanyaan yang tidak sempurna kepada pangkalan data berstruktur (contohnya NL2SQL), dan memastikan hasil yang seimbang dan berkualiti tinggi. Daripada hanya bergantung pada rantaian arahan prompt yang direka dengan rapi, sistem secara aktif memiliki proses penalarannya. Ia boleh menulis semula pertanyaan yang gagal, memilih kaedah pemulihan yang berbeza, dan mengintegrasi pelbagai alat—seperti pencarian vektor dalam Azure AI Search, pangkalan data SQL, atau API tersuai—sebelum memuktamadkan jawapannya. Ini menghapuskan keperluan untuk rangka kerja orkestrasi yang terlalu kompleks. Sebaliknya, kitaran yang agak mudah “panggilan LLM → penggunaan alat → panggilan LLM → …” dapat menghasilkan keluaran yang canggih dan berasas kukuh.

Agentic RAG Core Loop

Memiliki Proses Penalaran

Kualiti yang membezakan yang menjadikan sesuatu sistem “agentic” adalah keupayaannya memiliki proses penalarannya sendiri. Pelaksanaan RAG tradisional sering bergantung pada manusia yang mendefinisikan laluan untuk model: rantai pemikiran yang merangkum apa yang perlu dipulihkan dan bila. Tetapi apabila sistem benar-benar agentic, ia membuat keputusan dalaman tentang bagaimana untuk mendekati masalah itu. Ia bukan sekadar melaksanakan skrip; ia secara autonomi menentukan urutan langkah berdasarkan kualiti maklumat yang ditemuinya. Sebagai contoh, jika ia diminta untuk mencipta strategi pelancaran produk, ia tidak hanya bergantung pada prompt yang menerangkan keseluruhan aliran kerja penyelidikan dan pembuatan keputusan. Sebaliknya, model agentic secara bebas memutuskan untuk:

  1. Mendapatkan laporan trend pasaran semasa menggunakan Bing Web Grounding
  2. Mengenal pasti data pesaing yang relevan menggunakan Azure AI Search.
  3. Mengaitkan metrik jualan dalaman bersejarah menggunakan Azure SQL Database.
  4. Mensintesis penemuan ke dalam strategi yang kohesif yang diorkestrakan melalui Azure OpenAI Service.
  5. Menilai strategi untuk jurang atau ketidakselarasan, memicu pusingan pemulihan lagi jika perlu. Semua langkah ini—memperhalusi pertanyaan, memilih sumber, mengulang sehingga “berpuas hati” dengan jawapan—diputuskan oleh model, bukan diwarisi skrip oleh manusia.

Kitaran Berulang, Integrasi Alat, dan Memori

Tool Integration Architecture

Sistem agentic bergantung pada corak interaksi berulang:

Lama kelamaan, ini mencipta rasa kefahaman yang berkembang, membolehkan model mengemudi tugas rumit bertahap-tahap tanpa memerlukan campur tangan manusia yang berterusan atau merombak prompt.

Mengendalikan Mod Kegagalan dan Pembetulan Diri

Autonomi Agentic RAG juga melibatkan mekanisme pembetulan diri yang mantap. Apabila sistem menghadapi jalan buntu—seperti mendapatkan dokumen yang tidak relevan atau menghadapi pertanyaan yang tidak sempurna—ia boleh:

Pendekatan berulang dan dinamik ini membolehkan model sentiasa memperbaiki diri, memastikan ia bukan sahaja sistem satu tembakan tetapi satu yang belajar daripada kesilapan semasa sesi tertentu.

Self Correction Mechanism

Had Keagenan

Walaupun mempunyai autonomi dalam sesebuah tugas, Agentic RAG tidak setara dengan Kecerdasan Umum Buatan. Keupayaan “agentic”nya terbatas kepada alat, sumber data, dan polisi yang disediakan oleh pembangun manusia. Ia tidak boleh mencipta alatnya sendiri atau melangkaui sempadan domain yang telah ditetapkan. Sebaliknya, ia cemerlang dalam mengorkestrasi sumber-sumber yang ada secara dinamik. Perbezaan utama daripada bentuk AI yang lebih maju termasuk:

  1. Autonomi Khusus Domain: Sistem Agentic RAG fokus mencapai matlamat yang ditakrifkan pengguna dalam domain yang diketahui, menggunakan strategi seperti penulisan semula pertanyaan atau pemilihan alat untuk memperbaiki hasil.
  2. Bergantung pada Infrastruktur: Keupayaan sistem bergantung pada alat dan data yang diintegrasikan oleh pembangun. Ia tidak boleh melepasi batasan ini tanpa campur tangan manusia.
  3. Menghormati Garis Panduan: Garis panduan etika, peraturan pematuhan, dan polisi perniagaan kekal sangat penting. Kebebasan agen sentiasa terhad oleh langkah keselamatan dan mekanisme pengawasan (harapnya?)

Kes Penggunaan Praktikal dan Nilai

Agentic RAG menonjol dalam senario yang memerlukan pemurnian berulang dan ketepatan:

  1. Persekitaran Utamakan Ketepatan: Dalam pemeriksaan pematuhan, analisis regulatori, atau penyelidikan undang-undang, model agentic boleh berulang kali mengesahkan fakta, merujuk kepada pelbagai sumber, dan menulis semula pertanyaan sehingga menghasilkan jawapan yang disemak dengan teliti.
  2. Interaksi Pangkalan Data Kompleks: Apabila berurusan dengan data berstruktur di mana pertanyaan mungkin sering gagal atau perlu penyesuaian, sistem boleh memperhalusi pertanyaannya secara autonomi menggunakan Azure SQL atau Microsoft Fabric OneLake, memastikan pemulihan akhir selaras dengan niat pengguna.
  3. Aliran Kerja Berpanjangan: Sesi yang berjalan lebih lama mungkin berkembang apabila maklumat baru muncul. Agentic RAG boleh sentiasa menggabungkan data baru, mengubah strategi apabila ia mempelajari lebih lanjut tentang ruang masalah.

Tadbir Urus, Ketelusan, dan Kepercayaan

Apabila sistem ini menjadi lebih autonomi dalam penalaran mereka, tadbir urus dan ketelusan adalah penting:

Mempunyai alat yang menyediakan rekod tindakan yang jelas adalah penting. Tanpanya, menyahpepijat proses berbilang langkah boleh menjadi sangat sukar. Lihat contoh berikut dari Literal AI (syarikat di belakang Chainlit) untuk satu Agent run:

AgentRunExample

Kesimpulan

Agentic RAG mewakili evolusi semula jadi dalam cara sistem AI mengendalikan tugas yang kompleks dan berasaskan data. Dengan menggunakan corak interaksi berulang, memilih alat secara autonomi, dan memperhalusi pertanyaan sehingga mencapai hasil berkualiti tinggi, sistem bergerak melangkaui pengikut prompt statik ke arah pembuat keputusan yang lebih adaptif dan sedar konteks. Walaupun masih terhad oleh infrastruktur yang ditakrifkan manusia dan garis panduan etika, kemampuan agentic ini membolehkan interaksi AI yang lebih kaya, dinamik, dan akhirnya lebih berguna untuk perusahaan dan pengguna akhir.

Ada Lagi Soalan tentang Agentic RAG?

Sertai Microsoft Foundry Discord untuk bertemu dengan pelajar lain, menghadiri waktu pejabat dan mendapatkan jawapan untuk soalan Agen AI anda.

Sumber Tambahan

Kertas Akademik

Ujian Asas Agen Ini (Pilihan)

Selepas anda belajar untuk melancarkan agen dalam Lesson 16, anda boleh menguji asas TravelRAGAgent pelajaran ini — memeriksa bahawa jawapannya kekal berasaskan kepada pangkalan pengetahuan — dengan tests/lesson-05-smoke-tests.json. Lihat tests/README.md untuk cara menjalankannya.

Pelajaran Sebelumnya

Corak Reka Bentuk Penggunaan Alat

Pelajaran Seterusnya

Membina Agen AI yang Boleh Dipercayai


Penafian: Dokumen ini telah diterjemahkan menggunakan perkhidmatan terjemahan AI Co-op Translator. Walaupun kami berusaha untuk ketepatan, sila ambil maklum bahawa terjemahan automatik mungkin mengandungi kesilapan atau ketidaktepatan. Dokumen asal dalam bahasa asalnya harus dianggap sebagai sumber yang sahih. Untuk maklumat penting, terjemahan oleh manusia profesional adalah disyorkan. Kami tidak bertanggungjawab terhadap sebarang salah faham atau salah tafsir yang timbul daripada penggunaan terjemahan ini.