Architektura RAG: wyszukiwanie jednoprzebiegowe, agenci czy GraphRAG?

Tłumaczenie automatyczne Ten artykuł został automatycznie przetłumaczony z angielskiego oryginału.

Zacznij od jednego przebiegu wyszukiwania, który dostarczy modelowi odpowiednie fragmenty źródłowe. Dodaj wyszukiwanie iteracyjne, gdy odpowiedź wymaga drugiego wyszukania, którego zapytanie zależy od pierwszego wyniku. Przetestuj GraphRAG, gdy pytania wymagają relacji lub spojrzenia na całą kolekcję, którego nie zapewnia zwykłe wyszukiwanie fragmentów.

Są to decyzje dotyczące sposobu gromadzenia dowodów, a nie etapy, przez które musi przejść każdy system RAG. Najpierw przeanalizowałbym nieudane pytania oraz fragmenty, które faktycznie otrzymał model. Większa liczba wyszukiwań nie naprawi tekstu odrzuconego przez parser dokumentów.

Ostatni przegląd: 2026-09-08.

Dopasuj wyszukiwanie do pytania

Typ pytaniaPierwsze podejście do przetestowaniaDodatkowa praca wymagająca uzasadnienia
„Jakie polecenie resetuje to urządzenie?”Jeden przebieg wyszukiwania, a następnie odpowiedź ze źródłemOdpowiedni fragment musi trafić do modelu odpowiadającego
„Jaka część zamienna pasuje do elementu wymienionego w tym raporcie?”Wyszukiwanie iteracyjne: znajdź element, a następnie przeszukaj katalog częściWięcej wywołań, reguła zatrzymania oraz testy obu wyszukiwań
„Jakie motywy powtarzają się w tych raportach?”Globalne wyszukiwanie GraphRAG w porównaniu z prostszym podejściem podsumowującymBudowanie i odświeżanie podsumowań wyprowadzonych z grafu
„Jak są ze sobą powiązani ci dostawcy?”Wyszukiwanie uwzględniające graf w porównaniu z powtarzanym wyszukiwaniem fragmentówPoprawne powiązania encji, relacje i wsparcie w źródłach

Dokumentacja zapytań GraphRAG firmy Microsoft rozróżnia wyszukiwanie lokalne po wyodrębnionych encjach i fragmentach źródłowych od wyszukiwania globalnego po wygenerowanych raportach społeczności. Raport społeczności podsumowuje grupę w wyodrębnionym grafie. Wyszukiwanie globalne korzysta z tych raportów, aby odpowiadać na pytania dotyczące całej kolekcji. To nie jest po prostu wyszukiwanie wektorowe pod nową nazwą.

Wyszukiwanie iteracyjne to osobna decyzja projektowa i może korzystać ze zwykłego wyszukiwania tekstowego. Opracowanie Adaptive-RAG analizuje kierowanie pytań do braku wyszukiwania, pojedynczego kroku lub wielu kroków wyszukiwania. Umożliwia to testowanie różnych ścieżek, ale nie rozstrzyga, która z nich sprawdzi się najlepiej w danym korpusie.

Zanim zmienisz architekturę, sprawdź brakujące dowody

Dla każdego nieudanego pytania zachowaj oczekiwane źródło oraz pobrane fragmenty. Następnie ustal, gdzie nastąpiła pierwsza utrata:

  • Jeśli źródło nigdy nie trafiło do indeksu, napraw ingest lub parsowanie.
  • Jeśli opcjonalny filtr tematyczny je wykluczył, przetestuj filtr albo zachowaj szerszą ścieżkę wyszukiwania. Filtry uprawnień muszą być egzekwowane na każdej ścieżce.
  • Jeśli fragment został pobrany, ale otrzymał zbyt niską pozycję w rankingu, przetestuj zmiany w wyszukiwaniu i rerankingu.
  • Jeśli potrzebna nazwa występuje tylko w pierwszym wyniku, przetestuj drugie wyszukiwanie z użyciem tej nazwy.
  • Jeśli model otrzymał wystarczające dowody, ale odpowiedział niepoprawnie, przeanalizuj etap generowania odpowiedzi, zanim dodasz kolejne wyszukiwanie.

Odpowiedź search stack omawia BM25, embeddings i rerankery w ramach jednego przebiegu wyszukiwania. Te komponenty mogą również obsługiwać system iteracyjny; nie decydują jednak o tym, ile wyszukiwań powinien wykonać system.

Niech większy projekt uzasadni swój koszt

Porównaj ścieżki na tych samych pytaniach i przy użyciu tych samych dozwolonych dokumentów. Ustal dla każdej z nich jawny budżet czasu i wywołań modelu. Zmierz, czy system znalazł wymagane dowody, odpowiedział poprawnie oraz zacytował fragmenty wspierające jego twierdzenia. Uwzględnij przekroczenia limitu czasu i wyczerpanie budżetu wyszukiwania wśród przypadków niepowodzeń.

W przypadku grafu przeanalizuj wyodrębnione encje i relacje, a także końcowe odpowiedzi. Błędne powiązanie dostawcy może wygenerować spójną odpowiedź dotyczącą niewłaściwej firmy. Uwzględnij w porównaniu koszty budowania i odświeżania indeksu; sam koszt zapytania pomija tę pracę.

Jeśli wyszukiwanie jednoprzebiegowe spełnia założony cel, zakończ na nim. Dodaj kolejną ścieżkę tylko dla typów pytań, w przypadku których zmierzona porażka uzasadnia jej zastosowanie.

Dalsza lektura