Architecture RAG : recherche en une passe, agents ou GraphRAG ?
Traduction automatique Cet article a été traduit automatiquement depuis la version originale en anglais.
Commencez par une passe de retrieval qui fournit au modèle les passages sources pertinents. Ajoutez une recherche itérative lorsqu’une réponse nécessite une seconde recherche dont la requête dépend du premier résultat. Testez GraphRAG lorsque les questions nécessitent des relations ou une vue d’ensemble de la collection que la recherche classique par passages ne permet pas d’obtenir.
Il s’agit de choix portant sur la collecte des éléments de preuve, et non d’étapes par lesquelles chaque système RAG devrait nécessairement passer. Je commencerais par examiner les questions échouées et les passages effectivement reçus par le modèle. Multiplier les recherches ne peut pas réparer un texte supprimé par le parseur de documents.
Dernière vérification : 2026-09-08.
Adaptez la recherche à la question
| Type de question | Première approche à tester | Travail supplémentaire à justifier |
|---|---|---|
| « Quelle est la commande de réinitialisation de cet appareil ? » | Une passe de retrieval, puis une réponse avec une source | Un passage pertinent doit parvenir au modèle de réponse |
| « Quelle pièce de rechange correspond à la pièce nommée dans ce rapport ? » | Recherche itérative : trouver la pièce, puis interroger le catalogue | Davantage d’appels, une règle d’arrêt et des tests des deux recherches |
| « Quels thèmes reviennent dans ces rapports ? » | Recherche globale GraphRAG, comparée à une approche de synthèse plus simple | Construire et actualiser les synthèses dérivées du graphe |
| « Comment ces fournisseurs sont-ils reliés ? » | Retrieval tenant compte du graphe, comparé à des recherches répétées par passages | Liens entre entités corrects, relations et sources à l’appui |
La documentation des requêtes GraphRAG de Microsoft distingue la recherche locale sur les entités extraites et les chunks sources de la recherche globale sur les rapports de communautés générés. Un rapport de communauté résume un groupe dans le graphe extrait. La recherche globale utilise ces rapports pour répondre aux questions portant sur l’ensemble de la collection. Il ne s’agit pas simplement d’une recherche vectorielle rebaptisée.
Le retrieval itératif constitue un choix de conception distinct et peut utiliser une recherche textuelle classique. Adaptive-RAG étudie le routage des questions entre l’absence de retrieval, une seule étape et plusieurs étapes de retrieval. Cela permet de tester différents parcours, mais n’établit pas lequel est le meilleur sur votre corpus.
Vérifiez les éléments de preuve manquants avant de modifier l’architecture
Pour chaque question échouée, conservez la source attendue et les passages récupérés. Localisez ensuite le premier point de perte :
- Si la source n’est jamais entrée dans l’index, corrigez l’ingestion ou le parsing.
- Si un filtre de sujet facultatif l’a exclue, testez le filtre ou conservez un parcours de recherche plus large. Appliquez les filtres de permissions sur chaque parcours.
- Si le passage a été récupéré mais classé trop bas, testez des changements du retrieval et du reranking.
- Si un nom nécessaire apparaît uniquement dans le premier résultat, testez une seconde recherche en utilisant ce nom.
- Si le modèle a reçu suffisamment d’éléments de preuve mais a répondu incorrectement, examinez l’étape de réponse avant d’ajouter du retrieval.
La réponse sur la stack de recherche couvre BM25, les embeddings et les rerankers au sein d’une passe de retrieval. Ces composants peuvent également servir dans un système itératif ; ils ne déterminent pas le nombre de recherches que le système doit effectuer.
Faites en sorte que la conception plus ambitieuse justifie son coût
Comparez les parcours sur les mêmes questions et avec les mêmes documents autorisés. Attribuez à chacun un budget explicite de temps et d’appels au modèle. Mesurez s’il a trouvé les éléments de preuve requis, répondu correctement et cité des passages étayant ses affirmations. Comptez les timeouts et les budgets de recherche épuisés parmi les échecs.
Pour un graphe, examinez les entités et relations extraites ainsi que les réponses finales. Un lien erroné entre fournisseurs peut produire une réponse cohérente au sujet de la mauvaise entreprise. Intégrez les coûts de construction et d’actualisation de l’index à la comparaison ; le seul coût des requêtes ne rend pas compte de ce travail.
Si le retrieval en une passe atteint l’objectif, arrêtez-vous là. Ajoutez un autre parcours pour les types de questions auxquels un échec mesuré donne un rôle précis.
Pour approfondir
- Métriques d’évaluation RAG localise les pertes d’éléments de preuve dans le parsing, le filtrage, le retrieval et la génération.
- Guide pratique de l’ingénierie des LLM cartographie les parcours d’ingestion et de requête et présente GraphRAG.
- Enterprise RAG Challenge 3 examine les entrées publiques, le routage, les éléments de preuve et leurs limites.