Requêtes globales et agrégation sur graphe
Edge et al., « From Local to Global: A Graph RAG Approach to Query-Focused Summarization », Microsoft Research, 2024 · arXiv:2404.16130
La récupération classique sélectionne les k passages les plus pertinents et laisse au générateur le soin d'en faire une réponse. Ce paradigme suppose que la réponse est contenue dans un petit nombre d'unités. Il échoue sur les requêtes globales, dont la réponse n'est écrite nulle part et doit être agrégée sur l'ensemble du corpus : « quels projets ont fait appel à ce fournisseur, et lesquels ont rencontré le même mode de défaillance ? » implique de recouper comptes rendus de projet, fiches fournisseurs et rapports d'incident. Augmenter k ne résout rien : la fenêtre de contexte est bornée, et le classement par pertinence locale ne garantit aucune couverture.
Edge et ses coauteurs proposent en 2024 d'indexer non plus seulement le texte, mais une structure extraite du texte. Un modèle de langage parcourt le corpus pour en extraire entités et relations, constituant un graphe ; ce graphe est ensuite partitionné en communautés, dont des résumés hiérarchiques sont précalculés. Une requête globale est traitée en interrogeant ces résumés, puis en agrégeant les réponses partielles. Les auteurs rapportent des gains nets sur la complétude et la diversité des réponses par rapport à une base RAG vectorielle.
DeepView construit ce graphe lors de l'indexation, dans votre environnement. Notre implémentation s'écarte du travail d'origine sur un point assumé : plutôt que de précalculer des résumés de communautés et de les agréger à chaque requête, dont le coût croît avec la taille du corpus indépendamment de la question, nous ancrons la requête sur les entités qu'elle mentionne et parcourons le graphe depuis ces points, en élaguant les branches dont la pertinence décroît. Ce choix privilégie la latence et la traçabilité au prix d'une couverture moindre sur les requêtes véritablement globales, pour lesquelles l'approche par résumés reste supérieure.
Entrer dans le détail
Les choix d'architecture, les écarts assumés par rapport à la littérature et les résultats intermédiaires de l'évaluation se discutent directement avec l'équipe qui construit le système.