Réglages du pipeline RAG

Optimisations P2/P3 — bascule à chaud (aucun redéploiement).

← Accueil

Ces optimisations sont désactivées par défaut : activez-les une par une puis comparez la qualité avec php bin/console app:rag:seal (avant / après). Le routage synthèse nécessite d'avoir lancé app:raptor:build ; l'enrichissement à l'ingestion a un coût LLM et s'applique aux prochains dépôts.

Optimisation Lot État Action
Repondération heuristique
Réordonne les passages retenus par critères déterministes (titre, éléments factuels, diversité de source, niveau RAPTOR) — le cosinus reste le signal principal.
CHAT_RERANK · défaut : désactivé
L11 ○ Désactivé
Coupe distributionnelle
Coupe le dossier de preuve au plus grand décrochage de score (8 à 12 extraits) au lieu d'une coupe budgétaire aveugle.
CHAT_DIST_CUTOFF · défaut : désactivé
L10 ○ Désactivé
Coupe du dossier (budget)
Borne le dossier de preuve à RAG_CONTEXT_CHARS (étape « 9/9 · Coupe du dossier »). Activée (défaut) : les passages retenus qui dépassent le budget sont écartés. Désactivée : tous les passages retenus sont inclus, sans coupe — à privilégier pour les travaux qui veulent le maximum d'extraits.
CHAT_BUDGET_CUT · défaut : activé
P0a ● Activé
Plan de preuve opérant
Chaque élément de preuve attendu devient une branche de recherche (couverture élargie), dissocié de la reformulation.
CHAT_EVIDENCE_QUERIES · défaut : désactivé
L12 ○ Désactivé
Branche lexicale (tsvector)
Joint une branche lexicale plein-texte PostgreSQL (tsvector) aux branches denses de la recherche multi-branches. Désactivée (défaut) : seules les branches denses (cosinus) alimentent le dossier de candidats.
CHAT_LEXICAL_BRANCH · défaut : désactivé
L9 ○ Désactivé
Routage 2-classes + synthèse RAPTOR
Classe la question (factuel/synthèse) ; une synthèse élargit la couverture et injecte les résumés hiérarchiques RAPTOR (nécessite app:raptor:build).
CHAT_ROUTING · défaut : désactivé
L13/L14 ○ Désactivé
1er appel LLM (planification de requête)
Si activé, un appel LLM reformule la question et génère des sondes de recherche. Désactivé (défaut) : recherche directe déterministe (question + branche lexicale), sans ce 1er appel — mesuré neutre à légèrement positif, un appel LLM et de la latence en moins.
CHAT_COMPILE · défaut : désactivé
C1/D3 ○ Désactivé
Enrichissement à l'ingestion (coût LLM) coût
Une passe LLM par document à l'ingestion (résumé, contexte, métadonnées). ATTENTION : coût par document, s'applique aux prochains dépôts.
INGEST_ENRICH · défaut : désactivé
L7 ○ Désactivé

Sélection des extraits — molettes

Ajustez combien d'extraits sont examinés puis retenus. Baissez le taux/l'anti-dérive ou montez le vivier et le nombre minimal garanti si trop de passages sont éliminés. Les valeurs sont bornées ; « Réinitialiser » revient au défaut de configuration.

Taux retenu (relatif au meilleur) défaut 0.62
Un passage est retenu si son score ≥ taux × meilleur score. Plus BAS = on garde plus large (bande de scores élargie). 0 = désactivé.
Plancher absolu de score défaut 0.45
Sous ce score, même le meilleur passage est jugé hors-sujet (bascule au repli « pertinence faible »). Plus BAS = moins de bascules au repli.
Anti-dérive (cosinus min à la question) défaut 0.25
Sélection collective (chat deux appels) : un candidat trop loin de la question est écarté. Plus BAS = on écarte moins.
Extraits retenus (plafond) défaut 24 extraits
Nombre MAXIMAL de passages retenus par la diversité MMR. Plus HAUT = plus d'extraits sélectionnés (mais la coupe budgétaire ci-dessous peut en écarter ensuite ; et il faut un vivier ≥ ce plafond).
extraits
Budget du dossier (coupe finale) défaut 24000 caractères
Taille max du dossier de preuve (en CARACTÈRES ≈ 3,5-4 car./token → 800 000 ≈ 200k tokens) envoyé au rédacteur quand la « Coupe du dossier » est active. C'est CE budget (÷ la taille d'un extrait, ~3000 car. avec contexte parent) qui plafonne le nombre d'extraits [Sk]. Plus HAUT = plus d'extraits, mais coût d'entrée facturé et risque de dilution. Le nombre d'extraits reste aussi borné par « Extraits retenus » et le vivier.
caractères
Candidats par branche (recherche) défaut 12 candidats
Nombre de passages récupérés PAR BRANCHE de recherche (dense/lexicale). C'est le PREMIER plafond de la chaîne : avec 1 seule branche (compile OFF), le nombre total de candidats vaut ce chiffre. Trop bas ⇒ tous les réglages en aval sont affamés. Pour viser 200 extraits, monter à ≥ 200.
candidats
Liste de candidats HNSW (ef_search) défaut 100
Taille de la liste explorée par l'index vectoriel HNSW. Doit être ≥ au nombre de candidats voulu par branche, sinon la recherche ne peut pas en ramener autant (rappel plafonné). Plus HAUT = meilleur rappel, recherche plus lente.
Vivier de tête examiné défaut 40 candidats
Nombre de meilleurs candidats (par fusion RRF) dont les embeddings sont hydratés avant dédup/anti-dérive/MMR. Doit être ≥ au nombre d'extraits visé. Plus HAUT = moins de coupe en amont, mais coût MMR en O(vivier²).
candidats
Nombre minimal garanti défaut 0 extraits
Garantit AU MOINS N extraits quand autant de candidats existent, même si les seuils en auraient éliminé davantage (réintroduit les coupés par pertinence/anti-dérive, jamais les doublons). 0 = désactivé (comportement d'origine).
extraits
Loading…
Loading the web debug toolbar…
Attempt #