Presets
L'enveloppe de gouvernance héritée par les bases de connaissances.
Un preset est l'objet unique de gouvernance RAG : une enveloppe qui déclare les parsers et stratégies autorisés, les valeurs par défaut, le modèle d'embedding et les droits. Il est hérité par les bases de connaissances de sf-knowledge-hub, qui choisissent ensuite un parser par document dans ces limites.
Qu'est-ce qu'un preset
Un preset décrit ce qui est autorisé, pas ce qui est imposé. Il fixe des bornes et des valeurs par défaut ; à l'intérieur de ces bornes, chaque base de connaissances — et même chaque document — peut faire des choix différents.
Un preset gouverne une enveloppe : il ne fige pas la configuration. Chaque base de connaissances choisit dans ces limites, jusqu'au parser par document.
Cycle de vie
Un preset a un statut qui détermine sa visibilité au moment de créer une base de connaissances :
| Statut | Effet |
|---|---|
| Brouillon | Invisible à la création de base de connaissances. Sert à préparer un preset avant de l'ouvrir. |
| Publié | Sélectionnable par les bases de connaissances. |
| Déprécié | Plus proposé aux nouvelles bases ; les bases existantes continuent de fonctionner. |
Un preset publié est immuable. Le modifier crée une nouvelle version : les bases de connaissances déjà rattachées ne changent pas, seules les nouvelles héritent de la version à jour. Cela évite de réindexer en masse un corpus existant à chaque ajustement.
Portée : plateforme ou tenant
Deux origines de presets coexistent :
- Presets plateforme — fournis par SUPERFASTTT, communs à toutes les instances. Ils apparaissent en lecture seule : vous les utilisez tels quels, sans pouvoir les modifier.
- Presets du tenant — créés dans cette app d'administration, visibles de votre seule instance. Ce sont ceux que vous éditez.
Ce que borne un preset
L'édition d'un preset est organisée en quatre onglets. La distinction la plus importante oppose les réglages d'ingestion (destructifs : les changer impose de réindexer) et les réglages de recherche (appliqués à la requête, sans réindexation).
Général
Section Identité : nom, description, type de source (Documentaire, Catalogue ad-hoc, Catalogue référentiel, Connecteur, Composite) et statut (brouillon, publié, déprécié).
Ingestion — destructif (varie par document côté KB)
Ce qui détermine comment un document est découpé et vectorisé :
- Parsers autorisés et parser par défaut — l'ensemble dans lequel la base de connaissances choisit, éventuellement document par document.
- Taille des fragments (en tokens) et chevauchement (overlap).
- Dans la section Embedding : le modèle d'embedding par défaut — voir l'avertissement plus bas.
Recherche — query-time (sans réindexation)
Ce qui s'applique à chaque requête, modifiable sans toucher à l'index :
- Stratégies autorisées et stratégie par défaut : Sémantique (vectorielle), BM25 (lexicale) ou Hybride.
- Pour l'hybride, la pondération α (
0= lexical seul,1= sémantique seul), avec un intervalle α min / α max autorisé. - top-k (et top-k max) et seuil de pertinence.
- Reranking optionnel : Bonus métadonnées (rapide) ou Cross-encoder (plus précis, plus coûteux), avec le modèle issu de Modèles IA.
- RAG en deux passes (récupération large puis ciblée), citations obligatoires, mode strict (répondre uniquement à partir des sources).
Gouvernance
- Mode avancé KB autorisé — permet à l'administrateur d'une base de surcharger le parser ou le découpage par document ou par lot, dans les limites du preset.
- Autoriser les contributeurs à créer une base de connaissances — sinon la création reste réservée aux administrateurs de base.
Créer ou modifier un preset
Le modèle d'embedding d'un preset publié est verrouillé. En changer rendrait les vecteurs déjà indexés incomparables avec les nouveaux : il faut alors un nouveau preset (ou une nouvelle version) et une réindexation.
Ce qui reste à la base de connaissances
Le preset borne, la base de connaissances choisit dans ces bornes. Concrètement, le choix du parser par document, l'import et l'inspection du découpage se font dans les bases de connaissances, pas ici.
Comment un document est indexé
Quel que soit le parser retenu (OCR, markdown, texte…), l'ingestion passe par une représentation intermédiaire commune avant le découpage. Autrement dit, le parsing est découplé du chunking : les fragments issus de parsers différents restent comparables dans le même espace vectoriel, et la page d'origine est préservée (pour ouvrir une source au bon endroit). C'est ce qui permet à un preset d'autoriser plusieurs parsers sans produire un index incohérent.

