Guide des options

Conclave fait travailler plusieurs modèles sur la même question, puis les fait se relire. Les réglages ci-dessous décident de trois choses : quel dispositif traite la question, sur quoi il s'appuie, et ce qu'il en coûte. Les valeurs affichées en couleur sont les valeurs par défaut réellement appliquées par le code.

Modes d'orchestration

Sélecteur au-dessus de la zone de saisie. Le mode détermine le nombre d'étapes, donc le coût et la durée. Un run ne change jamais de mode en cours de route, sauf bascule automatique décrite ci-dessous.

Choix automatiqueConversation · sélecteur de mode — nom interne : Auto0,01 – 0,18 € · 4 – 40 s
Conclave analyse la question et retient le dispositif adapté à sa difficulté.
Réponse rapideConversation · sélecteur de mode — nom interne : Éclair0,01 € · ~4 s
Un seul modèle répond, sans relecture. Pour une question simple ou déjà cadrée.
Réponse vérifiéeConversation · sélecteur de mode — nom interne : Équipe0,06 € · ~18 s
Un modèle rédige, un second relit et signale les défauts, puis la réponse est corrigée.
Confrontation d'avisConversation · sélecteur de mode — nom interne : Débat0,13 € · ~32 s
Plusieurs modèles répondent séparément, se critiquent à l'aveugle, puis un arbitre tranche et conserve les désaccords.
Analyse de documentsConversation · sélecteur de mode — nom interne : Analyse0,18 € · ~45 s
Vos documents sont dépouillés d'abord, puis cités page par page dans la réponse.

Deux bascules automatiques échappent à votre choix. Joindre un document force le mode Analyse ; à l'inverse, un run lancé en Analyse sans aucun document joint retombe en Équipe et le signale dans les diagnostics du cockpit.

Routeur — mode Auto

En mode Auto, un appel préalable, court et peu coûteux, classe la question avant de choisir le dispositif. Sa proposition est affichée : vous pouvez la remplacer avant de lancer.

Prudence du routeurRéglages · RouteurDéfaut : Équilibré
Économe — Décale les seuils d'escalade d'un cran vers le haut : on reste sur des dispositifs légers. Équilibré — Applique les seuils de référence. Exigeant — Décale les seuils d'escalade d'un cran vers le bas : on escalade plus vite.
Nature de la questionDécidée par le routeurFactuelle · Analytique · Créative · Procédurale · Prospective
Détermine si la notion de fait vérifiable a un sens. Une demande créative ou procédurale n'est jamais écrêtée en confiance ; une question prospective l'est toujours, aucune source ne pouvant confirmer un état futur.
VolatilitéDécidée par le routeur, défaut du pack sinonstable · moyenne · haute
Une volatilité haute déclenche l'ancrage externe obligatoire, quel que soit le mode retenu.
Complexité et enjeuDécidés par le routeurcomplexité 1 à 5 · enjeu faible, moyen, fort
Seuils de référence : complexité ≤ 2 et enjeu faible → Éclair ; complexité 3-4 et enjeu moyen → Équipe ; enjeu fort, demande d'arbitrage ou sujet controversé → Débat ; volume documentaire → Analyse. La prudence décale ces seuils d'un cran.

Le réglage de prudence est enregistré dans le navigateur, pas dans votre compte : il ne suit pas d'un poste à l'autre. Si l'appel de routage échoue, le run part en mode Équipe avec une volatilité moyenne.

Rôles et attribution des modèles

Chaque étape d'un run est jouée par un rôle. Vous choisissez quel modèle tient quel rôle, avec des modèles de repli et une température propre.

BâtisseurRéglages · Rôles — batisseur
Comprend l'intention, structure le raisonnement et rédige la réponse. Il ne voit jamais le corpus brut, seulement la note factuelle de l'Analyste.
RelecteurRéglages · Rôles — relecteur
Audite la réponse à l'aveugle : erreurs factuelles, sauts de logique, cas limites oubliés, affirmations non étayées, données présentées comme réelles sans avoir été fournies.
RévisionRéglages · Rôles — revision
Reprend la réponse point par point face à l'audit et produit un journal : chaque problème est corrigé, contesté avec argument, ou laissé en suspens.
AnalysteRéglages · Rôles — analyste
Traite les documents joints et produit une note factuelle citée et localisée, sans répondre à la question.
Débat — tour 1Réglages · Rôles — debat_tour1
Répond à la question indépendamment des autres participants du panel.
Débat — tour 2Réglages · Rôles — debat_tour2
Critique les réponses des autres, à l'aveugle : les auteurs sont anonymisés derrière des étiquettes.
ArbitreRéglages · Rôles — arbitre
Tranche les désaccords, rédige la réponse finale et conserve explicitement les désaccords qu'il n'a pas pu trancher.
RouteurRéglages · Rôles — routeur
Classe la question en mode Auto : complexité, enjeu, volatilité, nature, volume documentaire, et propose les requêtes de recherche.
ÉclaireurRéglages · Rôles — eclaireur
Modèle principalRéglages · RôlesDéfaut : premier modèle actif
Sans attribution explicite, le rôle prend l'un des modèles actifs du registre, sans ordre garanti. Attribuez les rôles si vous voulez un résultat reproductible.
Modèles de repliRéglages · Rôles
Transmis à OpenRouter comme liste de secours : le premier modèle indisponible cède la place au suivant, sans échec du run.
TempératureRéglages · Rôles (surcharge) ou Prompts
La surcharge du rôle a priorité sur la température du prompt. Les étapes à sortie strictement structurée sont relancées à température 0 en cas de rejet par la validation serveur.
Participants au débatRéglages · Rôles — Débat tour 12 à 5 modèles
Le panel est constitué du modèle principal et de ses replis, complété par les modèles actifs. En dessous de deux modèles disponibles, le débat est refusé.

Registre des modèles

Le registre est synchronisé depuis OpenRouter. Rien n'est utilisable avant d'avoir été activé.

Synchroniser le registreRéglages · ModèlesRéservé aux administrateurs
Récupère le catalogue OpenRouter : nom, fournisseur, fenêtre de contexte, tarifs, paramètres pris en charge. Les modèles nouvellement découverts arrivent désactivés, et les activations existantes sont conservées.
Activer un modèleRéglages · ModèlesDésactivé à la découverte · réservé aux administrateurs
Seuls les modèles actifs peuvent être attribués à un rôle, participer à un débat ou servir de repli.
Tester la connexionRéglages · Modèles et Rôles
Appel minimal facturé au tarif du modèle, qui renvoie la latence, le coût et la réponse brute. C'est le moyen de vérifier qu'une clé et un modèle répondent avant de lancer un run coûteux.

Le registre des modèles est partagé : activer ou désactiver un modèle vaut pour tous les comptes de l'instance, pas seulement pour le vôtre. Ces deux actions exigent donc le rôle d'administrateur ; sans lui, le bouton de synchronisation et les interrupteurs d'activation sont inactifs. La lecture du registre, l'attribution des rôles et le test de connexion restent ouverts à tous.

Prompts

Chaque rôle a un prompt de référence versionné. Vous pouvez le surcharger : votre version prime, la version de référence reste disponible.

Socle communRéglages · Prompts — socle
Préfixe ajouté devant tous les rôles : distinguer l'établi du probable, marquer ou sourcer toute affirmation factuelle, ne jamais fabriquer une source, signaler le volatile, écrire dense. Les contenus explicitement fictifs échappent à la règle de sourçage.
Contenu du promptRéglages · Prompts
Enregistrer crée une nouvelle version active et désactive la précédente : l'historique reste consultable et l'empreinte de chaque version est figée dans les campagnes de calibration.
Température du promptRéglages · Prompts
Utilisée si aucune surcharge de rôle n'est définie.
Schéma JSONRéglages · Prompts (rôles structurés)
Le schéma est transmis comme paramètre d'API, jamais décrit dans le texte du prompt, et la sortie est revalidée côté serveur. Une sortie non conforme entraîne une relance unique, puis l'étape est déclarée en erreur.

Packs de domaine

Un pack ajoute du contexte métier sans jamais retirer les garde-fous universels. Le pack par défaut, « Généraliste », est volontairement vide et ne peut pas être supprimé.

Contexte de domaineRéglages · Domaines
Texte injecté dans le prompt système de chaque rôle : vocabulaire, contraintes réglementaires, conventions de l'activité.
GlossaireRéglages · Domaines
Couples terme / définition transmis aux modèles pour éviter les contresens sur le jargon interne.
Critères additionnelsRéglages · DomainesS'ajoutent aux 6 axes universels
Axes de notation supplémentaires pour le Relecteur. Les axes universels — exactitude, raisonnement, complétude, sourcing, cadrage, actionnabilité — ne sont ni supprimables ni désactivables par un pack.
Sources spécialiséesRéglages · Domaines
Points d'accès consultés directement lors de l'ancrage, selon leur déclencheur (toujours, ou volatilité haute seulement). Choisies explicitement par vous, elles ne passent pas par le portail de pertinence.
Volatilité par défautRéglages · Domainesmoyenne
S'applique quand le routeur n'a pas tranché, par exemple en mode manuel.
Pack par défautRéglages · Domaines
Un seul pack par défaut par compte. Le pack actif s'applique aux runs suivants ; en mode Auto, le routeur peut suggérer un autre pack.

Ancrage externe (recherche web)

Quand la question est volatile ou prospective, une étape de recherche précède la rédaction. Elle n'est jamais bloquante : en cas d'échec, le run continue et la confiance est plafonnée.

Activer l'ancrage externeRéglages · RechercheActivé
Désactivé, les runs à volatilité haute reposent uniquement sur les données d'entraînement des modèles, et le signalent dans les diagnostics.
FournisseurRéglages · RechercheExa.ai
La clé du fournisseur est un secret serveur : l'interface indique seulement si elle est configurée, et ne l'affiche jamais.
Nombre de résultatsRéglages · Recherche8
Résultats demandés par requête lors de la première vague. Une seule racine de domaine est retenue par vague, pour éviter qu'une source occupe toutes les places.
Caractères par sourceRéglages · Recherche1500
Longueur des extraits rapportés. Une page primaire dont les chiffres manquent aux extraits fait l'objet d'une extraction de texte, au plus cinq fois par run.
Émetteurs primairesRéglages · Recherche8 domaines par défaut
Liste imposée lors de l'escalade : si la première vague retient moins de deux sources, une seconde vague est lancée sur ces seuls domaines, avec une fenêtre de 24 mois.
Domaines bloquésRéglages · Recherche
Liste de rejet appliquée avant notation. Elle porte sur l'émetteur réel : reprendre un contenu bloqué via un fil de diffusion tiers ne permet pas de contourner le filtre. La liste globale est complétée par vos domaines personnels.

Portail de pertinence

Un ancrage de mauvaise qualité est plus nuisible qu'aucun ancrage : il donne une caution factuelle à des données non fiables. Chaque source est donc notée avant injection, sur trois axes de 0 à 3 — pertinence, attribuabilité, substance. Il faut 6/9 au total pour être retenu, et au moins 2 sur attribuabilite et au moins 2 sur substance : ces axes sont éliminatoires. Une date de publication absente est un refus d'admission ; une source tertiaire — fil de diffusion payant hébergé par un tiers, blog de reprise — est écartée quel que soit son score ; une source de plus de 18 mois est signalée comme potentiellement périmée.

Statuts d'ancrage

Ancrage réussigrounding_status = reussi
Au moins trois sources retenues, dont deux primaires. Aucun plafond de confiance au titre de l'ancrage.
Ancrage secondairegrounding_status = secondaireconfiance plafonnée à 55
Des sources ont été retenues, mais moins de deux émetteurs primaires : la donnée n'est connue que par relais.
Ancrage faiblegrounding_status = partielconfiance plafonnée à 55
Moins de trois sources ont franchi le portail de pertinence.
Ancrage non probantgrounding_status = partiel_non_probantconfiance plafonnée à 55
Des résultats ont été trouvés, aucun n'a franchi le portail. Le contenu des sources rejetées n'est jamais injecté : seul l'avertissement l'est.
Ancrage échouégrounding_status = echoue
Aucun résultat exploitable — clé absente, source indisponible, budget temps dépassé ou échec réseau. La réponse repose alors sur les seules données d'entraînement.
Ancrage désactivégrounding_status = desactive
L'ancrage a été désactivé dans les réglages de recherche.
Ancrage non requisgrounding_status = non_requis
Ni volatilité haute ni demande prospective : aucune recherche n'a été déclenchée, et aucun plafond ne s'applique.

Documents joints

Joindre un document bascule le run en mode Analyse. L'Analyste lit le corpus et produit une note factuelle ; le Bâtisseur ne voit jamais le texte brut.

Formats acceptésConversation · zone de dépôt26 extensions
PDF et DOCX paginés, plus les formats texte et code : .pdf .docx .txt .md .csv .json .yaml .yml .ts .tsx .js .jsx…
Taille maximaleConversation · zone de dépôt50.0 Mo
Par fichier. Le texte est extrait côté serveur avec sa carte des pages, pour que les citations soient localisables et le document ouvrable à la bonne page.
Pagination maximale d'un PDFConversation · zone de dépôt500 pages
Le plafond ne borne pas l'Analyste mais l'extraction du texte, qui tourne dans la requête : au-delà, le dépôt est refusé en annonçant le compte réel de pages. Découpez le document et joignez les parties séparément — le mode Analyse en accepte plusieurs, et les traite comme un corpus unique.
Découpage du corpusAutomatique
Si le corpus dépasse 70 % de la fenêtre du modèle Analyste, il est découpé en segments avec 10 % de recouvrement. Le cas est signalé dans les diagnostics : le corpus n'a alors pas été traité d'un seul tenant.
Frontière de confianceAutomatique
Le contenu des documents est traité comme une donnée non fiable, jamais comme une instruction. Une tentative d'injection de consigne détectée dans un document est ignorée et signalée.

Budget et garde-fous

L'estimation avant lancement est une heuristique. L'imputation, elle, n'utilise que le coût réel renvoyé par le fournisseur, appel par appel.

Plafond mensuelRéglages · Budget20 crédits
Remis à zéro au changement de période. Atteint, seul le mode Éclair reste disponible.
Seuil d'alerteRéglages · Budget80 % du plafond
Au-delà, un bandeau d'alerte apparaît au-dessus de la zone de saisie.
Seuil de confirmationRéglages · Budget0.25 crédit
Un run dont le coût prévisionnel dépasse ce seuil demande une confirmation explicite, avec le détail par étape et le budget restant.
Seuil de confirmation du débatConversation · barre du mode Débat0,25 $ — enregistré dans le navigateur
Contrôle distinct du précédent, calculé sur les tarifs réels du panel avant lancement.
Garde-fous techniquesNon configurables12 étapes · 10 min · 20 runs/h
Un run qui dépasse le nombre d'étapes ou la durée est interrompu et marqué comme tel. Un run ne peut jamais en déclencher un autre. Un run ne reste jamais bloqué en cours : il porte toujours, en sortie, un statut terminal, une durée et un coût.

Indice de confiance

L'indice n'est pas déclaré par un modèle : il est calculé à partir de l'audit et du journal de révision, puis écrêté côté serveur.

Base (mode Équipe)Calculé0 à 100
Moyenne pondérée des notes du Relecteur : exactitude, raisonnement et cadrage comptent double ; sourcing, complétude et actionnabilité comptent simple.
PénalitésCalculé−25 · −10 · −8 · −15
Par problème critique non résolu, par problème majeur non résolu, par point contesté sans argument, et si le verdict global est « rejeter ». Un problème absent du journal de révision compte comme non résolu.
Mémoire de la conversationAutomatiquele dernier échange
Une question de suite — « et pour une commune de 5 000 habitants ? » — reçoit désormais le rappel du dernier échange : la question précédente et sa réponse, bornées à 400 et 1 200 caractères. Le rappel n'est envoyé qu'aux rôles qui répondent à la question ; le Relecteur et la Révision travaillent sur le texte produit. Il se déclare subordonné aux sources et ordonne d'ignorer toute instruction qu'il contiendrait — une réponse précédente reste un texte produit par un modèle. Au-delà d'un échange, l'historique n'est pas transmis : reformulez la question plutôt que d'attendre du fil qu'il se souvienne.
Progression et détail techniqueConversation3 à 4 jalons
Pendant l'exécution, le fil affiche des jalons nommés en français ordinaire — Rédaction, Relecture, Correction, ou Réponses indépendantes, Critique croisée, Arbitrage — plutôt que les neuf rôles techniques. Le Routeur n'y figure pas : il choisit le mode, il ne produit rien que l'utilisateur attende. Le cockpit complet reste accessible par « Détail technique », dans l'en-tête de la conversation, et votre choix est mémorisé.
Indice de confiance, en clairBandeau de réponseélevée · moyenne · limitée · faible
Le score est doublé d'un mot, dont les seuils reprennent les plafonds que l'application applique déjà : au-delà de 75 aucun plafond ne s'applique ; en dessous de 55 l'ancrage externe est dégradé ; en dessous de 50 la question a été jugée non décidable en l'état. Le détail du calcul reste dans le cockpit.
Relances proposéesSous chaque réponse4 au maximum
Après une réponse, l'application propose jusqu'à quatre relances tirées de ce que le run a laissé ouvert : un désaccord que l'arbitre n'a pas tranché, une information qu'il a désignée comme manquante, un angle mort qu'aucune contribution n'a traité, un point que la Révision a contesté au Relecteur. Chaque puce affiche sa provenance. Un clic relance une exécution sur cette question, dans le mode courant. La relance est autoportante : elle embarque la question initiale, le point resté ouvert et les positions en présence, car chaque exécution repart de zéro et ne reçoit pas l'historique du fil. Aucun appel de modèle n'est nécessaire pour les produire — et quand le run n'a rien laissé d'ouvert, aucune relance n'est proposée : en inventer serait fabriquer du contenu.
Choix automatique du modèleRéglages · Rôlesaptitude, pas qualité
Un rôle sans assignation ne reçoit plus le premier modèle venu : le modèle est calculé à partir de ce que le rôle exige — sortie structurée pour le Relecteur et l'Arbitre, fenêtre suffisante pour ceux qui lisent, coût minimal pour le Routeur qui ne fait qu'aiguiller. Les recours privilégient un fournisseur différent, et l'Arbitre est pris hors du panel du débat. Le classement porte sur l'aptitude et la diversité, jamais sur une qualité supposée : le registre ne la connaît pas, seule la calibration la mesure. Une assignation explicite reste prioritaire.
Verdict du RelecteurPrompt Relecteurvalider · reviser · rejeter
Gravité et verdict sont deux axes distincts : la gravité mesure ce que coûte le défaut s'il reste, le verdict répond à une seule question — où est la faute ? Dans la question (présupposé faux, question non décidable) ou dans l'intégrité du texte audité (source fabriquée, consigne injectée) : « rejeter ». Dans la réponse : « reviser », quelle que soit la gravité, même s'il faut tout réécrire. Aucun problème majeur ni critique : « valider ».
Réponse sans défautPrompt Relecteur0 problème = valider
Ne rien trouver est un résultat légitime : un relecteur qui remonte toujours un problème ne mesure plus rien. Ne comptent pas comme problèmes : une connaissance générale exacte non sourcée, l'exposé honnête d'une controverse ouverte, le refus de trancher faute d'éléments, une réserve que la réponse a elle-même posée, une préférence de style. En revanche une donnée donnée pour relevée sans provenance — chiffre, date, référence, étude — reste critique.
Confiance (mode Débat)Calculé−12 par désaccord persistant
La confiance de l'arbitre est retenue, puis plafonnée en fonction du nombre de désaccords que l'arbitrage n'a pas tranchés.
Plafond « aucun fait vérifiable »Imposé côté serveur50
S'applique aux questions factuelles ou analytiques quand le routeur signale qu'aucun fait vérifiable n'est disponible, ou quand une volatilité haute n'a pas pu être ancrée.
Plafond « ancrage faible »Imposé côté serveur55
S'applique dès que l'ancrage a été tenté sans réunir trois sources retenues dont deux primaires, toutes natures de question confondues.
Plafond « question prospective »Imposé côté serveur45
Aucune source ne peut confirmer un état futur : l'ancrage ne documente que la situation présente.

Le plafond le plus contraignant s'applique, et toutes les raisons sont consignées avec le run. Une demande créative ou procédurale n'est jamais écrêtée : la notion de fait vérifiable n'y a pas de sens.

Intégrité des citations

Un modèle réécrit volontiers de mémoire les URL, les émetteurs et les dates qu'on lui a transmis, puis présente le résultat comme vérifié. Aucune réponse n'est enregistrée sans passer par ce contrôle, dès qu'un ancrage a été tenté.

URL inconnueContrôle automatique
Toute URL absente des sources transmises est retirée de la réponse et remplacée par une mention explicite.
Référence hors intervalleContrôle automatique
Les identifiants autorisés sont attribués par l'application, de [S1] à [Sn], sur les seules sources retenues. Toute autre référence est retirée.
Date divergenteContrôle automatiquetolérance 30 jours
Une date citée qui s'écarte de la métadonnée transmise au-delà de la tolérance est rétablie à sa valeur réelle.
Émetteur substituéContrôle automatique
Attribuer à une source l'émetteur d'une autre est corrigé depuis les métadonnées.
Prétention à vérificationContrôle automatique
« J'ai vérifié les sources » et ses variantes sont supprimées : aucun modèle n'a cette capacité.
Intégrité compromiseContrôle automatiqueau-delà de 30 % de citations non conformes
Une relance unique est effectuée avec la liste des écarts en contexte, le run est marqué partiel, et le détail des violations est conservé avec le run.

Calibration et analytique

Le banc de calibration mesure si un couple prompt / modèle détecte réellement les défauts qu'il est censé détecter, plutôt que de faire confiance à son verdict.

Motifs de défautÉvaluation11 motifs
P1 donnée périmée · P2 référence inventée · P3 causalité abusive · P4 faux présupposé dans la question · P5 cas limite non traité · P6 omission grave sous une réponse juste · P7 contrôle négatif : réponse saine · P8 contrôle négatif : controverse légitime · P9 question non décidable · P10 faux consensus · P11 injection de consigne
Domaines de testÉvaluation4 domaines
technique/logiciel, scientifique, juridique/normatif, gestion/finance. Un motif réussi dans un seul domaine est signalé comme compétence locale, non généralisable.
Critère de conformitéÉvaluation3 domaines sur 4 par motif
Une campagne n'est conforme que si tous les motifs sont couverts et réussis dans au moins trois domaines sur quatre. Un cas est réussi si le verdict est celui attendu, si le rappel atteint 80 % des défauts plantés, et — pour un contrôle négatif — s'il ne remonte aucun problème majeur.
Motif non exécutéÉvaluation« — » en gris
Un motif jamais exécuté n'est ni réussi ni échoué : il est signalé comme couverture manquante, et la conformité ne peut pas être prononcée tant qu'il en reste un. Une campagne incomplète s'affiche en ambre, jamais en rouge.
Reprendre une campagneÉvaluation1 cas par requête
Chaque cas est exécuté trois fois dans une requête distincte, pour rester sous la coupure de l'hébergeur. Un cas en échec technique n'interrompt pas la campagne ; « Reprendre » ne rejoue que les cas manquants, sans repayer les précédents. Trois échecs consécutifs interrompent : c'est alors le modèle ou la passerelle qu'il faut vérifier.
Alerte de régressionÉvaluation−10 points
Une baisse de plus de dix points du taux de réussite par rapport à la campagne précédente est signalée.
Empreinte des promptsAutomatique
L'empreinte de chaque prompt est figée au démarrage de la campagne : un résultat reste rattachable à la version exacte qui l'a produit.
Fenêtre et exportAnalytique30 jours par défaut
Coût par mode et par modèle, taux d'échec, latence, verdicts, retours utilisateur. L'historique complet des runs est exportable en CSV.

Chaque run conserve la trace de ses étapes dans le cockpit : prompt envoyé, réponse brute, jetons, coût, durée et statut par appel. En cas de doute sur une réponse, c'est là que se trouve la réponse à « pourquoi ».