Raccourcis clavier

Appuyez sur ← ou → pour passer d'un chapitre à l'autre

Appuyez sur S ou / pour rechercher dans la documentation

Appuyez sur ? pour afficher cette aide

Appuyez sur Échap pour masquer cette aide

Connaissances

La section Connaissances regroupe ce que votre agent peut retrouver : collections de documents, fichiers, outils personnalisés, wiki. Le principe du RAG est défini dans le Glossaire. Aujourd'hui, l'application affiche et gère les collections ; l'ajout de documents depuis l'interface n'est pas encore branché (détail plus bas).

Les pages

PageAdresseRôleÉtat
Collections/document-storesVos bases de connaissancesCréation, modification, duplication, suppression en service
Outils/toolsOutils personnalisés de l'agentCréation, modification, suppression en service
Vecteurs/vectorsCollections de la base vectorielleRéservée à l'opérateur de la plateforme (voir plus bas)
Fichiers/filesFichiers de votre espaceListe et suppression (l'envoi est prévu, voir plus bas)
Intents & NLU/intentsIntentions et entitésPage présente (non détaillée ici)
Wiki LLM/wikiÉtat de la synchronisation du wikiVoir plus bas
Médiathèque/mediathequeMédias par disciplinePage présente (non détaillée ici)
Formulaire pré-chat/pre-startFormulaire avant la conversationPage présente (non détaillée ici)

Les plans Essentiel n'affichent que Collections et Fichiers. Les autres pages apparaissent à partir du plan Starter (voir Tarification et offres).

Collections

La page liste vos collections avec quatre compteurs (collections, documents, morceaux, synchronisées). Une collection se crée, se modifie, se duplique, se supprime. Supprimer demande de retaper le nom.

Ouvrir une collection mène à /document-stores/<id>, une page à quatre onglets : Documents, Configuration, Preview, Vector Store. Cette page de détail est aujourd'hui une coquille avec des données d'exemple. Le bouton d'ajout de document propose cinq onglets (Fichier, URL, Sitemap, Table, Configuration), mais son envoi n'est pas branché.

Ce que l'API ne fait pas encore

Ces appels de l'API (Routes des ressources) répondent 503 FEATURE_PENDING : traiter un document (loader/process), l'envoyer par URL (loader/upload-url), l'envoyer en table (loader/upload-table), supprimer ou remplacer un document d'une collection.

Formats de fichier

FormatÉtat
Texte, Markdown, CSV, JSON, HTML, journauxLa fonction d'analyse du code (kb_parse.rs) les lit comme du texte
PDF, DOCX, XLSX, PPTXLa même fonction les refuse explicitement : l'analyse de ces formats n'est pas branchée
Pages web, sitemapsRoutes d'exploration présentes (scrape/page, scrape/sitemap, crawl)

Aucune route de l'API n'appelle encore cette fonction d'analyse : l'ingestion actuelle reçoit du texte déjà extrait (/rag/ingest). L'analyse des PDF et des documents Office est prévue : spec 115, tâches T-115-22 (admission des fichiers), T-115-23 (envoi), T-115-25 (branchement de l'analyse). Le crate d'extraction documentaire est en cours de livraison (T-115-31) ; il n'est pas branché sur l'API.

En attendant, l'API sait indexer un texte déjà extrait : voir « Indexer un texte » dans Routes des ressources.

Pipeline d'indexation

  1. Le texte est extrait.
  2. Il est découpé en morceaux. Le service de découpage intelligent propose cinq techniques, dont certaines appellent le modèle local ministral-3:3b.
  3. Chaque morceau reçoit un vecteur de 384 dimensions, calculé en local par paraphrase-multilingual-MiniLM-L12-v2 (fastembed, licence Apache-2.0 ; voir Fournisseurs de modèles).
  4. Les vecteurs sont rangés dans Qdrant (variables dans Variables d'environnement), dans des collections préfixées par l'identifiant de l'organisation. Ce cloisonnement est décrit dans Architecture Chatbotaurus.

Le suivi de progression en temps réel d'une ingestion n'est pas couvert par la page de détail actuelle.

Vecteurs

La liste des collections Qdrant est une vue de plateforme : elle exige une élévation d'opérateur et répond 403 sinon. La page décode un tableau alors que l'API rend un objet (engine, collections, total_vectors) : la liste ne s'affiche pas correctement. Les routes de lecture des enregistrements, de recherche et de synchronisation par collection (/vectors/<id>/...) n'existent pas dans l'API. Cette page est donc, pour un client, une page annoncée et non utilisable.

Fichiers

La page liste les fichiers de l'espace et permet d'en supprimer. L'envoi de fichiers depuis l'application, avec contrôle et chiffrement, est prévu : T-115-23 et T-115-24.

Outils

Un outil personnalisé a un nom, une couleur, une description, un schéma d'entrée (JSON Schema) et un corps de fonction. La page enregistre ces champs dans votre espace. L'exécution du corps de fonction par l'agent n'est pas couverte par ce chapitre.

Wiki LLM

Le wiki est un arbre de pages Markdown (format OKF : un fichier à en-tête type, l'identifiant est le chemin). Le serveur le lit depuis un dossier, un WebDAV ou un stockage S3. Aucun éditeur web n'est hébergé : on édite les fichiers dans le stockage. La page /wiki offre le bouton « Reindex now » et l'état de la synchronisation.

Voir aussi