Connaissances
La section Connaissances regroupe ce que votre agent peut retrouver : collections de documents, fichiers, outils personnalisés, wiki. Le principe du RAG est défini dans le Glossaire. Aujourd'hui, l'application affiche et gère les collections ; l'ajout de documents depuis l'interface n'est pas encore branché (détail plus bas).
Les pages
| Page | Adresse | Rôle | État |
|---|---|---|---|
| Collections | /document-stores | Vos bases de connaissances | Création, modification, duplication, suppression en service |
| Outils | /tools | Outils personnalisés de l'agent | Création, modification, suppression en service |
| Vecteurs | /vectors | Collections de la base vectorielle | Réservée à l'opérateur de la plateforme (voir plus bas) |
| Fichiers | /files | Fichiers de votre espace | Liste et suppression (l'envoi est prévu, voir plus bas) |
| Intents & NLU | /intents | Intentions et entités | Page présente (non détaillée ici) |
| Wiki LLM | /wiki | État de la synchronisation du wiki | Voir plus bas |
| Médiathèque | /mediatheque | Médias par discipline | Page présente (non détaillée ici) |
| Formulaire pré-chat | /pre-start | Formulaire avant la conversation | Page présente (non détaillée ici) |
Les plans Essentiel n'affichent que Collections et Fichiers. Les autres pages apparaissent à partir du plan Starter (voir Tarification et offres).
Collections
La page liste vos collections avec quatre compteurs (collections, documents, morceaux, synchronisées). Une collection se crée, se modifie, se duplique, se supprime. Supprimer demande de retaper le nom.
Ouvrir une collection mène à /document-stores/<id>, une page à quatre onglets : Documents, Configuration, Preview, Vector Store. Cette page de détail est aujourd'hui une coquille avec des données d'exemple. Le bouton d'ajout de document propose cinq onglets (Fichier, URL, Sitemap, Table, Configuration), mais son envoi n'est pas branché.
Ce que l'API ne fait pas encore
Ces appels de l'API (Routes des ressources) répondent 503 FEATURE_PENDING : traiter un document (loader/process), l'envoyer par URL (loader/upload-url), l'envoyer en table (loader/upload-table), supprimer ou remplacer un document d'une collection.
Formats de fichier
| Format | État |
|---|---|
| Texte, Markdown, CSV, JSON, HTML, journaux | La fonction d'analyse du code (kb_parse.rs) les lit comme du texte |
| PDF, DOCX, XLSX, PPTX | La même fonction les refuse explicitement : l'analyse de ces formats n'est pas branchée |
| Pages web, sitemaps | Routes d'exploration présentes (scrape/page, scrape/sitemap, crawl) |
Aucune route de l'API n'appelle encore cette fonction d'analyse : l'ingestion actuelle reçoit du texte déjà extrait (/rag/ingest). L'analyse des PDF et des documents Office est prévue : spec 115, tâches T-115-22 (admission des fichiers), T-115-23 (envoi), T-115-25 (branchement de l'analyse). Le crate d'extraction documentaire est en cours de livraison (T-115-31) ; il n'est pas branché sur l'API.
En attendant, l'API sait indexer un texte déjà extrait : voir « Indexer un texte » dans Routes des ressources.
Pipeline d'indexation
- Le texte est extrait.
- Il est découpé en morceaux. Le service de découpage intelligent propose cinq techniques, dont certaines appellent le modèle local
ministral-3:3b. - Chaque morceau reçoit un vecteur de 384 dimensions, calculé en local par
paraphrase-multilingual-MiniLM-L12-v2(fastembed, licence Apache-2.0 ; voir Fournisseurs de modèles). - Les vecteurs sont rangés dans Qdrant (variables dans Variables d'environnement), dans des collections préfixées par l'identifiant de l'organisation. Ce cloisonnement est décrit dans Architecture Chatbotaurus.
Le suivi de progression en temps réel d'une ingestion n'est pas couvert par la page de détail actuelle.
Vecteurs
La liste des collections Qdrant est une vue de plateforme : elle exige une élévation d'opérateur et répond 403 sinon. La page décode un tableau alors que l'API rend un objet (engine, collections, total_vectors) : la liste ne s'affiche pas correctement. Les routes de lecture des enregistrements, de recherche et de synchronisation par collection (/vectors/<id>/...) n'existent pas dans l'API. Cette page est donc, pour un client, une page annoncée et non utilisable.
Fichiers
La page liste les fichiers de l'espace et permet d'en supprimer. L'envoi de fichiers depuis l'application, avec contrôle et chiffrement, est prévu : T-115-23 et T-115-24.
Outils
Un outil personnalisé a un nom, une couleur, une description, un schéma d'entrée (JSON Schema) et un corps de fonction. La page enregistre ces champs dans votre espace. L'exécution du corps de fonction par l'agent n'est pas couverte par ce chapitre.
Wiki LLM
Le wiki est un arbre de pages Markdown (format OKF : un fichier à en-tête type, l'identifiant est le chemin). Le serveur le lit depuis un dossier, un WebDAV ou un stockage S3. Aucun éditeur web n'est hébergé : on édite les fichiers dans le stockage. La page /wiki offre le bouton « Reindex now » et l'état de la synchronisation.
Voir aussi
- Chat : parler à un workflow déployé
- Sécurité et identifiants : les accès aux services externes et à l'API
- Routes des ressources : les routes du Document Store et des outils personnalisés
- Sauvegarde et restauration : ce qui est sauvegardé, dont les collections Qdrant
- Limites et ce que la plateforme ne fait pas : taille des fichiers et limites de l'IA ancrée
- Conseils : sessions courtes, demandes itérées, données protégées