Bases de connaissances

Une base indexe vos documents pour que vos agents les retrouvent par le sens, pas par mot-clé. Nous lisons la source là où elle vit et n’en gardons que les vecteurs. Choisissez une base dans le panneau pour l’ouvrir.

Bases

4

Documents indexés

41 276

291 990 fragments

Volume vectorisé

4,5 Go

Bases à jour

2

sur 4

Choisissez une base

Le panneau de gauche liste les bases de cet Espace. Sa fiche donne la source, le découpage, les habilitations qui la filtrent et la manière de l’interroger.

Connecteurs d’ingestion

D’où les documents peuvent venir. Nous lisons la source là où elle vit et n’en gardons que les vecteurs — pas de seconde copie de vos documents chez nous.

Drive SyneliaDisponible

PDF, DOCX, ODT, TXT, MD

Synchronisation par dossier, respect des partages en place

Stockage objet S3Disponible

Tous formats textuels, PDF, CSV

Par préfixe de bucket, avec filtre sur les métadonnées

Dépôt gitDisponible

Markdown, code, ADR

Par branche, réindexation à chaque poussée si un webhook est posé

Exploration de siteDisponible

HTML

Profondeur et domaine bornés, robots.txt respecté

SharePointDisponible

PDF, DOCX, XLSX, PPTX

Application Entra ID à déclarer côté client, portée en lecture

ConfluenceDisponible

Pages, pièces jointes

Par espace, avec les restrictions de page conservées

NotionAperçu

Pages, bases

En aperçu : la pagination de l’API Notion rend la synchronisation lente au-delà de 5 000 pages

Téléversement directDisponible

PDF, DOCX, TXT, CSV

Pour un corpus figé. Sans source vivante, l’index vieillit sans prévenir

Le téléversement direct est le dernier recours

Déposer des fichiers une fois donne un index qui vieillit sans prévenir : la procédure révisée en octobre restera absente jusqu’à ce que quelqu’un y repense. Branchez une source vivante partout où c’est possible, même au prix d’une configuration d’accès.