Une architecture ouverte composée de services indépendants

Data Fair est développé selon un modèle open core : un socle de services open source (AGPL v3 ou MIT) que vous pouvez installer, auditer et faire évoluer, et des plugins métier (applications, traitements, connecteurs) distribués en code ouvert sous licence AGPL v3 + Commons Clause. Tout le code reste lisible, modifiable et forkable ; seule la revente commerciale des plugins telle quelle est soumise à un accord avec Koumoul. L'OSI classe ces licences comme « source-available » : nous parlons de code ouvert à restriction commerciale, par transparence.

Chaque service est indépendant et déployable séparément : vous pouvez installer la plateforme complète ou seulement les briques utiles à votre besoin, et faire évoluer votre déploiement progressivement.

Le socle open source

Module Rôle Licence Code source
data-fair Import, stockage, exposition API, gouvernance, moteur d'applications AGPL-3.0 data-fair
portals Portails de données (CMS orienté data), recherche et catalogues AGPL-3.0 portals
simple-directory Utilisateurs, organisations, groupes et SSO MIT simple-directory
catalogs Moteur des connecteurs d'import/export de catalogues AGPL-3.0 catalogs
processings Moteur des traitements : collecte, transformations, enrichissements AGPL-3.0 processings
agents · mcp Briques IA : agents, requêtage en langage naturel et serveur MCP AGPL-3.0 agents · mcp
events Événements, notifications, traçabilité MIT events
metrics Analyse d'audience et métriques d'API AGPL-3.0 metrics

L'organisation GitHub regroupe l'ensemble des dépôts : github.com/data-fair.

Les plugins : applications, traitements, connecteurs

Les plugins étendent la plateforme et sont maintenus par Koumoul et ses partenaires. Leur code est ouvert et auditable, en AGPL v3 + Commons Clause : la revente commerciale du logiciel tel quel est soumise à un accord préalable, et les versions packagées et maintenues sont distribuées via le registre Data Fair.

Installer et contribuer

La documentation d'installation détaille le déploiement par Docker Compose sur votre infrastructure. Le code source de chaque composant est disponible sur GitHub : vous pouvez l'auditer, le modifier et contribuer, sous réserve du respect des licences.

Prérequis de stockage : Data Fair s'appuie sur trois briques d'infrastructure : MongoDB pour les données applicatives (métadonnées, comptes, configurations, contenus), Elasticsearch pour l'indexation et la recherche dans les jeux de données, et un stockage objet compatible S3 (MinIO, OVHcloud, Scaleway…) pour les fichiers importés, les pièces jointes et les révisions (FILES_STORAGE=s3). Ces briques peuvent être managées ou auto-hébergées.

Conteneurs et déploiement : chaque service est livré sous forme d'image de conteneur (ghcr.io/data-fair/…). Les recettes d'installation officielles se déploient avec Docker Compose (variantes locale et production) ; l'architecture en services indépendants s'opère également sur Kubernetes. Les serveurs et les workers sont séparés (core, traitements) pour que les imports lourds ne bloquent pas l'API.

Pour aller plus loin