Import XML : aplatissez vos documents en données tabulaires
Pour qui ?
Collectivités, administrations et entreprises dont les sources exposent des données en XML (marchés publics, référentiels métier, flux de partenaires) et qui veulent les exploiter comme des tableaux.
Le traitement Import XML télécharge un document XML à une adresse HTTP, aplatit sa structure arborescente en colonnes et publie le résultat dans un jeu de données. Il ne demande aucun mapping : c'est la structure du document qui détermine, à elle seule, les colonnes produites.
Ce que permet l'import XML
- Aplatissement automatique : chaque occurrence de l'élément répété devient une ligne ; les sous-éléments sont dépliés en colonnes sur toute la profondeur de l'arbre ;
- Noms de colonnes lisibles : le chemin de chaque balise compose le nom de la colonne (
acheteur/nom,titulaires/titulaire/denominationSociale), avec le séparateur de votre choix ; - Types détectés : nombres et dates sont reconnus automatiquement ; le jeu se filtre, s'expose en API et se visualise comme n'importe quel autre ;
- Mise à jour : création d'un jeu de données, remplacement du fichier ou mise à jour incrémentale des lignes ;
- Planification et suivi : horaire, quotidienne, hebdomadaire, mensuelle ou manuelle ; historique d'exécution et notifications en cas d'échec.
Cas d'usage
- Attributions des marchés publics : publier la commande publique d'une collectivité exposée en XML ;
- Import et mise à jour de données : formats, planification, jeux virtuels ;
- Publication et diffusion de données : catalogue, API et réutilisations.
Pour aller plus loin
- Configurer un traitement Import XML : le cours pas à pas (structure du document, séparateur de colonnes) ;
- Programmer des mises à jour automatiques de données : la mécanique commune à tous les traitements ;
- Traitements et imports planifiés : le hub des traitements ;
- Import depuis une API JSON : quand la source répond en JSON plutôt qu'en XML.