Parution

Publication de CAO_CRM (Corpus Author Ontology CRM) v1.0 : une ontologie pour décrire les métadonnées des œuvres littéraires

Le 1 juillet 2026

Le groupe de travail « Métadonnées et modélisation des données » du Consortium Huma-Num ARIANE annonce la publication de la version 1.0 de CAO_CRM (Corpus Author Ontology CRM), une ontologie destinée à la description des métadonnées des corpus textuels et, plus particulièrement, des objets littéraires.

Le texte littéraire n’est pas un objet univoque : il relève à la fois de la création intellectuelle, de la matérialité documentaire, de la ressource linguistique et de l’objet numérique. Les standards existants, tels que l'en-tête XML-TEI ou le Dublin Core, ne permettent pas toujours de distinguer de manière suffisamment précise ce qui relève de l’œuvre, de l’expression, de la manifestation, de l’exemplaire physique ou encore de l’objet numérique.

CAO_CRM répond à ce besoin, identifié notamment dans le cadre du projet AMIS, en proposant un modèle intégré qui permet de décrire les différentes étapes et formes d’existence d’une œuvre littéraire : sa création, ses différentes expressions (par exemple une traduction ou une adaptation), ses éditions et publications, ainsi que les exemplaires physiques et leurs versions numériques.

Méthode et composition :

CAO_CRM est un module qui réutilise et articule des classes et des propriétés issues de trois modèles de référence :
  • CIDOC-CRM 7.1.3
  • LRMoo 1.1.1
  • CRMdig 5.0
CAO_CRM ne crée donc pas de nouvelles classes ni de nouvelles propriétés. Les cinq seules exceptions sont des sous-propriétés de rôle (auteur original, traducteur, abréviateur, éditeur commercial et éditeur scientifique) définies à partir de propriétés existantes du CIDOC-CRM, conformément à son Encoding Rule 4.

Validation :

Le module a été soumis au raisonneur OWL HermiT, qui n’a détecté aucune classe insatisfaisable. Il a également été validé au regard de contraintes SHACL et vérifié visuellement dans Protégé.

Ces vérifications ont ensuite été complétées par une chaîne de trois audits indépendants et successifs, chacun fondé sur une consultation directe des fichiers sources officiels plutôt que sur des documents de synthèse. Une chaîne de validation automatisée, comprenant huit catégories de contrôles dont l’évaluation FAIR via FOOPS! (score : 0,80/1,0), accompagne par ailleurs chaque modification du module.

Équipe :

Le modèle conceptuel de CAO_CRM a été initialement élaboré par Mélanie Bouland au sein du groupe de travail « Métadonnées » du Consortium Huma-Num ARIANE. Durant cette étape de modélisation, Mélanie Bouland et les membres du groupe ont bénéficié des conseils et des précieux retours du Consortium HN MASAPlus, notamment de Florian Hivert. Nous tenons à les en remercier chaleureusement.

Les échanges avec les membres de l’équipe du projet AMIS (Ala Eddine Laouir, Amelia Sanz, Ameni Guizani, Fatiha Idmhand, Ioana Galleron, Roxana Patras, Sabine Loudcher et Simone Rebora) ont ensuite largement contribué à la consolidation et à la stabilisation du modèle ontologique.

Enfin, l’encodage en RDF/OWL et la validation ont été réalisés et préparés par Andrés Echavarría Peláez (CNRS, AMIS, Consortium HN ARIANE), avec l’appui des membres d’AMIS. Cette démarche collective a permis d’aboutir à une formalisation complète du modèle, conçue pour en faciliter la réutilisation et l’exploitation dans différents environnements numériques.

Accès et licence :

L’ontologie est publiée en RDF/OWL sous licence CC BY-NC-SA 4.0 et disponible dans les sérialisations RDF/XML, Turtle, N-Triples et JSON-LD.

Documentation et téléchargements

Dépôt source