Le projet CollEx IndexAngkor : Navigation dans les documents de la Conservation d’Angkor
De septembre 2022 à avril 2025 l’École française d’Extrême-Orient (EFEO) a réalisé le projet CollEx IndexAngkor, financé avec le soutien de CollEx-Persée, et conduit par le service des archives de l’établissement, la Bibliothèque de l’EFEO à Paris, des membres chercheurs de l’équipe Construction des Centres de Civilisations, en partenariat avec l’Autorité pour la Protection du Site et l’Aménagement de la Région d’Angkor (APSARA).
Dans une série de plusieurs articles, l’équipe projet présente le corpus et le contexte d’IndexAngkor, ses avancées et sa mise en production.
Le sixième article est écrit par Vincent PAILLUSSON, Responsable informatique de l’EFEO jusqu’en janvier 2024, et désormais Chargé des projets numériques au Laboratoire d’histoire des théories linguistiques (UMR 7597). Cet article propose de décrire le deuxième objectif du projet IndexAngkor relatif à la navigation dans les documents de la Conservation d’Angkor (CA). Il fait suite aux articles sur la présentation générale du projet et sur les opérations de numérisation et de description des archives de la CA.
Contexte
Comme expliqué dans les précédents articles, la documentation de la CA est riche de plusieurs dizaines de milliers de documents hétérogènes. Naviguer dans cette masse documentaire n’est pas chose aisée, toutefois les Journaux de fouilles de la CA (JFCA) conservent, sous forme d’annotations, les liens entre les activités de conservation, les sites et les différents documents produits par la CA.
Navigation
Le projet propose donc une navigation dans les documents de la CA en s’appuyant sur deux axes :
- 1) les JFCA qui renvoient aux sites d’Angkor et aux nombreux documents de la CA via des annotations au sein même des pages du document,

- 2) la génération d’un index des sites d’Angkor mentionnés dans les JFCA qui permet, pour un site donné, de lister toutes ses références dans les JFCA.

Cette navigation propose les fonctionnalités suivantes :
Annotations des JFCA
- la consultation d’une page précise d’un journal de fouilles via son URL,
- l’affichage des annotations présentes dans les pages d’un JFCA (références aux sites d’Angkor et à d’autres documents de la CA),
- la recherche dans ces annotations,
Index
- la consultation des sites d’Angkor sous forme d’index
- la liste de l’ensemble des références dans les JFCA pour un site donné.
Implémentation technique
Techniquement, le projet IndexAngkor se construit dans le prolongement de la bibliothèque numérique de l’EFEO, banyan.efeo.fr, mise en place en 2021 et développée sous Omeka-S. Il offre une opportunité de mise à jour de ce logiciel tout en révisant l’utilisation et l’organisation des modules complémentaires utilisés jusqu’alors.
D’autre part, la mise en place d’un processus de travail (workflow) spécifique a permis de ne s’appuyer que sur Nakala pour exposer les ressources images en IIIF.
Quelques explications sur le IIIF utilisé dans Banyan.
La norme IIIF permet l’exploitation centralisée d’images de haute qualité. Dans la première version de la bibliothèque numérique de 2021, les images étaient déposées sur Nakala qui les exposait individuellement via IIIF (cela permet notamment la gestion du zoom sur une image ou encore la sélection et l’affichage de parties d’image seulement). La présentation IIIF de ces images, réalisée via la génération d’un manifeste IIIF (document textuel structuré qui décrit quelles images il faut afficher pour une ressource donnée) était effectuée par Omeka-S. Cela créait une dépendance technologique forte entre Omeka-S et ce service d’images que nous souhaitons le plus pérenne et stable possible pour cette nouvelle mouture. C’est pourquoi, dans la version 2 de la bibliothèque numérique, résultante du projet Collex IndexAngkor, ce service est intégralement géré du côté de Nakala.
Les nouvelles fonctionnalités implémentées ont donc nécessité les modifications et opérations techniques suivantes :
Annotations des JFCA
- l’utilisation et la modification du module Omeka-S Mirador Viewer pour naviguer dans les numérisations d’un JFCA et pour intégrer un numéro de page en paramètre d’URL,
- la mise en place d’un workflow d’annotations et de versement d’un manifeste IIIF annoté sur Nakala,
- le développement d’un module Omeka-S spécifique pour effectuer des recherches dans les annotations IIIF et les afficher dans Mirador,
Index
- la consultation de la liste des sites d’Angkor, via l’utilisation d’un bloc d’indexation alphabétique généré par Omeka-S.
- l’import et la gestion de métadonnées relatives aux documents de la CA et aux sites d’Angkor.
Focus sur le workflow d’annotation et de versement du manifeste IIIF dans Nakala
La mise en place de ce workflow répond à deux objectifs :
- continuer de s’appuyer sur Nakala pour exposer les images en IIIF (API Image) afin de garantir une accessibilité qui dépasse le cadre d’une bibliothèque numérique, et ainsi les rendre compatibles avec une démarche de science ouverte (application des principes FAIR),
- implémenter les fonctionnalités IIIF non présentes nativement sur Nakala: notamment l’API Presentation avec gestion des annotations et l’API Content Search.
Petit rappel lié aux fonctionnalités IIIF évoquées ici.
API Image IIIF : Donne les informations et mécanismes nécessaires à l’affichage d’une image de haute qualité ou à la sélection d’une zone précise de celle-ci.
API Présentation IIIF : Donne les informations nécessaires et mécanismes d’échange, à travers un document appelé manifeste IIIF, pour naviguer dans un ensemble d’images associé ou non à des métadonnées, à des formats de téléchargement ou à une table des matières le cas échéant.
API Search IIIF : permet la recherche dans les annotations qui sont associées au manifeste généré par l’API Présentation.
Saisie des annotations
Les annotations d’images consistent en des coordonnées de rectangles au sein d’une image auxquelles on ajoute des informations textuelles. Pour les réaliser nous avons fait le choix de nous appuyer sur le logiciel OpenSource Tropy et sur un export des annotations dans un format structuré en JSON-LD.

Génération et dépôt du manifeste
Une fois les annotations d’un JFCA effectuées, nous avons écrit un script python qui génère un manifeste IIIF et le verse dans une ressource Nakala dont l’identifiant a été communiqué en paramètre de l’appel du script. Le manifeste IIIF intègre les données d’annotations et les informations nécessaires à la navigation dans les images d’un jJFCA.
L’affichage des images dans Banyan via le module Mirador s’effectue en renseignant l’adresse de ce manifeste IIIF comme valeur du champ dc:hasFormat dans les métadonnées associées à une ressource dans Omeka-S.
Gestion de la recherche
Pour intégrer la recherche dans les annotations liées à un manifeste IIIF il n’est malheureusement pas possible de s’appuyer uniquement la capacité de Nakala à exposer des fichiers sur le web comme nous l’avons fait dans l’étape précédente. Un service (c’est à dire un script qui renvoie une réponse précise à une requête spécifique) doit être implémenté. Le plus cohérent compte tenu des ressources à disposition était de s’appuyer sur le socle logiciel Omeka-S. Plusieurs modules existent pour effectuer des recherches dans les manifestes IIIF mais ils ne correspondaient pas exactement à ce que nous souhaitions faire. Un module Omeka-S a donc été développé pour fournir cette fonctionnalité manquante. Il renvoie les informations nécessaires pour que Mirador affiche les résultats d’une recherche au sein des annotations IIIF d’un JFCA en cours de consultation.

Conclusion
Les nouvelles fonctionnalités développées dans le cadre du projet CollEx IndexAngkor facilitent la navigation au sein d’un corpus d’images conséquent en permettant de se déplacer directement d’une mention à l’autre du terme recherché, sans avoir à refaire une recherche en passant par un sommaire.
Par ailleurs, les développements effectués et la méthodologie utilisée pour centraliser l’exposition IIIF des images sur Nakala pourront être réutilisés et servir pour d’autres projets similaires.



OpenEdition vous propose de citer ce billet de la manière suivante :
Vincent Paillusson (13 février 2025). Le projet CollEx IndexAngkor : Navigation dans les documents de la Conservation d’Angkor. ArchivEFE. Consulté le 4 septembre 2026 à l’adresse https://doi.org/10.58079/13b6o