À l'ère des données, la quantité de données biomédicales et biologiques augmente de manière exponentielle. Ces données sont souvent stockées dans des silos, dispersées et très hétérogènes. Ces problèmes entravent la (ré)utilisation et l'échange des données, et donc les progrès et les avancées dans les domaines des sciences de la vie et de la recherche en matière de santé. Le groupe de réflexion sur le web sémantique des données travaille à l'élaboration de solutions communes pour l'intégration transparente des ensembles de données et des bases de données en sciences de la vie, ainsi que pour leur mise en conformité avec les principes FAIR.
À propos du Web sémantique des données
Le Web sémantique fournit un cadre commun qui permet le partage et la réutilisation des données au-delà des frontières des applications, des entreprises et des communautés. Il repose sur le Resource Description Framework (RDF), un modèle de données orienté graphe. En savoir plus
Des silos de données à un Web sémantique des données
Les données relatives aux sciences de la vie sont intrinsèquement hétérogènes, par exemple en termes de formats, de modélisation, de stockage, de modes d'accès et de sémantique. Cette hétérogénéité rend très difficile la découverte et l'intégration transparente des données, qui sont essentielles pour mettre au jour les processus et les modèles biologiques.Le « groupe de réflexion sur le web sémantique des données » vise à construire un web sémantique de données biologiques et biomédicales (voir encadré) afin de favoriser l'intégration et la réutilisabilité des données de recherche. Ce web de données peut inclure des ensembles de données privés et publics de manière souple. Rendre les données FAIR est une condition préalable à la réussite.
À propos des groupes de discussion du SIB
Les groupes de discussion visent à favoriser les échanges de connaissances et les collaborations au sein de la communauté des 900 membres du SIB, autour de thèmes scientifiques spécifiques et/ou transversaux, allant du séquençage unicellulaire à l'égalité, la diversité et l'inclusion. Voir tous les groupes de discussion
Un groupe de réflexion dédié à l'échelle du SIB
Lancé en 2022, ce groupe de réflexion est un groupe de R&D très dynamique composé de plus de 30 membres issus de plusieurs groupes du SIB, qui se réunit tous les deux mois pour discuter des technologies, des défis et des solutions récents liés au RDF. Leurs dernières réalisations sont communiquées par la co-rédaction et la publication d'articles de recherche, des réunions externes et des présentations lors de conférences. Par exemple, un an après le lancement de ce groupe de réflexion, un article a été publié dans le numéro de la base de données Nucleic Acids Research (voir référence 1 : https://doi.org/10.1093/nar/gkad902).
Membres coordinateurs du groupe de réflexion :
- Jerven Bolleman (président), ingénieur logiciel principal, Swiss-Prot
- Séverine Duvaud (coprésidente), chef d'équipe, Ressources de données biologiques
- Tarcisio Mendes de Farias, co-chef d'équipe, Unité de représentation des connaissances
- Marco Pagni, chef d'équipe, Biologie computationnelle
- Ana Claudia Sima, co-chef d'équipe, Unité de représentation des connaissances
Vous êtes membre du SIB et souhaitez rejoindre le groupe ? Contactez Ana Claudia Sima ou Séverine Duvaud
RÉFÉRENCES
- Membres du groupe RDF du SIB Institut Suisse de Bioinformatique, « Le SIB Institut Suisse de Bioinformatique Semantic Web of data », Nucleic Acids Research 2023. DOI : 10.1093/nar/gkad902
- Bolleman J. et al., « Une grande collection de paires question–query en bioinformatique sur des graphes de connaissances fédérés : méthodologie et applications », GigaScience 2025, DOI : 10.1093/gigascience/giaf045