Visibiliser des données

Étant donné le temps et les efforts importants investis dans la recherche mais aussi pour l’obtention des données, leur documentation, leur analyse, leur archivage et leur éventuel partage dans un data repository, leur donner de la visibilité est essentiel.

De plus, cela assure que les jeux de données soient conforme aux principes FAIR et aux pratiques de la science ouverte (Open Science).

⚠️Toutes les méthodes suggérées ci-dessous supposent que les données ont préalablement été mises à disposition dans un data repository.

Indiquer la disponibilité des données dans la publication

Indiquer les données dans une rubrique data statement

Certains périodiques proposent une rubrique spécifique pour indiquer le ou les jeux de données en lien avec l’article intitulée data statement ou data availability statement.
Cette section devrait comporter, a minima:

  • le nom du data repository où les données sont déposées;
  • l’identifiant unique pérenne attribué aux données (DOI, URL, numéro d’accession, autre identifiant unique pérenne);
  • les conditions d’accès aux données (sur demande, contre signature d’un contrat d’utilisation, restreint avec précision des raisons pour cela). 

"Les données [type de données, par ex. sequençage / interview / …] qui étayent les résultats de cette étude / générées et/ou analysées dans le cadre de la présente étude sont librement accessibles / disponibles sur demande / accessibles après signature d’un accord d’utilisation des données dans le dépôt [nom du repository] à l’adresse [DOI/ URL/numéro d’accession/ autre identifiant unique pérenne]. (Suivi éventuellement de la référence pointant vers la bibliographie où vous aurez indiqué la citation complète : auteur-es du jeu de donnée, titre, etc. …)"

  • "Les données qui étayent les résultats de cette étude sont librement accessibles sur Yareta à l’adresse https://doi.org/10.26037/yareta:yqae72143d."
  • "Les données de séquençage ciblé en cellule unique (single-cell) et en vrac (bulk) sont accessibles via la base de données EGA (https://www.ega-archive.org) sous les numéros EGAS00001006784 et EGAS00001006901. Les autres données sont disponibles sur demande auprès du ou de la responsable de la recherche."

Les instructions aux auteur-es proposées par les revues scientifiques comportent parfois des exemples standardisés afin d’accompagner et de structurer la rédaction du data statement. Voici quelques exemples proposés par :

De nombreux data repositories permettent de réserver un DOI, pour l’intégrer au data statement, avant la finalisation du dépôt de données. Cela permet de soumettre le manuscrit à la revue en rendant les données accessibles aux relecteurs/trices, tout en ayant le temps de finaliser le dépôt des données ensuite. 

Yareta ou Zenodo, par exemple, offrent cette possibilité.

Ajouter la référence du jeu de données dans les notes de bas de page ou dans la bibliographie

En l’absence d’une section data statement, il est toujours possible d’ajouter la référence du jeu de données directement dans la publication, par exemple dans les notes de bas de page et dans la bibliographie.
En fonction du style bibliographique de la revue, la référence du jeu de données peut inclure :

  • les auteurs ou autrices du jeu de données;
  • l’année de publication;
  • le titre du jeu de données, suivi de la mention "Data set";
  • le nom du data repository où les données sont déposées;
  • l’identifiant unique pérenne attribué aux données (DOI, URL, numéro d’accession, autre identifiant unique pérenne);
  • la version de référence, si plusieurs versions du jeu de données ont été déposées;
  • éventuellement, les conditions d’accès aux données (sur demande, contre signature d’un contrat d’utilisation, restreinte avec précision des raisons pour cela). 

Pouliot-Laforte, A. (2021). Impairments and sagittal kinematics of the lower limbs of children with cerebral palsy [Data set]. Université de Genève, Yareta. https://doi.org/10.26037/yareta:ghvxtm3d2naenafsu6ungo2sny

Créateur(s) ou créatrice(s) (Année de publication). Titre [Data set]. Nom du data repository. Identifiant unique. Version (si approprié). Licence (si approprié). 

Certains data repositories, comme Yareta ou Zenodo, permettent de générer facilement la référence bibliographique correspondant au jeu de données et dans plusieurs styles de citations (APA, MLA, …) :

Yareta

Zenodo

Citation_data.png

Créer des liens entre différentes plateformes

Il est également possible de créer ou de renforcer le lien entre les données, la publication et les chercheuses et chercheurs de l’équipe après la sortie officielle de la publication. L’idée est ainsi de permettre aux personnes accédant aux données, à la publication ou à un profil numérique de facilement localiser l'ensemble des ressources liées.

Ajouter dans le data repository un renvoi vers la publication concernée

Dans Yareta, sur la page d’édition des informations du dépôt, il faut renseigner le DOI de la publication dans le champ dédié « Données et publications associées » et « Référencé par cet autre DOI ou ARK » :publication dans le champ dédié « DOI référencé par ».

Image1.png

Sur Zenodo, il est possible de rattacher un jeu de données avec une publication lors du dépôt du jeu de données, en complétant la section « Related works » :

Image2.png

Ajouter un lien vers le jeu de données depuis le dépôt institutionnel des publications scientifiques 

La plupart des plateformes institutionnelles dédiées à la diffusion des publications scientifiques et des résultats de recherche offrent la possibilité de référencer les jeux de données parmi les métadonnées de la publication.

Si la publication est déposée dans l’Archive ouverte UNIGE, il est possible d’y indiquer où trouver les données associées dans les métadonnées, à savoir lors de l’étape 3 du dépôt ou de l’édition de la publication (Description de la publication), via le champ ad hoc « URL ou DOI du jeu de données »:

Capture d'écran 2026-07-28 155833.png

Mentionner les données dans les CVs et profils numériques

Que les jeux de données soient liés à une publication ou non, il est possible de les référencer sur les portails liés aux chercheuses et chercheurs impliqués dans la recherche  :

  • dans le profil ORCID : en ajoutant un élément « travail » du type « jeu de données ». Cet ajout peut être fait manuellement, ou en passant par le DOI du jeu de données. Dans Yareta et Zenodo, il est possible de configurer le profil pour que les publications de jeux de données soient automatiquement envoyées vers les comptes ORCID liés (voir ci-dessous).
  • dans le CV : en ajoutant une rubrique « open science » ou « open data », comme c’est le cas, par exemple, dans le nouveau modèle de CV collaboratif qui est actuellement en vigueur à la Faculté de Médecine;
  • dans la section major achievements ou research achievements du CV du FNS ou de Horizon Europe;
  • dans un rapport de fin de projet, comme celui du FNS;
  • sur les réseaux sociaux (LinkedIn, par exemple).

Il convient de "créer ou connecter" le compte ORCID iD dans la section "profil" de Yareta. 

Image3.png

Pour relier son compte ORCID à son compte Zenodo, il faut passer par "my account", et aller dans "linked accounts". 

Screenshot 2026-07-28 at 11-28-19 Settings Zenodo.png

Publier un data paper

Il est possible de valoriser le travail effectué sur les données dans un data paper (parfois appelé data descriptor, dataset paper, database paper, etc.). Il s’agit d’une publication consacrée uniquement aux données et qui paraît dans une revue à comité de lecture.

Focalisé sur la description du jeu de données, ses informations techniques et le travail de traitement effectué dessus (anonymisation, procédures, standardisation, etc.), le data paper ne contient ni hypothèse de recherche, ni méthodologie pour confirmer ou infirmer l'hypothèse, ni conclusions à la suite de l’analyse de données. Le potentiel de réutilisation est cependant généralement mis en avant.

  • Li, K., Jiang, J., Qiu, L. et al. A multimodal MRI dataset of professional chess players. Sci Data 2, 150044 (2015). https://doi.org/10.1038/sdata.2015.44
  • Duan Yan, Adam K. Frost et Spencer Dean Stewart, An Empire of Their Own? A Longitudinal Dataset of Cotton Production and Industry in Republican China, 1919-1937. (2026). Research Data Journal for the Humanities and Social Sciences, 10. https://doi.org/10.52024/beh04a28

Il existe des revues (généralistes ou disciplinaires) dévolues uniquement à la publication de data papers:

D’autres revues acceptent ce type de contributions parmi d’autres.

Le site web Forschungdaten a compilé une liste de data journals.

Le CIRAD propose également une liste de revues publiant des data papers et des software papers.

La figure ci-dessous présente la structure d’un data paper, ainsi que ses liens avec les données qu’il présente et visibilise :

structure_data_paper.png

Figure : Structure d'un data paper.
Source de l'image: Esther Dzale Yeumo Windpouire et Dominique L'Hostis. Open Science. Gestion et partage des données de la recherche. Journée de Formation - URFIST Paris (22/01/2015) ; Mise à jour - Agropolis Montpellier (01/04/15), slide 108, ⟨hal-02800107⟩, licence : CC BY NC SA.

Demander un "Open Practice Badge"

Les “Open Practice Badges” proposés par le Center for Open Science sont un moyen de faire reconnaître les efforts fournis par les chercheuses et les chercheurs en matière de Science ouverte. Ils sont destinés à être affichés sur les articles pour signifier que les auteurs et les autrices ont employé des pratiques ouvertes. Différents badges existent  :

badges.jpg

Image: Open Science Badges, licence CC BY 4.0

  • Le badge Open Data (Données ouvertes) indique que les données nécessaires à la reproduction des résultats présentés sont disponibles dans un dépôt en libre accès, sous licence ouverte, accompagnées d’une description des données;

  • Le badge Open Materials (Matériels ouverts) indique que tous les éléments de la méthodologie de recherche pouvant être partagés sous forme numérique sont disponibles dans un dépôt en libre accès, et que les éléments ne pouvant pas être partagés numériquement sont décrits avec suffisamment de détails pour qu’un chercheur ou une chercheuse indépendant-e puisse comprendre comment reproduire la procédure;

  • Le badge Pre-registration (Préenregistrement) indique que le protocole de l’étude a été enregistré publiquement et horodaté avant le début de la recherche.

En bref

Voici un schéma récapitulatif des liens qui peuvent être établis entre les jeux de données, les publications scientifiques et les profils numériques des chercheuses et des chercheurs afin que l’ensemble du travail effectué soit facile à trouver, accessible, bien référencé et pérenne  :

Visibiliser.jpg

Pour aller plus loin

Formations UNIGE

Visibiliser le travail investi dans vos données grâce à un Data Paper ou un Data Statement, en 15 minutes

Ressources UNIGE

DS4A_Visibiliser.png

Capsule vidéo Data Science for All - Trucs et astuces pour rendre visibles vos jeux de données

28 juillet 2026