Lexique de la data – Données brutes, informations structurées, contenus éditorialisés : ces trois niveaux forment l’épine dorsale de tout système numérique. Cette thématique explore comment l’information est capturée, nommée, liée, publiée et rendue utile — ou au contraire, exploitée. Elle met l’accent sur la structuration sémantique, la réutilisabilité et la souveraineté des contenus.
Définitions associées
-
Google Analytics
Google Analytics est une solution de mesure d’audience et d’analyse comportementale développée par Google, permettant de suivre les interactions des utilisateurs sur des sites web et applications. Depuis 2023, Universal Analytics (UA) a été officiellement arrêté :→ Google ne traite plus aucune donnée dans UA depuis le 1er juillet 2023.→ Tous les utilisateurs sont migrés…
-
Gouvernance des données
Ensemble de règles, processus, rôles et normes qui encadrent la qualité, la sécurité, la disponibilité, l’usage et le cycle de vie des données au sein d’une organisation. La gouvernance des données, c’est « la manière dont une organisation décide ce qu’elle fait de ses données ». Elle répond à des questions essentielles : Elle ne…
-
Guide RGPD du Développeur
Guide d’accompagnement au règlement général sur la protection des données pour la mise en conformité des développements projet web ou applicatif en open source élaboré par la CNIL. Ce guide est découpé en 18 fiches thématiques et complété par des exemples de codes qui couvrent la plupart des besoins des développeuses et développeurs. Guide-RGPD-du-developpeur Explorer les thématiques : RGPD,…
-
Hadoop
Hadoop est un framework qui permet de stocker et de traiter de grandes quantités de données structurées sur des clusters de serveurs. L’éco-système Hadoop a été créé par Doug Cutting et Mike Cafarella en 2005, en s’inspirant des travaux de Google sur le système de fichiers distribué et le traitement de données en grands volumes.…
-
Index (base de données)
Structure auxiliaire associée à une table de base de données qui accélère la récupération de données en permettant un accès direct à des enregistrements spécifiques, sans parcourir l’intégralité de la table. Un index est une structure de données optimisée (souvent basée sur des arbres B, des hachages ou des index bitmap) créée sur une ou…
-
Index inversé
Classement des mots, expressions répertoriés pour chaque document indexé par un moteur de recherche. L’index des mots clés est rattaché à l’index de documents qui traite et archive les pages complètes. Explorer les thématiques : Données, information & contenus
-
JSON-LD
Le format JSON-LD JavaScript Object Notation for Linked Data, est un format de balisage de données structurées utilisé pour fournir des informations supplémentaires aux moteurs de recherche sur le contenu d’une page web. JSON-LD est devenu une notion fondamentale en développement web et SEO. Lorsqu’on parle de SEO (Search Engine Optimization), il est essentiel de…
-
Modélisation linéaire
La modélisation linéaire est l’un des fondements de la statistique et de l’apprentissage automatique : simple, interprétable, et souvent un excellent point de départ. C’est une méthode statistique qui consiste à représenter la relation entre une ou plusieurs variables explicatives (entrées) et une variable cible (sortie) à l’aide d’une fonction linéaire c’est-à-dire une droite (en…
-
NoSQL
Famille de systèmes de gestion de bases de données conçus pour stocker et interroger des données non structurées ou semi-structurées (comme du JSON, du XML ou des graphes), avec une forte capacité d’évolution (scalabilité) et une flexibilité de schéma. Une base de données NoSQL (qui signifie « Not Only SQL », et non « pas…
À quoi ça sert / Pour qui
À transformer des flux chaotiques en ressources documentaires exploitables, interopérables et pérennes.
Pour les documentalistes, archivistes numériques, concepteur·rices de bases de connaissances, équipes culturelles, développeur·ses sensibles au web sémantique, ou toute personne travaillant à la description ou à la diffusion de savoirs.
Repères
- Domaines concernés : Data & analytics, Architecture de l’information, Expérience utilisateur, Écoconception
- Types de concepts associés :
- Concept (ex. Donnée, Information, Contenu, Métadonnée)
- Format (ex. JSON-LD, XML, CSV, RDF)
- Technologie (ex. Knowledge graph, API de contenu)
- Pratique (ex. Documentation sémantique, Enrichissement contextuel)
- Méthode (ex. Modélisation d’ontologie, Cartographie documentaire)
- Rôles liés :
- Gestionnaire de contenu
- Documentaliste numérique
- Architecte de l’information
- Développeur·se sémantique
- Référent·e données ouvertes
- Niveau d’appropriation recommandé :
Découverte → Compréhension → Application → Structuration → Maîtrise opérationnelle
Aller plus loin
Thématiques proches
• Web sémantique et données liées
• Gestion documentaire résiliente
• Architecture de l’information
• Sobriété documentaire
Domaines liés
• Data & analytics
• Architecture de l’information
• Expérience utilisateur
• Écoconception
Définitions connexes
• Donnée – Concept
• Métadonnée – Concept
• JSON-LD – Format
• Knowledge graph – Technologie
• CMS – Plateforme
• Ontologie – Modèle
• Schema.org – Standard
• Enrichissement sémantique – Pratique
FAQ
Pourquoi structurer les contenus avec JSON-LD plutôt que laisser faire Google ?
Parce que structurer soi-même, c’est garder la main sur le sens donné à ses contenus. JSON-LD permet de décrire explicitement qui, quoi, où, quand — sans dépendre des algorithmes opaques de reconnaissance automatique.
Un knowledge graph, c’est réservé aux géants du web ?
Non. Un graph de connaissances peut être petit, local et maîtrisé : un musée, une association, un projet pédagogique peuvent modéliser leurs entités (personnes, œuvres, lieux) et leurs relations pour permettre une navigation intelligible et non linéaire.