Posté par alkino .
Évalué à 2 (+0/-0).
Dernière modification le 13 septembre 2026 à 08:53.
Je me suis intéressé fortuitement à ce sujet récemment. Je vais essayer d'expliquer rapidement ce qui se trouve en dessous, corrigez moi si je dis des âneries.
Wikidata est un graphe de connaissance (knowledge graph). Ces graphes sont composés de triplet : sujet - prédicat - objet.
Jean-Jacques Goldman - est né en - France
France - est un pays de - Europe
Europe - est un continent de - Terre
Bref, il y a des moteurs de bases de données spécialisées dans le stockage et l'interrogation de ces triplets. Ils ne s'interrogent pas avec un langage genre SQL mais Sparql.
SELECT ?person WHERE {
?person - est né en - France;
?person - est né en - 1951;
}
Cela va retourner toutes les personnes nées en 1951 dans la base.
Du coup, wikidata utilisait Blazegraph abandonné en 2020. Qlever est le prochain moteur, beaucoup plus performant il semblerait. Développé depuis 2017 à l'Université de Freiburg.
Blazegraph était open source (comme QLever) mais racheté et tué par Amazon.
Oui c'est ça globalement, à part que le modèle de WD ce n'est pas directement des triplets mais des triplets annotés (les "déclarations" dans le jargon Wikidata) par des "qualificatifs" (pour dater l'époque de validité par exemple) et des "références". Concrètement une déclaration est traduite en un ensemble de triplets dans la base de données. Les propriétés et qualificatifs sont imaginés et créés par la communauté, ainsi que leur signification.
Les triplestore peuvent prendre ce type de modèles qui vont au delà des triplets avec des normes comme RDF* par exemple. Je crois que qlever le fait par exemple, mais le modèle actuel de Wikidata traduit ça comme un ensemble de triplet dans le backend sparql.
# Explications
Posté par alkino . Évalué à 2 (+0/-0). Dernière modification le 13 septembre 2026 à 08:53.
Je me suis intéressé fortuitement à ce sujet récemment. Je vais essayer d'expliquer rapidement ce qui se trouve en dessous, corrigez moi si je dis des âneries.
Wikidata est un graphe de connaissance (knowledge graph). Ces graphes sont composés de triplet : sujet - prédicat - objet.
Bref, il y a des moteurs de bases de données spécialisées dans le stockage et l'interrogation de ces triplets. Ils ne s'interrogent pas avec un langage genre SQL mais Sparql.
Cela va retourner toutes les personnes nées en 1951 dans la base.
Du coup, wikidata utilisait Blazegraph abandonné en 2020. Qlever est le prochain moteur, beaucoup plus performant il semblerait. Développé depuis 2017 à l'Université de Freiburg.
Blazegraph était open source (comme QLever) mais racheté et tué par Amazon.
[^] # Re: Explications
Posté par thoasm . Évalué à 5 (+2/-0).
Oui c'est ça globalement, à part que le modèle de WD ce n'est pas directement des triplets mais des triplets annotés (les "déclarations" dans le jargon Wikidata) par des "qualificatifs" (pour dater l'époque de validité par exemple) et des "références". Concrètement une déclaration est traduite en un ensemble de triplets dans la base de données. Les propriétés et qualificatifs sont imaginés et créés par la communauté, ainsi que leur signification.
Les triplestore peuvent prendre ce type de modèles qui vont au delà des triplets avec des normes comme RDF* par exemple. Je crois que qlever le fait par exemple, mais le modèle actuel de Wikidata traduit ça comme un ensemble de triplet dans le backend sparql.
Le github de qlever ou on peut constater que le dev est plutôt dynamique : https://github.com/ad-freiburg/qlever
[^] # Re: Explications
Posté par steph1978 . Évalué à 3 (+1/-0).
Et en France.
Envoyer un commentaire
Suivre le flux des commentaires
Note : les commentaires appartiennent à celles et ceux qui les ont postés. Nous n’en sommes pas responsables.