oneworldtimeline

À propos des données

D'où viennent ces cinq mille ans d'événements, comment chacun a été vérifié, et ce que nous ne pouvons toujours pas promettre.

Ce que contient le jeu de données

5 146 événements, chacun avec une date, un lieu, un résumé en trois langues et une liste de sources. La couverture va du Néolithique à l'an 2000, sur dix régions du monde.

Les événements sont assemblés par un pipeline automatisé, non saisis à la main. Chaque fiche passe des contrôles de format, un rapport de distribution, une relecture par IA et un échantillon de régression figé avant publication.

Sources et licences

Les résumés sont rédigés à partir de faits vérifiés, non recopiés. Les preuves sous-jacentes proviennent de :

  • Wikidata CC0 1.0faits structurés — dates, coordonnées, classifications
  • Wikipedia CC BY-SA 4.0texte servant de preuve pour les dates et les lieux
  • UNESCO World Heritage Centre © UNESCOinscriptions officielles au patrimoine mondial — la seule source tierce indépendante de la famille Wikimedia
  • OpenStreetMap ODbLtuiles du fond de carte

Le texte de Wikipédia est sous CC BY-SA 4.0 et les données OpenStreetMap sous ODbL ; les deux exigent une attribution, que cette page fournit. Nos résumés sont des textes originaux rédigés à partir de faits vérifiés.

Comment une fiche est vérifiée

Dates et lieux sont d'abord normalisés : une date connue seulement au siècle près est enregistrée comme un siècle, jamais comme une fausse année exacte. Un lieu schématique plutôt qu'un site précis est signalé comme tel sur la carte.

Une fiche qui échoue à une règle structurelle est retenue plutôt que publiée avec une approximation. Lorsque les sources divergent sans réconciliation possible, la fiche est retenue — mieux vaut une lacune qu'une date fausse.

Ce que nous ne pouvons pas promettre

454(9%) événements disposent d'au moins une source indépendante de la famille Wikimedia. Les 4 692(91%) autres reposent sur Wikidata et les Wikipédias, qui comptent comme une seule famille de sources.

Ce n'est donc pas un jeu de données recoupé, mais un jeu de données sourcé : chaque fait indique d'où il vient, et vous pouvez le vérifier vous-même.

Vous avez trouvé une erreur ? C'est utile — le pipeline est relancé régulièrement et les corrections y sont réinjectées.