Construire un pipeline
Ingérer des fichiers CSV et organiser un flux de données simple de bout en bout.
Un dataset autour des jeux vidéo rétro, proposé en éditions small et large, pour expérimenter, apprendre et construire des exemples en data engineering, analytics et business intelligence.

Les datasets utilisés dans les démonstrations data finissent souvent par se ressembler : clients, commandes, produits et ventes.
Le Retro Video Games Dataset est né d’une envie simple : disposer de données assez réalistes pour construire des tutoriels et des expérimentations, tout en travaillant avec un univers plus personnel et plus agréable à manipuler.
Les jeux vidéo rétro font partie des passions à l’origine de Nice Data. Cette ressource transforme cette passion en terrain de jeu compréhensible, réutilisable et suffisamment riche pour apprendre sans reproduire un système métier complexe.
Choisissez l’édition small pour commencer vite ou la version large pour travailler sur des volumes plus réalistes, tout en conservant la même structure.
Ingérer des fichiers CSV et organiser un flux de données simple de bout en bout.
Travailler les relations, les jointures et les transformations sur un domaine lisible.
Créer un modèle analytique, un rapport BI ou une première exploration dans un notebook.
Disposer de données compactes et reproductibles pour expliquer un outil ou une méthode.
L’édition small privilégie la lisibilité et la rapidité. L’édition large reprend ses 20 lignes à l’identique et les complète pour atteindre 340 jeux.
Choisissez la représentation adaptée à votre usage. Retrouvez sur GitHub le détail des fichiers, des colonnes et des deux éditions.
Des fichiers séparés pour les jeux et les plateformes, disponibles dans les deux tailles. À privilégier pour pratiquer les jointures et la modélisation.
Voir l’édition large relationnelleUne représentation dénormalisée réunissant chaque jeu et sa plateforme dans une seule ligne, sans jointure préalable, en éditions small et large.
Voir l’édition large OBTSmall contient 20 jeux pour les tutoriels, les tests rapides et les démonstrations. Large conserve ces 20 enregistrements à l’identique et porte le dataset à 340 jeux pour des exercices d’ingestion et de transformation plus réalistes. Les deux éditions couvrent 3 plateformes et suivent le même schéma v1.
Retrouvez les fichiers prêts à télécharger, le schéma des données, l’historique et les informations de version.