Résumé
Contrairement aux systèmes SQL, conçus pour gérer des données structurées, les environnements big data reposent sur une architecture logicielle organisée en trois couches indépendantes : le stockage, la gestion des données et l'analyse. Cette sépara/on des couches a favorisé l'émergence d'un écosystème riche en ou/ls, frameworks et systèmes interopérables, fondés sur des architectures distribuées et parallèles. Dans ce chapitre, nous reviendrons sur la définition du big data ainsi que sur la gestion distribuée et parallèle des données, afin de présenter ces nouvelles architectures et leur intégration dans un environnement cloud.