Qu'est-ce que Hadoop ?
Il regroupe notamment le système de fichiers distribué HDFS pour la réplication et la persistance des données, le moteur d'exécution MapReduce pour le calcul distribué, ainsi que d'autres composants (YARN, Hive, Pig, etc.) qui facilitent le déploiement d’applications Big Data sur des clusters de serveurs standards.
Qui utilise Hadoop ?
Les profils qui maîtrisent Hadoop sont généralement des data engineers, des architectes Big Data, des développeurs Java/Spark, des administrateurs de systèmes Linux, ainsi que des spécialistes en opérations (DevOps) et des data scientists travaillant sur des traitements batch de grande ampleur.