Définition
Apache Hadoop est un framework open source pour le stockage et le traitement distribué de très grands volumes de données, répartis sur des clusters de machines standards plutôt que sur du matériel spécialisé coûteux.
Pionnier historique du Big Data dans les années 2000, Hadoop repose sur son système de fichiers distribué (HDFS) et le paradigme de calcul MapReduce ; il est aujourd'hui souvent complété, voire remplacé sur les nouveaux projets, par Apache Spark, plus rapide pour de nombreux cas d'usage.
Formations intégrant Hadoop
Hadoop
Maîtrisez les modules Hadoop et le stockage de vos données grâce à notre formation Apache Hadoop de 3 jours !
Pig, Hive et Impala avec Hadoop
formation Pig, Hive et Impala avec Hadoop
HBase : mise en œuvre et administration
Maîtrisez la base de données NoSQL d'Hadoop grâce à notre formation !
Big Data Foundation (avec certification du CCC)
Passez la certification officielle du CCC Big Data Foundation avec notre formation certifiante Big Data Foundation !
Spark
Traitez les données massives en un temps record grâce au moteur d'analyse Apache Spark et à notre formation Spark !
Big Data : mise en œuvre
Mettez en oeuvre une solution complète d'analyse des données grâce à notre formation Big Data : mise en œuvre de 5 jours !
Questions fréquentes
Qu'est-ce que Hadoop ?
Framework open source pour le stockage et le traitement distribué de très grands volumes de données sur des clusters de machines standards.
Quelles formations Sparks abordent Hadoop ?
Hadoop, Pig, Hive et Impala avec Hadoop, HBase : mise en œuvre et administration, Big Data Foundation (avec certification du CCC), Spark, Big Data : mise en œuvre.
