梳理数据倾斜、Shuffle 优化等高频考点,准备大数据工程师面试。
了解 Hadoop 核心组件,搭建分布式文件系统和资源管理,运行批处理作业。
理解 Hadoop 分布式文件系统与 MapReduce 计算模型,搭建本地集群并运行经典的单词计数作业,奠定大数据基础。