首页
AI / 大模型
  • 智能体 Agent
  • 大模型工程
  • 模型原理
  • AI 应用
  • 检索增强 RAG
大数据
  • Flink
  • Kafka
  • ClickHouse
  • Hive
  • ZooKeeper
  • Hadoop
运维部署
  • 网站部署
  • 后端与工程
项目管理 关于本站
峰的个人知识库 菜单
  1. 首页
  2. AI / 大模型
    1. 智能体 Agent
    2. 大模型工程
    3. 模型原理
    4. AI 应用
    5. 检索增强 RAG
  3. 大数据
    1. Flink
    2. Kafka
    3. ClickHouse
    4. Hive
    5. ZooKeeper
    6. Hadoop
  4. 运维部署
    1. 网站部署
    2. 后端与工程
  5. 项目管理
  6. 关于本站
快捷操作
登录

HDFS 与 MapReduce 详解:存储架构、高可用与 YARN 运行流程
Hadoop 2025.08.04
阅读 2 评论 0 点赞 0

HDFS 与 MapReduce 详解:存储架构、高可用与 YARN 运行流程

本文系统介绍Hadoop体系:HDFS 1.0中,NameNode管理元数据,DataNode存储数据块,写入采用pipeline方式,SecondaryNameNode辅助合并编辑日志。HDFS 2.0通过ZooKeeper、ZKFC和QJM解决单点故障,实现主备切换与元数据一致。YARN作为资源调度层,由ResourceManager、NodeManager和Container组成;MapReduce作业由ApplicationMaster申请资源,执行MapTask和ReduceTask。Shuffle机制核心为环形缓冲区溢写、分区归并与排序。文中还以作战比喻和Mapper/Reducer执行流程帮助理解。本文让读者掌握HDFS高可用原理、YARN调度流程以及MapReduce核心Shuffle机制。

#HDFS#MapReduce#YARN#Hadoop
DATA · LLM · DEVOPS DATA · LLM · DEVOPS DATA · LLM · DEVOPS DATA · LLM · DEVOPS
F Archive

沉淀后端底层、大数据工程与大模型落地实践,结构化归档技术学习笔记。

导航

  • 首页
  • AI / 大模型
  • 大数据
  • 运维部署
  • 项目管理
  • 关于本站

© 2026 峰的个人知识库. 保留所有权利.

用 ♥ 与氢气构建

Built with Theme 氢·简 CMS Halo