Mapreduce框架的相关问题

来源:互联网 发布:电脑连接不到网络 编辑:程序博客网 时间:2024/05/22 09:34
jobtracker的单点故障:


jobtracker和hdfs的namenode一样也存在单点故障,
单点故障一直是hadoop被人诟病的大问题,
为什么hadoop的做的文件系统和mapreduce计算框架都是高容错的,但是最重要的管理节点的故障机制却如此不好,我认为主要是namenode和jobtracker在实际运行中都是在内存操作,而做到内存的容错就比较复杂了,只有当内存数据被持久化后容错才好做,namenode和jobtracker都可以备份自己持久化的文件,但是这个持久化都会有延迟,因此真的出故障,任然不能整体恢复,另外hadoop框架里包含zookeeper框架,zookeeper可以结合jobtracker,用几台机器同时部署jobtracker,保证一台出故障,有一台马上能补充上,不过这种方式也没法恢复正在跑的mapreduce任务。