Secondary NameNode

　　在Hadoop中，有一些命名不好的模块，Secondary NameNode是其中之一。从它的名字上看，它给人的感觉就像是NameNode的备份。但它实际上却不是。HDFS集群有两类节点以管理者和工作者的工作模式运行，namenode就是其中的管理者。它管理着文件系统的命名空间，维护着文件系统树及整棵树的所有文件和目录。这些信息以两个文件的形式保存于内存或者磁盘，这两个文件是：命名空间镜像文件fsimage和编辑日志文件edit logs ，同时namenode也记录着每个文件中各个块所在的数据节点信息。

图中有两个文件：

（1）fsimage:文件系统映射文件，也是元数据的镜像文件（磁盘中），存储某段时间namenode内存元数据信息。

（2）edits log:操作日志文件。

这种工作方式的特点：

（1）namenode始终在内存中存储元数据（metedata）,使得“读操作”更加快、

（2）有“写请求”时，向edits文件写入日志，成功返回后才修改内存，并向客户端返回。

（3）fsimage文件为metedata的镜像，不会随时同步，与edits合并生成新的fsimage。

从以上特点可以知道，edits文件会在集群运行的过程中不断增多，占用更多的存储空间，虽然有合并，但是只有在namenode重启时才会进行。并且在实际工作环境很少重启namenode，

这就带来了一下问题：

（1）edits文件不断增大，如何存储和管理？

（2）因为需要合并大量的edits文件生成fsimage，导致namenode重启时间过长。

（3）一旦namenode宕机，用于恢复的fsiamge数据很旧，会造成大量数据的丢失。

Secondary NameNode

上述问题的解决方案就是运行辅助namenode–Secondary
NameNode，为主namenode内存中的文件系统元数据创建检查点，Secondary
NameNode所做的不过是在文件系统中设置一个检查点来帮助NameNode更好的工作。它不是要取代掉NameNode也不是NameNode的备份，

SecondaryNameNode有两个作用，一是镜像备份，二是日志与镜像的定期合并。两个过程同时进行，称为checkpoint（检查点）。

镜像备份的作用：备份fsimage(fsimage是元数据发送检查点时写入文件)；

日志与镜像的定期合并的作用：将Namenode中edits日志和fsimage合并,防止如果Namenode节点故障，namenode下次启动的时候，会把fsimage加载到内存中，应用edits log,edits log往往很大，导致操作往往很耗时。（这也是namenode容错的一套机制）

Secondarynamenode工作过程

（1）SecondaryNameNode通知NameNode准备提交edits文件，此时主节点将新的写操作数据记录到一个新的文件edits.new中。

（2）SecondaryNameNode通过HTTP
GET方式获取NameNode的fsimage与edits文件（在SecondaryNameNode的current同级目录下可见到
temp.check-point或者previous-checkpoint目录，这些目录中存储着从namenode拷贝来的镜像文件）。

（3）SecondaryNameNode开始合并获取的上述两个文件，产生一个新的fsimage文件fsimage.ckpt。

（4）SecondaryNameNode用HTTP POST方式发送fsimage.ckpt至NameNode。

（5）NameNode将fsimage.ckpt与edits.new文件分别重命名为fsimage与edits，然后更新fstime，整个checkpoint过程到此结束。

SecondaryNameNode备份由三个参数控制fs.checkpoint.period控制周期（以秒为单位，默认3600秒），fs.checkpoint.size控制日志文件超过多少大小时合并（以字节为单位，默认64M），
dfs.http.address表示http地址，这个参数在SecondaryNameNode为单独节点时需要设置。

从工作过程可以看出，SecondaryNameNode的重要作用是定期通过编辑日志文件合并命名空间镜像，以防止编辑日志文件过大。SecondaryNameNode一般要在另一台机器上运行，因为它需要占用大量的CPU时间与namenode相同容量的内存才可以进行合并操作。它会保存合并后的命名空间镜像的副本，并在namenode发生故障时启用。

原文地址：https://www.cnblogs.com/1iHu4D0n9/p/8353561.html

时间： 2024-11-08 12:56:19

Secondary NameNode

Secondary NameNode的相关文章

通过secondary namenode恢复崩溃的namenode

secondary namenode和namenode分离

解读Secondary NameNode的功能

Hadoop之Secondary NameNode

NameNode和Secondary NameNode通信模型

Secondary NameNode究竟是做什么的

Secondary NameNode 的作用

secondary namenode 检查点

NameNode&Secondary NameNode 工作机制