Hadoop完全分布式配置 历史服务器&日志聚集

Posted ZSYL

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了Hadoop完全分布式配置 历史服务器&日志聚集相关的知识,希望对你有一定的参考价值。

配置历史服务器

为了查看程序的历史运行情况,需要配置一下历史服务器。具体配置步骤如下:

1)配置 mapred-site.xml

[zs@hadoop102 hadoop]$ vim mapred-site.xml

在该文件里面增加如下配置:

<!-- 历史服务器端地址 -->
<property>
 <name>mapreduce.jobhistory.address</name>
 <value>hadoop102:10020</value>
</property>

<!-- 历史服务器 web 端地址 -->
<property>
 <name>mapreduce.jobhistory.webapp.address</name>
 <value>hadoop102:19888</value>
</property>

2)分发配置

[zs@hadoop102 hadoop]$ xsync $HADOOP_HOME/etc/hadoop/mapred-site.xml

3)在 hadoop102 启动历史服务器

[zs@hadoop102 hadoop]$ mapred --daemon start historyserver

4)查看历史服务器是否启动

[zs@hadoop102 hadoop]$ jps

5)查看 JobHistory

http://hadoop102:19888/jobhistory

配置日志的聚集

日志聚集概念:应用运行完成以后,将程序运行日志信息上传到 HDFS 系统上。


日志聚集功能好处:可以方便的查看到程序运行详情,方便开发调试。

注意:开启日志聚集功能,需要重新启动 NodeManager 、ResourceManager 和 HistoryServer。

开启日志聚集功能具体步骤如下:

1)配置 yarn-site.xml

[zs@hadoop102 hadoop]$ vim yarn-site.xml

在该文件里面增加如下配置:

<!-- 开启日志聚集功能 -->
<property>
 <name>yarn.log-aggregation-enable</name>
 <value>true</value>
</property>
<!-- 设置日志聚集服务器地址 -->
<property> 
 <name>yarn.log.server.url</name> 
 <value>http://hadoop102:19888/jobhistory/logs</value>
</property>
<!-- 设置日志保留时间为 7 天 -->
<property>
 <name>yarn.log-aggregation.retain-seconds</name>
 <value>604800</value>
</property>

2)分发配置

[zs@hadoop102 hadoop]$ xsync $HADOOP_HOME/etc/hadoop/yarnsite.xml

3)关闭集群

关闭 NodeManager 、ResourceManager 和 HistoryServer

[zs@hadoop103 hadoop-3.1.3]$ sbin/stop-yarn.sh
[zs@hadoop103 hadoop-3.1.3]$ mapred --daemon stop historyserver

4)启动集群

启动 NodeManager 、ResourceManage 和 HistoryServer

[zs@hadoop103 ~]$ start-yarn.sh
[zs@hadoop102 ~]$ mapred --daemon start historyserver

5)删除 HDFS 上已经存在的输出文件

[zs@hadoop102 ~]$ hadoop fs -rm -r /output

6)执行 WordCount 程序

[zs@hadoop102 hadoop-3.1.3]$ hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-3.1.3.jar wordcount /input /output

7)查看日志

(1)历史服务器地址

http://hadoop102:19888/jobhistory

(2)历史任务列表


(3)查看任务运行日志


(4)运行日志详情


加油!

感谢!

努力!

以上是关于Hadoop完全分布式配置 历史服务器&日志聚集的主要内容,如果未能解决你的问题,请参考以下文章

大数据技术之_03_Hadoop学习_02_入门_Hadoop运行模式+本地运行模式+伪分布式运行模式+完全分布式运行模式(开发重点)+Hadoop编译源码(面试重点)+常见错误及解决方案(示例代(代

hadoop历史服务的启动与停止

3-3 Hadoop集群完全分布式配置部署

Hadoop完全分布式安装配置完整过程

Hadoop完全分布式集群配置

Hadoop完全分布式搭建