大数据面试题|面试,hadoop,大数据,德仔网

大数据面试题

来源: CSDN　　作者:网友　　日期:2018/4/12　　类别:大数据　　主题:Hadoop　　编辑:Lucien

在单机模式（standalone）中不会存在守护进程，所有东西都运行在一个JVM上。这里同样没有DFS，使用的是本地文件系统。单机模式适用于开发过程中运行MapReduce程序，这也是最少使用的一个模式。3

1.Hadoop集群可以运行的3个模式？

单机（本地）模式
伪分布式模式
全分布式模式

2. 单机（本地）模式中的注意点？

在单机模式（standalone）中不会存在守护进程，所有东西都运行在一个JVM上。这里同样没有DFS，使用的是本地文件系统。单机模式适用于开发过程中运行MapReduce程序，这也是最少使用的一个模式。

3. 伪分布模式中的注意点？

伪分布式（Pseudo）适用于开发和测试环境，在这个模式中，所有守护进程都在同一台机器上运行。

4. VM是否可以称为Pseudo？

不是，两个事物，同时Pseudo只针对Hadoop。

5. 全分布模式又有什么注意点？

全分布模式通常被用于生产环境，这里我们使用N台主机组成一个Hadoop集群，Hadoop守护进程运行在每台主机之上。这里会存在Namenode运行的主机，Datanode运行的主机，以及task tracker运行的主机。在分布式环境下，主节点和从节点会分开。

6. Hadoop是否遵循UNIX模式？

是的，在UNIX用例下，Hadoop还拥有“conf”目录。

7. Hadoop安装在什么目录下？

Cloudera和Apache使用相同的目录结构，Hadoop被安装在cd/usr/lib/hadoop-0.20/。

8. Namenode、Job tracker和task tracker的端口号是？

Namenode，70；Job tracker，30；Task tracker，60。

9. Hadoop的核心配置是什么？

Hadoop的核心配置通过两个xml文件来完成：1，hadoop-default.xml；2，hadoop-site.xml。这些文件都使用xml格式，因此每个xml中都有一些属性，包括名称和值，但是当下这些文件都已不复存在。

10. 那当下又该如何配置？

Hadoop现在拥有3个配置文件：1，core-site.xml；2，hdfs-site.xml；3，mapred-site.xml。这些文件都保存在conf/子目录下。

11. RAM的溢出因子是？

溢出因子（Spill factor）是临时文件中储存文件的大小，也就是Hadoop-temp目录。

12. fs.mapr.working.dir只是单一的目录？

fs.mapr.working.dir只是一个目录。

13. hdfs-site.xml的3个主要属性？

dfs.name.dir决定的是元数据存储的路径以及DFS的存储方式（磁盘或是远端）
dfs.data.dir决定的是数据存储的路径
fs.checkpoint.dir用于第二Namenode

14. 如何退出输入模式？

退出输入的方式有：1，按ESC；2，键入:q（如果你没有输入任何当下）或者键入:wq（如果你已经输入当下），并且按下Enter。

15. 当你输入hadoopfsck /造成“connection refused java exception’”时，系统究竟发生了什么？

这意味着Namenode没有运行在你的VM之上。

面试

hadoop

大数据

　　>>频道首页　　 >>网站首页　　 >>纠错　　 >>投诉

德仔网尊重行业规范，每篇文章都注明有明确的作者和来源；德仔网的原创文章，请转载时务必注明文章作者和来源:德仔网；

头条那些事

BAT解密——什么在驱动技术发展？

数据科学家和大数据技术人员工具包

40 个重要的 HTML5 面试问题及答案

2016年企业应该如何改进IT组织

业务、流程、IT、质量、运营的关系

数据可视化该用什么软件来展示

携程瘫痪12小时,故障还是隐患

流程与IT管理部—IT支撑业务变革的必然趋势

新技术架构引领IT管理革新

十大IT运维管理经验解析

大家在关注

一文搞懂微服务架构演进

一文详解微服务架构

迄今为止最完整的DDD实践

ClickHouse、Doris、 Impala等MPP架构详解

全链路压测自动化实践

多维度规划业务架构

企业架构之业务架构

基于CLICKHOUSE的数据仓库分层规范

需求管理完整指南

软件安全设计原则

广告那些事

我们的推荐

最实用的机器学习算法优缺点分析

阿里/网易/美团/58用户画像中的ID体系建设

知识图谱的技术详解与应用

用户画像技术及方法论

菜鸟实时数仓技术架构演进

如何从0到1设计搭建AI售前营销机器人？

机器学习项目实操指南

阿里的大数据建设方法论

OPPO数据中台之基石：基于Flink SQL构建实时数仓

6亿用户音乐场景下的AI思考

也许感兴趣的

企业数据治理落地和同行面试基础

如何面试CIO

20道你必须要背会的微服务面试题

面试常问的 25+个Linux命令

Dubbo面试八连问

大数据面试题

面试聊得好好的,怎么就没有下文了？

那些刁钻的面试问题,我们有什么回答套路？

怎样花两年时间去面试一个人

Hadoop 面试,有它就够了

干货

面试官技能训练

AI面试机器人打造智能化招聘

招聘面试方法技巧

如何当一个合格的面试官

ASP.NET面试题

行为面试技巧

面试方法培训手册

101个面试难题及结构化面试题库

部分常见ORACLE面试题以及SQL注意事项

超经典面试题

赞助广告