简答题2007年Hadoop诞生,Hadoop是一个大数据计算框架,提供海量数据存储、查询和计算能力。()简答题NodeManager()是每个节点上的资源和任务管理器。它定时地向RM汇报本节点上的资源使用情况和各个Container的运行状态;另一方面,它接收并处理来自AM的Container启动/停止等各种请求。() A、正确 B、错误简答题基于Hadoop架构设计一数据库产品Hbase原因有( )。 A、Hadoop无法满足大规模数据实时处理应用的需求。 B、HDFS面向批量访问模式,不是随机访问模式。 C、传统的通用关系型数据库无法应对在数据规模剧增时导致的系统扩展性和性能问题。 D、传统关系数据库在数据结构变化时一般需要停机维护,空列浪费存储空间。简答题下列关于MessageQueue或消息系统描述正确的有( )。 A、MessageQueue负责将数据从一个应用传递到另外一个应用,应用只需关注于数据。 B、分布式消息传递基于可靠的消息队列,在客户端应用和消息系统之间异步传递消息。 C、Kafka将数据封装到事件(event)里,然后将事件推入Channel中。 D、常用消息传递模式包括点对点传递模式和发布-订阅模式。简答题下列关于HDFS架构描述中正确的有( )。 A、ActiveNamenode属于主Master(只有一个)。 B、ActiveNamenode管理HDFS的名称空间,管理数据块映射信息。 C、ActiveNamenode配置副本策略,处理客户端读写请求 D、ActiveNamenode存储实际的数据块.具体执行数据块读/写简答题Container是YARN中的资源抽象,它封装了某个节点上的多维度资源,如内存.CPU.磁盘.网络等。() A、正确 B、错误简答题以下属于VMware公司的虚拟化平台组件是()。 A、EXSi B、vSphere Hypervisor C、Workstation D、Fusion简答题字节跳动对YARN的定制主要实现( )。 A、物理资源分配率提升和使用率提升。 B、多种负载场景优化。 C、稳定性提升。 D、异地多活,全球统一的YARNUI 界面。简答题ApacheStorm是一种包含流处理能力的下一代批处理框架。Storm框架基于内存计算及处理优化,保证了集群计算的效率。() A、正确 B、错误简答题下列属于Spark核心 (SparkCore) 的基础核心功能()。 A、提供常用机器学习算法的实现。 B、提供内存计算.任务调度.部署模式.故障恢复.存储管理等。 C、提供用于图计算的API,能在海量数据上自如地运行复杂的图算法。 D、提供高吞吐量.可容错处理的实时流数据处理。简答题大数据处理通过对数据执行操作提高理解能力,揭示出数据蕴含的模式,并针对复杂互动获得见解。() A、正确 B、错误简答题HDFS的优点包括( )。 A、高容错性,适合批处理 B、构建在廉价机器上 C、适合大数据处理,流式文件访问 D、对延时要求在毫秒级别的应用简答题最大规模的集群称为仓库级计算机(),它们的设计方式使数万个服务器像一个服务器一样运行。() A、正确 B、错误简答题下列描述中错误的是()。 A、集群是指一组桌面计算机或服务器通过局域网连接在一起。 B、集群中每个节点都运行自己的操作系统,节点之间使用网络协议进行通信。 C、最大规模的集群称为仓库级计算机(WSC)。 D、仓库级计算机(WSC)是指大型机。多选题智慧城市的构建,不包含( )。简答题下列关于Flume数据采集框架描述正确的有( )。 A、Flume是一个海量日志采集.聚合和传输的系统。 B、Flume支持在日志系统中定制各类数据发送方,用于收集数据。 C、Flume提供对数据进行简单处理,并写到各种数据接受方的能力。 D、Flume基于zookeeper协调的分布式日志系统,也可当做MQ系统。简答题虚拟化技术是云计算发展的一个重要技术推力。() A、正确 B、错误简答题关于Spark的RDD描述正确的有( )。 A、RDD(ResilentDistributed Datasets) 是弹性分布式数据集简称。 B、是Spark底层的分布式存储的数据结构,是Spark的核心。 C、SparkAPI 的所有操作都是基于RDD的。 D、RDD是一种可读写的数据块。简答题下列不属于ActiveNamenode节点功能的是()。 A、管理HDFS的名称空间 B、管理数据块映射信息 C、处理客户端读写请求 D、执行数据块读/写简答题云计算的特征包括()。 A、随需应变的自助服务.广泛的网络访问 B、资源池化 C、快速灵活扩展性 D、可计量的服务