大学网课搜题引擎
首页
融优学堂
大数据技术导论
6 大数据处理
题目详情
简答题
MapReduce执行的全过程包括以下几个主要阶段( )。
A、从分布式文件系统读入数据
B、执行Map任务输出中间结果
C、通过Shuffle阶段把中间结果分区排序整理后发送给Reduce任务
D、执行Reduce任务得到最终结果并写入分布式系统文件
查看答案与解析
简答题
Apache软件基金会最重要的三大分布式计算系统开源项目包括( )。 A、Hadoop B、Spark C、Storm D、HDFS
简答题
Hadoop擅长批处理,不适合流计算。( ) A、正确 B、错误
简答题
Spark的组件中,用于做查询分析的是()。 A、Spark SQL B、Spark Streaming C、Spark MLib D、Spark Core
简答题
RDD的两种主要操作类型是()。 A、Map B、Transform C、Reduce D、 Action
简答题
在Spark运行时,( )为程序构建基本运行环境 Spark context对象(应用管家),向资源管理器进行资源申请,任务分配与监控。 A、Driver program B、Spark Environment C、DAG Scheduler D、Task Scheduler
简答题
Shuffle过程分为Map端的操作和Reduce端的操作 。( ) A、正确 B、错误
简答题
Spark 支持的开发语言有( )。 A、Java B、 C语言 C、Python D、Scala
简答题
关于RDD论述正确的是( )。 A、RDD提供一种高度受限的共享内存模型,是一个弹性分布式数据集 B、RDD读取的数据都存储在一台机器上 C、RDD是只读存储 D、RDD 支持各种粗粒度和细粒度的操作
简答题
以下属于Spark的特点的有( )。 A、 Speed B、Concise C、In-memory processing D、 Lazy Evaluation
大数据技术导论
章节列表
2 引论
5
3 大数据感知与获取
10
4 大数据存储与管理
10
5 大数据分析与可视化
15
6 大数据处理
10
7 大数据安全与隐私保护
10
8 大数据技术应用
2