单选题下列有关RDD的说法中错误的是()。ARDD是一个只读的,可分区的分布式数据集。BRDD默认存储在磁盘,当磁盘不足时,溢写到内存。CRDD数据以分区的形式在集群中存储。DRDD具有血统机制,发生数据丢失时,可快速进行数据恢复。
单选题
下列有关RDD的说法中错误的是()。
A
RDD是一个只读的,可分区的分布式数据集。
B
RDD默认存储在磁盘,当磁盘不足时,溢写到内存。
C
RDD数据以分区的形式在集群中存储。
D
RDD具有血统机制,发生数据丢失时,可快速进行数据恢复。
参考解析
解析:
暂无解析
相关考题:
SparkStreming中()函数可以通过对源DStream的每RDD应用RDD-to-RDD函数返回一个新的DStream,这可以用来在DStream做任意RDD操作。 A.transB.reduceC.joinD.cogroup
Dstream输出操作中foreachRDD的正确用法是使用rdd.foreachPartition方法创建一个单独的连接对象,然后使用该连接对象输出所有RDD分区中的数据到外部系统。() 此题为判断题(对,错)。
以下关于rdd的特性说法错误的是()A、rdd是仅仅由一组partition够成的B、rdd之间都是独立的,没有依赖C、算子作用在partition上D、每个rdd都会提供一批最优的计算位置
以下关于rdd的说法中,正确的是哪些()A、rdd是由一系列partition够成的B、rdd之间都是独立的,没有依赖C、算子作用在partition上D、每个rdd都会提供一批最优的计算位置
spring中关于bean的说法正确的是()A、rdd是由一组partition够成的B、rdd之间都是独立的,没有依赖C、算子作用在partition上D、每个rdd都会提供一批最优的计算位置
以下选项中是persist算子在源码中具有哪些参数的是()A、rdd是由一系列partition够成的B、rdd之间都是独立的,没有依赖C、算子作用在partition上D、每个rdd都会提供一批最优的计算位置
多选题关于spark说法正确的是()。A调用RDD的Transformation算子可以立即发起jobBNodeManager负责整个集群的资源统一调度和分配。CYarn-client适合测试,Yarn-cluster适合生产。DDataset具有RDD和DataFrame的优点,又避免它们的缺点。