spark RDD

Spark計算模型 目標 熟練使用RDD的算子完成計算 掌握RDD的原理 彈性分佈式數據集RDD RDD概述 什麼是RDD RDD(Resilient Distributed Dataset)叫做分佈式數據集,是Spark中最基本的數據抽象,它代表一個不可變、可分區、裏面的元素可並行計算的集合。RDD具有數據流模型的特點:自動容錯、位置感知性調度和可伸縮性。RDD允許用戶在執行多個查詢時顯式地將工
相關文章
相關標籤/搜索