簡介 ??spark一個最重要的特性就是對數(shù)據(jù)集在各個節(jié)點的分區(qū)進行控制。控制數(shù)據(jù)分布可以減少網(wǎng)絡開銷,極大地提升整體性能。 ??只有Pair RDD才有分區(qū),非Pair RDD分區(qū)的值是None。如
億速云公眾號
手機網(wǎng)站二維碼
Copyright ? Yisu Cloud Ltd. All Rights Reserved. 2018 版權所有
廣州億速云計算有限公司粵ICP備17096448號 粵公網(wǎng)安備 44010402001142號增值電信業(yè)務經(jīng)營許可證編號:B1-20181529