spark dataframe 将一列展开,把该列所有值都变成新列的方法
更新时间:2019年01月29日 11:39:19 作者:Nougats
今天小编就为大家分享一篇spark dataframe 将一列展开,把该列所有值都变成新列的方法,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
The original dataframe
需求:hour代表一天的24小时,现在要将hour列展开,每一个小时都作为一个列
实现:
val pivots = beijingGeoHourPopAfterDrop.groupBy("geoHash").pivot("hour").sum("countGeoPerHour").na.fill(0)
并且统计了对应的countGeoPerHour的和,如果有些行没有这个新列对应的数据,将用null填充
The new dataframe
以上这篇spark dataframe 将一列展开,把该列所有值都变成新列的方法就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持脚本之家。
相关文章
零基础写python爬虫之urllib2中的两个重要概念:Openers和Handlers
文章首先介绍了urllib2的2个方法,然后详细介绍了urllib2中的2个重要概念Openers和Handlers的相关知识,希望能对大家有所帮助2014-11-11Python3.5内置模块之shelve模块、xml模块、configparser模块、hashlib、hmac模块用法
这篇文章主要介绍了Python3.5内置模块之shelve模块、xml模块、configparser模块、hashlib、hmac模块,结合实例形式较为详细的分析了shelve、xml、configparser、hashlib、hmac等模块的功能及使用方法,需要的朋友可以参考下2019-04-04解决Python 使用h5py加载文件,看不到keys()的问题
今天小编就为大家分享一篇解决Python 使用h5py加载文件,看不到keys()的问题,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧2019-02-02
最新评论