sparkCore wordCount小应用

需求:按照value值降序
wordcount.map(x=>(x._2,x._1)).sortByKey(false ).map(x=>(x._2,x._1)).collect()

需求:Top Key
wordcount.map(x=>(x._2,x._1)).sortByKey(false ).map(x=>(x._2,x._1)).take(3)

需求:Group Top Key
*按照第一个字段分组 ,输出为:(aa,list(68,17,49)),(bb,list(67,96,57))
*对分好组中的第二个字段进行排序,输出为:(aa,list(68,49,17))
*获取前k个,输出为(aa,list(68,49))
val rdd=sc. textFile(“hdfs://localhost:8020/usr/local/a.txt”)
rdd.map(_.split(” “)).collect ##输出为数组array(aa,78)
rdd.map(_.split(” “)).map(x=>x(0),x(1))##输出为:(aa,78)
rdd.map(_.split(” “)).map(x=>x(0),x(1)).groupByKey.collect ##输出为:(aa,CompactBuffer68,17,49))
rdd.map(_.split(” “)).map(x=>x(0),x(1)).groupBuKey.map(
x=>{
val xx=x._1
val yy=x._2
yy
}).collect

rdd.map(_.split(" ")).map(x=>x(0),x(1)).groupByKey().map(x=>{
x=>{
    val xx=x._1
    val yy=x._2
    (xx,yy.toList.sorted.reverse.take(3))
    }).collect

val aa=rdd.map(_.split(” “)).map(x=>x(0),x(1)).groupByKey().map(x=>{
x=>{
val xx=x._1
val yy=x._2
(xx,yy.toList.sorted.reverse.take(3))
}).collect

aa.saveAsTextFile(path)

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值