spark 操作 spark-shell

读取HDFS 上文件命令,

spark.read.textFile("/user/ssy.097").count


spark.read.wholeTextFiles
SparkContext.wholeTextFiles 能够读取指定目录下的许多小文本文件


spark.read.textFile("/user/ssy.097").map(_.split("\u001,-1")).show           //相当于把每一行的内容看做一个map


spark.read.parquet("/user/ssy.097").createOrReplaceTempView("")      // createOrReplaceTempView注册为临时表   注册完临时表就可以写sql语句去查询你需要的信息了


val df = sqlContext.read.json("file:///usr/local/spark/examples/src/main/resources/people.json")  读取 JSON 格式的数据

DataFrames 处理结构化数据
df.select("name").show()    // 只显示 "name" 列
df.select(df("name"), df("age") + 1).show() // 将 "age" 加 1
df.filter(df("age") > 21).show()  //条件语句
df.groupBy("age").count().show()   // groupBy 操作

 SQL 语句来进行操作
df.reg

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值