mongodb和spark的整合(sparkRDD,sparkSQL)

本文探讨了如何将MongoDB数据库与Apache Spark进行集成,重点介绍了使用SparkCore的RDD操作以及通过SparkSQL进行数据查询的方法。
摘要由CSDN通过智能技术生成

话不多数,代码来了

sparkcore和mongodb

package com.bw.day02

import com.mongodb.spark.MongoSpark
import com.mongodb.spark.rdd.MongoRDD
import org.apache.spark.{SparkConf, SparkContext}
import org.bson.Document

object MongoSparkRDD {

  def main(args: Array[String]): Unit = {

    val conf = new SparkConf()
      .setMaster("local[*]").setAppName("MongoSparkRDD")
      .set("spark.mongodb.input.uri", "mongodb://he:123456@192.168.12.11:27017/bike.log")
      .set("spark.mongodb.output.uri", "mongodb://he:123456@192.168.12.11:27017/bike.result")
    //创建sparkContext
    val sc = new SparkContext(conf)

    val MongoRDD: MongoRDD[Document] = MongoSpark.load(sc)

    val pv: Long = MongoRDD.count()
    //过滤,缓存  按照每天


    val uv = MongoRDD.map(rdd => {
      rdd.getString("openid")
    }).distinct().count()

    println("pv " +
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值