Spark mllib 贝叶斯分类

最新推荐文章于 2022-05-25 14:50:59 发布

瓦力冫

最新推荐文章于 2022-05-25 14:50:59 发布

阅读量800

点赞数

分类专栏： Spark mllib

本文链接：https://blog.csdn.net/fox64194167/article/details/81055361

版权

Spark mllib 专栏收录该内容

9 篇文章 0 订阅

订阅专栏

贝叶斯定理

已知某条件概率，如何得到两个事件交换后的概率，也就是在已知P(A|B)的情况下如何求得P(B|A)。这里先解释什么是条件概率：

表示事件B已经发生的前提下，事件A发生的概率，叫做事件B发生下事件A的条件概率。其基本求解公式为：

下面直接给出贝叶斯定理：

package com.immooc.spark

import org.apache.log4j.{Level, Logger}
import org.apache.spark.mllib.classification.NaiveBayes
import org.apache.spark.mllib.linalg.Vectors
import org.apache.spark.mllib.regression.LabeledPoint
import org.apache.spark.{SparkConf, SparkContext}

object NaiveBayesTest {
  def main(args:Array[String]): Unit = {


    val conf = new SparkConf().setAppName("NaiveBayes").setMaster("local[2]")
    val sc = new SparkContext(conf)

    Logger.getRootLogger.setLevel(Level.WARN)

     val data = sc.textFile("file:///Users/walle/Documents/D3/sparkmlib/football.txt")
     val parsedData = data.map{ line =>
         val parts = line.split(',')
         LabeledPoint(parts(0).toDouble, Vectors.dense(parts(1).split(' ').map(_.toDouble)))
     }
     val splits = parsedData.randomSplit(Array(0.6, 0.4), seed = 11L)
     val training = splits(0)
     val test = splits(1)

     val model = NaiveBayes.train(training, lambda = 1.0, modelType = "multinomial")

     val predictionAndLabel = test.map(p => (model.predict(p.features), p.label))
     val print_predict = predictionAndLabel.take(20)
      for (i <- 0 to print_predict.length - 1){
         println(print_predict(i)._1 + "\t" + print_predict(i)._2)
      }

    println("Predictionof (0.0, 2.0, 0.0, 1.0):"+model.predict(Vectors.dense(0.0,2.0,0.0,1.0)))

  }
}

http://www.waitingfy.com/archives/4671

1. 数据

2. 输出

 1.0	1.0
1.0	1.0
0.0	1.0
1.0	1.0
0.0	0.0
Predictionof (0.0, 2.0, 0.0, 1.0):0.0

瓦力冫

关注

0
点赞
踩
2

收藏

觉得还不错? 一键收藏
打赏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录