LocalLR

最新推荐文章于 2021-05-06 21:49:50 发布

润砾成珠

最新推荐文章于 2021-05-06 21:49:50 发布

阅读量526

点赞数

分类专栏： spark

本文链接：https://blog.csdn.net/u011569805/article/details/37829903

版权

spark 专栏收录该内容

14 篇文章 0 订阅

订阅专栏

1. 生成Array,由N个 DataPoint(Vector, Double), DataPoint 由 rand 随机生成D个元素组成Vector

def generateData = {
    def generatePoint(i: Int) = {
      val y = if(i % 2 == 0) -1 else 1
      val x = DenseVector.fill(D){rand.nextGaussian + y * R}
      DataPoint(x, y)
    }
    Array.tabulate(N)(generatePoint)
  }

2. 定义 DataPoint

case class DataPoint(x: Vector[Double], y: Double)

3.随机初始化系数 w (和vector维数一样D)

var w = DenseVector.fill(D){2 * rand.nextDouble - 1}

4. 跌代 ITERATIONS次，计算 gradient, 逻辑回归 (1/ 1+ e(-y * (w 点乘 vector(x))) - 1) * p.y 不断调节权重

 for (i <- 1 to ITERATIONS) {
      println("On iteration " + i)
      var gradient = DenseVector.zeros[Double](D)
      for (p <- data) {
        val scale = (1 / (1 + math.exp(-p.y * (w.dot(p.x)))) - 1) * p.y
        gradient +=  p.x * scale
      }
      w -= gradient
    }

5. 并行化

 val sparkConf = new SparkConf().setAppName("SparkLR")
    val sc = new SparkContext(sparkConf)
    val numSlices = if (args.length > 0) args(0).toInt else 2
    val points = sc.parallelize(generateData, numSlices).cache()

    // Initialize w to a random value
    var w = DenseVector.fill(D){2 * rand.nextDouble - 1}
    println("Initial w: " + w)

    for (i <- 1 to ITERATIONS) {
      println("On iteration " + i)
      val gradient = points.map { p =>
        p.x * (1 / (1 + exp(-p.y * (w.dot(p.x)))) - 1) * p.y
      }.reduce(_ + _)
      w -= gradient
    }

    println("Final w: " + w)
    sc.stop()

润砾成珠

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
LocalLR

1. 生成Arraydef generateData = { def generatePoint(i: Int) = { val y = if(i % 2 == 0) -1 else 1 val x = DenseVector.fill(D){rand.nextGaussian + y * R} DataPoint(x, y) } A
复制链接

扫一扫