Spark常见错误

最新推荐文章于 2023-04-13 11:17:34 发布

anoperA

最新推荐文章于 2023-04-13 11:17:34 发布

阅读量790

点赞数

分类专栏： Spark 文章标签： spark scala

本文链接：https://blog.csdn.net/a1158375969/article/details/78582754

版权

Spark 专栏收录该内容

6 篇文章 0 订阅

订阅专栏

scala> val lines = sc.textFile("README.md")
scala> lines.count()
org.apache.hadoop.mapred.InvalidInputException: Input path does not exist: hdfs://192.168.32.132:9000/user/walter/README.md
  at org.apache.hadoop.mapred.FileInputFormat.singleThreadedListStatus(FileInputFormat.java:287)
  at org.apache.hadoop.mapred.FileInputFormat.listStatus(FileInputFormat.java:229)
  at org.apache.hadoop.mapred.FileInputFormat.getSplits(FileInputFormat.java:315)
  at org.apache.spark.rdd.HadoopRDD.getPartitions(HadoopRDD.scala:200)
  at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:248)
  at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:246)
  at scala.Option.getOrElse(Option.scala:121)
  at org.apache.spark.rdd.RDD.partitions(RDD.scala:246)
  at org.apache.spark.rdd.MapPartitionsRDD.getPartitions(MapPartitionsRDD.scala:35)
  at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:248)
  at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:246)
  at scala.Option.getOrElse(Option.scala:121)
  at org.apache.spark.rdd.RDD.partitions(RDD.scala:246)
  at org.apache.spark.SparkContext.runJob(SparkContext.scala:1911)
  at org.apache.spark.rdd.RDD.count(RDD.scala:1115)
  ... 48 elided

上面的sc.textFile()中的路径默认是hdfs路径
如果要使用本地路径应该使用
val lines = sc.textFile(“file:///filepath/”)

anoperA

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Spark常见错误

scala> val lines = sc.textFile("README.md")scala> lines.count()org.apache.hadoop.mapred.InvalidInputException: Input path does not exist: hdfs://192.168.32.132:9000/user/walter/README.md at org.apa
复制链接

扫一扫

专栏目录