spark分析学生成绩排名

最新推荐文章于 2024-07-08 15:09:49 发布

编外人员_coder

最新推荐文章于 2024-07-08 15:09:49 发布

阅读量3.2k

点赞数 2

文章标签： spark hdfs

本文链接：https://blog.csdn.net/zx421311541/article/details/103661996

版权

通过sparkSql的分析学生成绩在全校、全区、全市的排名

最近在公司做了一个关于学生成绩的排名、因为数据量很大，导入mysql后跑不起来，因此用spark来做的。当然用hive也能做，将hdfs上的数据load到hive中然后使用sql语句进行查询，如果会编码的话不建议这么做，因为它的底层还是转换成mapreduce提交执行，效率不够高。

代码

pom依赖

<dependencies>
        <dependency>
            <groupId>org.apache.spark</groupId>
            <artifactId>spark-core_2.11</artifactId>
            <version>2.2.0</version>
        </dependency>
        <dependency>
            <groupId>org.apache.spark</groupId>
            <artifactId>spark-sql_2.11</artifactId>
            <version>2.2.0</version>
        </dependency>
        <!-- https://mvnrepository.com/artifact/log4j/log4j -->
        <dependency>
            <groupId>log4j</groupId>
            <artifactId>log4j</artifactId>
            &

最低0.47元/天解锁文章

编外人员_coder

关注

2
点赞
踩
9

收藏

觉得还不错? 一键收藏
0
评论
spark分析学生成绩排名

通过sparkSql的分析学生成绩在全校、全区、全市的排名最近在公司做了一个关于学生成绩的排名、因为数据量很大，导入mysql后跑不起来，因此用spark来做的。当然用hive也能做，将hdfs上的数据load到hive中然后使用sql语句进行查询，如果会编码的话不建议这么做，因为它的底层还是转换成mapreduce提交执行，效率不够高。代码pom依赖<dependencies&gt...
复制链接

扫一扫