2024年最新大数据:数据合集,你想要的或许这里都有,2024年大数据开发技术下半场在哪

img
img
img

既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,涵盖了95%以上大数据知识点,真正体系化!

由于文件比较多,这里只是将部分目录截图出来,全套包含大厂面经、学习笔记、源码讲义、实战项目、大纲路线、讲解视频,并且后续会持续更新

需要这份系统化资料的朋友,可以戳这里获取

上海市政务数据服务网:覆盖经济建设、文化科技、信用服务、交通出行等12个重点领域数据。

贵州省政府数据开放平台:贵州省在政务数据开放方面做的确实不错。

Data.gov:美国政府开放数据,包含气候、教育、能源金融等各领域数据。

3.数据竞赛网站

竞赛的数据集通常干净且科研究性非常高。

DataCastle:专业的数据科学竞赛平台。

Kaggle:全球最大的数据竞赛平台。

天池:阿里旗下数据科学竞赛平台。

Datafountain:CCF制定大数据竞赛平台。

二、利用爬虫可以获得有价值数据


这里给出了一些网站平台,我们可以使用爬虫爬取网站上的数据,某些网站上也给出获取数据的API接口,但需要付费。

1.财经数据

(1)新浪财经:免费提供接口,这篇博客教授了如何在新浪财经上获取获取历史和实时股票数据。

(2)东方财富网:可以查看财务指标或者根据财务指标选股。

(3)中财网:提供各类财经数据。

(4)黄金头条:各种财经资讯。

(5)StockQ:国际股市指数行情。

(6)Quandl:金融数据界的维基百科。

(7)Investing:投资数据。

(8)整合的96个股票API合集。

(9)Market Data Feed and API:提供大量数据,付费,有试用期。

2.网贷数据

(1)网贷之家:包含各大网贷平台不同时间段的放贷数据。

(2)零壹数据:各大平台的放贷数据。

(4)网贷天眼:网贷平台、行业数据。

(5)76676互联网金融门户:网贷、P2P、理财等互金数据。

3.公司年报

(1)巨潮资讯:各种股市咨询,公司股票、财务信息。

(2)SEC.gov:美国证券交易数据

(3)HKEx news披露易:年度业绩报告和年报。

4.创投数据

(1)36氪:最新的投资资讯。

(2)投资潮:投资资讯、上市公司信息。

(3)IT桔子:各种创投数据。

5.社交平台

(1)新浪微博:评论、舆情数据,社交关系数据。

(2)Twitter:舆情数据,社交关系数据。

(3)知乎:优质问答、用户数据。

(4)微信公众号:公众号运营数据。

(5)百度贴吧:舆情数据

(6)Tumblr:各种福利图片、视频。

6.就业招聘

(1)拉勾:互联网行业人才需求数据。

(2)中华英才网:招聘信息数据。

(3)智联招聘:招聘信息数据。

(4)猎聘网:高端职位招聘数据。

7.餐饮食品

(1)美团外卖:区域商家、销量、评论数据。

(2)百度外卖:区域商家、销量、评论数据。

(3)饿了么:区域商家、销量、评论数据。

(4)大众点评:点评、舆情数据。

8.交通旅游

(1)12306:铁路运行数据。

(2)携程:景点、路线、机票、酒店等数据。

(3)去哪儿:景点、路线、机票、酒店等数据。

(4)途牛:景点、路线、机票、酒店等数据。

(5)猫途鹰:世界各地旅游景点数据,来自全球旅行者的真实点评。

类似的还有同程、驴妈妈、途家等

9.电商平台

(1)亚马逊:商品、销量、折扣、点评等数据

(2)淘宝:商品、销量、折扣、点评等数据

(3)天猫:商品、销量、折扣、点评等数据

(4)京东:3C产品为主的商品信息、销量、折扣、点评等数据

(5)当当:图书信息、销量、点评数据。

类似的唯品会、聚美优品、1号店等。

10.影音数据

(1)豆瓣电影:国内最受欢迎的电影信息、评分、评论数据。

(2)时光网:最全的影视资料库,评分、影评数据。

(3)猫眼电影专业版:实时票房数据,电影票房排行。

(4)网易云音乐:音乐歌单、歌手信息、音乐评论数据。

11.房屋信息

(1)58同城房产:二手房数据。

(2)安居客:新房和二手房数据。

(3)Q房网:新房信息、销售数据。

(4)房天下:新房、二手房、租房数据。

(5)小猪短租:短租房源数据。

12.购车租车

(1)网易汽车:汽车资讯、汽车数据。

(2)人人车:二手车信息、交易数据。

(3)中国汽车工业协会:汽车制造商产量、销量数据。

13.新媒体数据

新榜:新媒体平台运营数据。

img
img
img

既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,涵盖了95%以上大数据知识点,真正体系化!

由于文件比较多,这里只是将部分目录截图出来,全套包含大厂面经、学习笔记、源码讲义、实战项目、大纲路线、讲解视频,并且后续会持续更新

需要这份系统化资料的朋友,可以戳这里获取

体平台运营数据。

[外链图片转存中…(img-YMq1qcMK-1715659402210)]
[外链图片转存中…(img-fubtCeE6-1715659402211)]
[外链图片转存中…(img-nhWhZgLx-1715659402211)]

既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,涵盖了95%以上大数据知识点,真正体系化!

由于文件比较多,这里只是将部分目录截图出来,全套包含大厂面经、学习笔记、源码讲义、实战项目、大纲路线、讲解视频,并且后续会持续更新

需要这份系统化资料的朋友,可以戳这里获取

  • 14
    点赞
  • 25
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
### 回答1: 抓取网站数据需要用到网络请求库,这里我们使用 Java 的 OkHttp 库来发送 HTTP 请求。以下是示例代码: ```java import okhttp3.OkHttpClient; import okhttp3.Request; import okhttp3.Response; import java.io.IOException; public class FootballStatsScraper { private static final String BASE_URL = "http://www.win007.com/jsData/matchResult/"; public static void main(String[] args) { OkHttpClient client = new OkHttpClient(); for (int i = 1; i <= 38; i++) { String leagueUrl = BASE_URL + "cn/2019-2020/z" + i + ".js"; try { String leagueData = fetchData(client, leagueUrl); System.out.println("League " + i + ":\n" + leagueData); } catch (IOException e) { System.err.println("Failed to fetch data for league " + i); e.printStackTrace(); } } } private static String fetchData(OkHttpClient client, String url) throws IOException { Request request = new Request.Builder() .url(url) .build(); Response response = client.newCall(request).execute(); return response.body().string(); } } ``` 该代码会循环遍历所有联赛(共38个),并以类似 `http://www.win007.com/jsData/matchResult/cn/2019-2020/z1.js` 的格式构造 URL。然后使用 OkHttp 库发送请求并获取数据。在控制台输出每个联赛的数据。 ### 回答2: 以下是使用Java抓取球探足球网站上半场所有足球数据的示例代码: ```java import org.jsoup.Jsoup; import org.jsoup.nodes.Document; import org.jsoup.nodes.Element; import org.jsoup.select.Elements; import java.io.IOException; public class FootballDataScraper { public static void main(String[] args) { try { // 使用Jsoup连接球探足球网站并获取网页内容 Document doc = Jsoup.connect("http://www.qiutan.com/") .header("Accept-Encoding", "gzip, deflate") .userAgent("Mozilla/5.0 (Windows NT 6.3; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/57.0.2987.133 Safari/537.36") .get(); // 在网页中查找所有上半场足球数据的元素,这里我们假设数据在class为"football-data"的div中 Elements footballDataElements = doc.select("div.football-data"); // 遍历所有足球数据元素,提取所需的信息,并输出到控制台 for (Element element : footballDataElements) { String homeTeam = element.select("span.home-team").text(); String awayTeam = element.select("span.away-team").text(); String score = element.select("span.score").text(); System.out.println("主队: " + homeTeam); System.out.println("客队: " + awayTeam); System.out.println("比分: " + score); System.out.println("---------------------"); } } catch (IOException e) { e.printStackTrace(); } } } ``` 这个示例代码使用了Jsoup库来连接球探足球网站,并通过Jsoup提供的选择器功能找到网页中所有上半场足球数据的元素。然后,它提取了每个足球数据元素中的主队、客队和比分信息,并将其输出到控制台。请注意,在实际使用中,你可能需要根据球探足球网站的网页结构和选择器定义更准确的选择器,以找到正确的足球数据元素。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值