「Python入门只需20分钟」从安装到数据抓取、存储原来这么简单_python抓取并存入数据库编程入门

写第一段Python代码

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

这段代码类似于 Java 中的 Main 方法。可以直接鼠标右键,选择 Run。

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

第二步:请求RUL

python 的强大之处就在于它有大量的模块(类似于Java 的 jar 包)可以直接拿来使用。

我们需要安装一个 request 模块: File - Setting - Product - Product Interpreter

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

点击如上图的 + 号,就可以安装 Python 模块了。搜索 requests 模块(有 s 噢),点击 Install。

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

我们顺便再安装一个 beautifulSoup4 和 pymysql 模块,beautifulSoup4 模块是用来解析 html 的,可以对象化 HTML 字符串。pymysql 模块是用来连接 mysql 数据库使用的。

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

相关的模块都安装之后,就可以开心的敲代码了。

定义一个 getContent 方法:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

在 main 方法中调用:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

第三步:分析页面数据

定义一个 getData 方法

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

上面的解析其实就是按照 HTML 的规则解析的。可以打开 杭州天气 在开发者模式中(F12),看一下页面的元素分布。

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

在 main 方法中调用:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

数据写入excel

现在我们已经在 Python 中拿到了想要的数据,对于这些数据我们可以先存放起来,比如把数据写入 csv 中。

定义一个 writeDate 方法:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

在 main 方法中调用:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

执行之后呢,再指定路径下就会多出一个 weather.csv 文件,可以打开看一下内容。

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

到这里最简单的数据抓取–储存就完成了。

数据写入数据库

因为一般情况下都会把数据存储在数据库中,所以我们以 mysql 数据库为例,尝试着把数据写入到我们的数据库中。

第一步创建WEATHER 表:

创建表可以在直接在 mysql 客户端进行操作,也可能用 python 创建表。在这里 我们使用 python 来创建一张WEATHER 表。

定义一个 createTable 方法:(之前已经导入了 import pymysql 如果没有的话需要导入包)

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

在 main 方法中调用:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

执行之后去检查一下数据库,看一下 weather 表是否创建成功了。

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

第二步批量写入数据至 WEATHER 表:

定义一个 insertData 方法:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

在 main 方法中调用:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

在这里插入图片描述

感谢每一个认真阅读我文章的人,看着粉丝一路的上涨和关注,礼尚往来总是要有的:

① 2000多本Python电子书(主流和经典的书籍应该都有了)

② Python标准库资料(最全中文版)

③ 项目源码(四五十个有趣且经典的练手项目及源码)

④ Python基础入门、爬虫、web开发、大数据分析方面的视频(适合小白学习)

⑤ Python学习路线图(告别不入流的学习)

网上学习资料一大堆,但如果学到的知识不成体系,遇到问题时只是浅尝辄止,不再深入研究,那么很难做到真正的技术提升。

需要这份系统化学习资料的朋友,可以戳这里无偿获取

一个人可以走的很快,但一群人才能走的更远!不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人,都欢迎加入我们的的圈子(技术交流、学习资源、职场吐槽、大厂内推、面试辅导),让我们一起学习成长!
网上学习资料一大堆,但如果学到的知识不成体系,遇到问题时只是浅尝辄止,不再深入研究,那么很难做到真正的技术提升。

需要这份系统化学习资料的朋友,可以戳这里无偿获取

一个人可以走的很快,但一群人才能走的更远!不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人,都欢迎加入我们的的圈子(技术交流、学习资源、职场吐槽、大厂内推、面试辅导),让我们一起学习成长!

  • 12
    点赞
  • 14
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值