机缘
例如最初创作的初心便是记录一下自己的学习笔记,不知不觉已经创作的几十篇文章了,也收获了许多的阅读量,让我对创作博文有了更加的强烈的热情,我也会去创作更多的博文来记录自己的学习。
收获
在创作的期间也收获了许多志同道合的朋友,也学习到了许多大佬的创作技巧,也收获了一些粉丝,这对我的创作有了很大的帮助。
日常
在实习期间也创作的自己的博文来记录自己的学习情况,来帮助我对自己的学习有着更加好的关注度,让我有一个更好的学习习惯,对自己的知识有一个更加好的整理。
成就
import csv
import requests
import re
import time
def main(page):
url = f'https://tieba.baidu.com/p/7882177660?pn={page}'
headers = {
'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/106.0.0.0 Safari/537.36'
}
resp = requests.get(url,headers=headers)
html = resp.text
# 评论内容
comments = re.findall('style="display:;"> (.*?)</div>',html)
# 评论用户
users = re.findall('class="p_author_name j_user_card" href=".*?" target="_blank">(.*?)</a>',html)
# 评论时间
comment_times = re.findall('楼</span><span class="tail-info">(.*?)</span><div',html)
for u,c,t in zip(users,comments,comment_times):
# 筛选数据,过滤掉异常数据
if 'img' in c or 'div' in c or len(u)>50:
continue
csvwriter.writerow((u,t,c))
print(u,t,c)
print(f'第{page}页爬取完毕')
if __name__ == '__main__':
with open('01.csv','a',encoding='utf-8')as f:
csvwriter = csv.writer(f)
csvwriter.writerow(('评论用户','评论时间','评论内容'))
for page in range(1,8): # 爬取前7页的内容
main(page)
time.sleep(2)
憧憬
在后面的创作过程中会更加注重博文的质量,以便于能够来获取更加多的阅读量和获得更多的关注和粉丝。