Java定时爬取数据

本文介绍了一位新入职员工如何使用Java进行网页爬虫开发,包括配置文件设置、理解网页结构、利用jsoup解析网页,并实现定时任务自动抓取学校新闻并存储到数据库中。
摘要由CSDN通过智能技术生成

刚刚入职一家教育机构,被要求爬取一些学校的新闻到数据库来丰富公司对外系统的页面丰富性,接下来是一些简单的教程。

一.配置文件

applicationContent如下

<?xml version="1.0" encoding="UTF-8"?>

<bean id="tellingTheTimeService" class="service.impl.TellingTheTimeServiceImpl"/>

<!-- 配置一个Job -->
<bean id="tellTheTimeJob" class="org.springframework.scheduling.quartz.JobDetailBean">
	<property name="jobClass" value="jobs.TellingTheTimeJob"/>
	<property name="jobDataAsMap">
		<map>
			<entry key="tellingTheTimeService" value-ref="tellingTheTimeService"></entry>
		</map>
	</property>
</bean>

<!-- 简单的触发器 -->
<bean id="simpleTellTheTimeTrigger" class="org.springframework.scheduling.quartz.SimpleTriggerBean">
	<property name="jobDetail">
		<ref bean="tellTheTimeJob" />
	</property>
	<!-- 以毫秒为单位,启动后一分钟触发 -->
	<property name="startDelay">
		<value>1000</value>
	</property>
	<!-- 每间隔一分钟触发一次 -->
	<property name="repeatInterval">
		<value>600000</value>
	</property>
</bean>

<!-- 复杂的触发器 -->
<bean id="complexTellTheTimeTrigger" class="org.springframework.scheduling.quartz.CronTriggerBean">
	<property name="jobDetail">
		<ref bean="tellTheTimeJob"/>
	</property>
	<property name="cronExpression">
		<!-- 这里是重点,可以自定义表达式实现定时触发。以下含义是每分钟触发一次 -->
		<value>*/5 * * * * ?</value>
	</property>
</bean>

<!-- Spring触发工厂 -->
<bean class="org.springframework.scheduling.quartz.SchedulerFactoryBean">
	<property name="triggers">
		<list>
			<!--<ref bean="complexTellTheTimeTrigger"/>
			--><ref bean="simpleTellTheTimeTrigger"/>
			<!-- ....下面可以继续添加其他触发器 -->
		</list>
	</property>
</bean>
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值