[36]抓取任务与实际抓取动作关系的说明

前面不断提到了 抓取任务博客抓取 两个词,从字面意思上大家可能感觉是同一个意思,实际上这两个词是完全不同的两个概念

  • 抓取任务:指用户提交的任务
  • 博客抓取:指系统执行抓取的动作

为什么说这两者有不同呢?

这要从我RSS抓取引擎的设计说起

在设计系统之初,考虑到用户提交任务可能会非常密集,或者多个用户提交抓取同一博客的不同任务(因为任务创建者对应不同用户),所以会造成 在同一时间有多个任务需要抓取同一个博客

那我们是否需要对每个任务单独执行呢?

答案是否定的,因为在非常短的时间段内,博客进行更新的可能性几乎为零,而对同一个博客在1分钟内进行多次抓取,不仅会造成资源的过度浪费,还有可能被博客提供商的服务器认为是在进行恶意cc攻击,从而屏蔽了我们的抓取服务器,造成抓取受阻

如何解决这个问题?

这里我通过 任务对动作是n对1的关系 来设计系统,也就是说如果在某个时间点有多个任务对应同一个博客,我们的抓取引擎就只需要抓取一次,在本次动作完成后,这些任务都会被标记为完成状态

这样做的优点

通过这样一种n对1的设计,不仅优化了抓取速度,减少了任务的等待时间,还能够减轻系统负担,同时还减轻了博客服务器的压力,属于一举多得的设计

展开阅读全文

Git 实用技巧

11-24
这几年越来越多的开发团队使用了Git,掌握Git的使用已经越来越重要,已经是一个开发者必备的一项技能;但很多人在刚开始学习Git的时候会遇到很多疑问,比如之前使用过SVN的开发者想不通Git提交代码为什么需要先commit然后再去push,而不是一条命令一次性搞定; 更多的开发者对Git已经入门,不过在遇到一些代码冲突、需要恢复Git代码时候就不知所措,这个时候哪些对 Git掌握得比较好的少数人,就像团队中的神一样,在队友遇到 Git 相关的问题的时候用各种流利的操作来帮助队友于水火。 我去年刚加入新团队,发现一些同事对Git的常规操作没太大问题,但对Git的理解还是比较生疏,比如说分支和分支之间的关联关系、合并代码时候的冲突解决、提交代码前未拉取新代码导致冲突问题的处理等,我在协助处理这些问题的时候也记录各种问题的解决办法,希望整理后通过教程帮助到更多对Git操作进阶的开发者。 本期教程学习方法分为“掌握基础——稳步进阶——熟悉协作”三个层次。从掌握基础的 Git的推送和拉取开始,以案例进行演示,分析每一个步骤的操作方式和原理,从理解Git 工具的操作到学会代码存储结构、演示不同场景下Git遇到问题的不同处理方案。循序渐进让同学们掌握Git工具在团队协作中的整体协作流程。 在教程中会通过大量案例进行分析,案例会模拟在工作中遇到的问题,从最基础的代码提交和拉取、代码冲突解决、代码仓库的数据维护、Git服务端搭建等。为了让同学们容易理解,对Git简单易懂,文章中详细记录了详细的操作步骤,提供大量演示截图和解析。在教程的最后部分,会从提升团队整体效率的角度对Git工具进行讲解,包括规范操作、Gitlab的搭建、钩子事件的应用等。 为了让同学们可以利用碎片化时间来灵活学习,在教程文章中大程度降低了上下文的依赖,让大家可以在工作之余进行学习与实战,并同时掌握里面涉及的Git不常见操作的相关知识,理解Git工具在工作遇到的问题解决思路和方法,相信一定会对大家的前端技能进阶大有帮助。
©️2020 CSDN 皮肤主题: 游动-白 设计师: 上身试试 返回首页
实付0元
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、C币套餐、付费专栏及课程。

余额充值