如何在18天内让Google收录超过55亿个网页

转载 2006年06月18日 16:00:00
点击看大图  今天这个新闻成为了热点,同时也让人感到非常吃惊。这也许是有史以来最成功的Spam个案,因为它成功地骗过了Google,让Google在18天内收录了它的超过55亿个网页。这是一个前所未有的例子,同时也对Google的形象造成了一定的影响。那么到底是谁这么厉害,用什么样的方法做到这一点的呢?下面我们一起来看一下实现的方法。

  根据Monetize(via digg)的报道,下面这两个网站被Google收录的网页数量达到了惊人的几十亿:

  直接点击这里看站点一的Google收录结果

  直接点击这里看站点二的Google收录结果

  要提醒一下的是,点击上面的链接时,每个人返回的结果数并不一定相同,这是因为每个人访问的Google数据中心不一定相同。但结果都是十分惊人的。为了保存记录,我截了两个图:

点击看大图
这是站点一的收录结果,接近24亿个。

点击看大图
这是站点二的收录结果,少一些,但也接近20亿个。

  根据数据中心的结果的不同,以上两个站点能查询到的Google收录数量分别最多可达55亿个和24亿个。当然,不排除这件事曝光后Google会对这个站采取行动,估计以后查询的话,结果数量会更少。

  然而更令人吃惊的是上面的两个站点的域名都只有18天历史,也就是说这两个站在3个星期内,就已经被Google收录了几十亿个网页。更不可思议的是,这两个站点的拥有者为同一个人,并且站点的每个网页上竟然都投放着Google AdSense广告!(写到这里,我再次打开这两个站点,却找不到AdSense广告了,因为站点被曝光后站长已经快速地撤走了所有广告,但之前的确是有的)可想而知这两个站点已经从Google手里赚走了多少广告费。

  那么到底这种超级Spam是怎样实现的呢?下面是大概的方法:

1.注册一个无意义的域名,域名由数字、字母及特定符号组成。注册多一些,比如100个;

2.用服务器把这些域名及相关的子域名管理起来。为域名建立尽可能多的子域名。当然,你需要一个足够强大的服务器,因为在接下来的几个星期里,它将要承受巨大的访问压力;

3.弄来尽可能多的文章数据库。不管你是采集还是用钱买的,尽量弄多一些,至于内容是什么并不重要。最好把这些数据库中的某些字符替换成相应的ASCII码,这样就不会被搜索引擎认为是重复的内容;

4.自己编写或购买一个特定的脚本。这个脚本的作用是用来返回不同关键词的相关结果,并且有效地让数据库的内容分配到不同的子域名里。这个脚本应该能应付所有的查询。并且在服务器里设置所有的子域名都自动转向域名主页,并且由这个脚本决定显示的内容。并且你还要为这些子域名创建无限多的子域名,比如abc.xyz.com,变成123.abc.xyz.com。这是为了欺骗Google,因为Google(或者MSN、Yahoo!等)都认为一个子域名是一个新站点。这一点是成功的关键,如果你自己没有这种能力,那么最好出钱叫别人做。由于某些原因,这里只写大概。

5.发动blog评论spam攻势。把你的子域名遍布尽可能多的blog或其它网站;

6.等待几个星期,你将会有惊喜。

  上面例子中的站点可谓超级垃圾站,并且Google没能成功地识别这是一种Spam行为,反而收录了它的几十亿个网页。相比国内的一些单纯通过采集数据而建立起的垃圾站而言,这两个站的站长就聪明得多了。但无论如何,这种行为都是应该要受到所有搜索引擎的惩罚才行,否则对于广大正规做站的站长而言,是极不公平的行为。同时这种行为也会极大地损害Google在用户心里的形象,破坏用户对Google的信赖感。

  我的估计是这两个站很快就会被Google处以极刑。当然,与Spam站点作斗争是所有搜索引擎共同面对的任务,这是一个漫长的过程。但作为普通用户,我们更希望的是包括Google在内的搜索引擎可以提高识别垃圾站的能力,净化搜索结果,提高准确度。

google web designer linux网页设计器

  • 2017年07月17日 18:10
  • 41.65MB
  • 下载

Google Earth网页版初探

最近三维GIS界有个比较爆炸性的消息,嗯,没错,Google Earth Enterprise(谷歌地球企业版)宣告开源,47万行代码的大项目就此开放。(深深感觉谷歌就是要搞事情)。 当然更大事情是G...
  • ESA_DSQ
  • ESA_DSQ
  • 2017年04月19日 23:30
  • 1716

模仿google的拖拽的个性网页布局

  • 2012年03月16日 15:55
  • 169KB
  • 下载

为何 Gmail、Google Reader 和大部分网页应用都使用 J 和 K 作为导航快捷键

转自:http://www.guao.hk/posts/why-do-gmail-and-other-web-apps-use-j-k-keys-for-navigation.html ...

如何在制作的网页中加入google地图

http://i.mtime.com/5667366/blog/6875975/   Google Maps JavaScript API V3 教程 注意:以下网页中提到的 G...

利用JavaScript和Google API在网页中加入地图

首先获取当前位置的经纬度,然后利用谷歌的API来显示一个地图,并用大头针标记自己的当前位置。 Google Map .map { width: 400px; ...

Google Python Class 之——正则表达式提取html网页数据字段

需要提取的内容格式: Popularity in 1990 .... 1MichaelJessica 2ChristopherAshley 3MatthewBrittany #!/usr/b...

谷歌图形化HTML5网页编辑器Google Web Designer

谷歌图形化HTML5网页编辑器Google Web Designer

【Google Chrome】如何让浏览器显示手机网页

先前在网上爬文的时候看到过很多文章说在Chrome的快捷方式上加参数以达到显示手机网页的效果,总感觉有点不妥。 今天在老外网站上看到一篇文章,如何把各种浏览器变成手机模拟器,以达到显示手机网页的效果...
  • XChicken
  • XChicken
  • 2014年03月06日 07:19
  • 10960
内容举报
返回顶部
收藏助手
不良信息举报
您举报文章:如何在18天内让Google收录超过55亿个网页
举报原因:
原因补充:

(最多只允许输入30个字)