首页 > 优化 > 关键词  > SEO最新资讯  > 正文

搜索引擎蜘蛛抓取页面过程图解

2012-02-06 16:30 · 稿源:seowlyx.co

《搜索引擎蜘蛛抓取页面过程图解》文章已经归档,站长之家不再展示相关内容,下文是站长之家的自动化写作机器人,通过算法提取的文章重点内容。这只AI还很年轻,欢迎联系我们帮它成长:

学习seo的人经常在网上看到一句话:搜索引擎蜘蛛跟浏览器差不多,都是抓取页面...

首先看一张图,是用firebug(firefox浏览器的一个著名插件)记录下来的浏览器抓取我网站的情况...

这里浏览器是一种客户端程序,搜索引擎蜘蛛也是一种客户端程序...

2.ip地址,后面冒号加80,表明访问的是服务器的80端口...

搜索引擎在各地都有蜘蛛服务器,每个服务器同时放出很多蜘蛛,日夜不停地抓取网页...

不过没有关系,浏览器和搜索引擎蜘蛛都可以解压缩gzip文件...

搜索引擎对网页文件大小有个上限,一种说法是128k(未压缩),超过128k的内容不再抓取...

有的服务器为了不让百度蜘蛛抓取,会封禁百度蜘蛛的User-Agent,参见百度站长俱乐部发布的百度SpiderUser-Agent字段更新通知...

......

本文由站长之家用户“seowlyx.co”投稿,本平台仅提供信息索引服务。由于内容发布时间超过平台更新维护时间,为了保证文章信息的及时性,内容观点的准确性,平台将不提供完整的内容展现,本页面内容仅为平台搜索索引使用。需阅读完整内容的用户,请联系作者获取原文。

举报

  • 相关推荐
  • 大家在看

今日大家都在搜的词:

热文

  • 3 天
  • 7天