网站资讯 news
您现在的位置:首页 > 网站资讯 > 降权蜘蛛
NEWS

新闻资讯

降权蜘蛛

发布时间:2017/03/04 网站资讯 浏览次数:1080

昆山网站建设

我们的站长们或者说SEO工作者最怕的事情是什么?对,是网站被降权或者被K,但是网站被降权有什么预兆吗?
如果依照搜索引擎或者说Spider的工作原理来说,应当是可以从发现降权蜘蛛中找到一些“蝴蝶翅膀振动“的兆头。
其实降权蜘蛛的发现,要从搜索引擎采用的分布式计算中对站点的分类说起。如果你是一个接触过很多站点的站长,那么你就会发现,百度的Spider经常会用同一个IP段的Spider对网站进行抓取,而对不同的网站又采用不同的的IP段的Spider来抓取,如果你真的看过足够多的站点,并且站点类型也足够丰富,那么,就会发现,百度或者其他搜索引擎的Spider任务分发模式,从而在做日志分析时发现自己的网站,在百度或者其他搜索引擎中是什么样的。
假设搜索引擎对站点进行了分类,然后根据优秀站点、普通站点、降权站点、屏蔽站点(被K)来对网站分类并使用不同IP段的Spider进行抓取,那么,网络上盛传的“降权蜘蛛”就真的存在了。比如,你如果在百度上搜索一下“百度降权蜘蛛IP段详解”,你就会发现这样的内容:

下面的百度蜘蛛IP造访,准备抓取你东西,抓取网页的百度蜘蛛。
60.172.229.61
61.129.45.72
61.135.162.*

百度竞价蜘蛛
61.135.165.134
117.34.74.66
118.122.188.194
119.63.196.9
125.39.78.185

(百度联盟爬虫),说白了就是百度统计。
61.135.186.*

站长工具模仿的百度蜘蛛。
61.147.98.146
61.188.39.16
113.98.254.245
117.21.220.245
117.28.255.42

114站长工具箱(这个是你的网站不稳定时常来的)
119.147.114.213
121.10.141.*

百度图片爬虫
123.15.**.**

这个蜘蛛经常来,别的来的少,表示网站可能要进入沙盒了,或被者降权。
123.125.68.*

抓取内页收录的,权重较低,爬过此段的内页文章暂时被收录但不放出来(意思也就是说待定),因不是原创或采集文章。(百度网页爬虫(百度图片爬虫)
123.125.71.*

搜外站长工具蜘蛛。
124.248.34.52

也属于百度蜘蛛IP 主要造成成分,是新上线站较多,还有使用过站长工具,或SEO综合检测造成的,没有多大用。
125.90.88.*

百度蜘蛛
159.226.50.*
180.76.5.*
180.76.5.87
220.181.158.107

伪装百度蜘蛛IP
180.149.130.*

这个ip段出现在新站及站点有不正常现象后。
183.91.40.144
203.208.60.*

这个ip段不间断巡逻各站,就是路过一下。
210.72.225.*
降权蜘蛛
每天这个IP 段只增不减很有可能进沙盒或K站
218.30.118.102
220.181.68.*
123.125.68.*
220.181.68.*

主要是抓取首页占80%,内页占30%,这此爬过的文章或首页,绝对24小时内放出来和隔夜快照的!一般成功抓取返回代码都是 200 0 0返回304 0 0代表网站没更新,蜘蛛来过,如果是 200 0 64别担心这不是K站,可能是网站是动态的,所以返回就是这个代码。
220.181.108.*

代表百度蜘蛛IP来访准备抓取你东西
220.181.7.*
123.125.66.*

这个ip段作为度过新站考察期
121.14.89.*

这个ip段出现在新站或站点有不正常现象后
203.208..60.*

这个ip段不间断巡逻各站
210.72.225.*

这个是百度抓取首页的专用IP如是220.181.108段的ip来的话基本来说网站会天天隔夜快照,绝对错不了的
220.181.108.95

98%抓取首页可能还会抓取其他「不是指内页)属于权重IP段此段爬过的文章或首页基本24小时放出来.
220.181.108.92

抓取内页收录的 权重较低 爬过此段的内页文章不会很快放出来,因不是原创或采集文章
123.125.71.106

属于综合的。主要抓取首页和内页或者其它页面。属于权重IP段, 抓过的文章或首页基本24小时放出来
220.181.108.91

重点抓取更新文章的内页达到90%,8%的抓取首页,2%其他权重ip段,抓过的文章或首页基本24小时放出来
220.181.108.75

专用抓取首页ip 权重段
220.181.108.86

抓取内页收录的,权重较低,爬过此段的内页文章不会很快放出来,因不是原创
123.125.71.95
123.125.71.97

专用抓取首页ip 权重段
220.181.108.89
220.181.108.94
220.181.108.97
220.181.108.80
220.181.108.77

抓取内页收录的, 权重较低,爬过此段的内页文章不会很快放出来,因不是原创
123.181.108.77

专用抓取首页ip 权重段,一般返回代码304 0 0代表未更新
220.181.108.83

上面所列的只是从百度搜出来的网友对搜索引擎的spider的IP段分析,有兴趣的朋友可以比对参照一下,权当一个小玩艺,知道这个东西就好,不要绝对当真,因为百度那么大的搜索引擎,不可能只采用一种任务分发模式,因为搜索引擎对网站和网页的分类有太多的纬度,而且各种纬度又综合使用,当然,这也可以是一种研究方向,尽管可能到最终一无所获,SEO照样可以乐在其中。

当然,如果你在你的站点日志中发现了所谓的“降权蜘蛛”IP段,那么,你就要对自己的网站进行仔细检查了,看是不是有哪些地方触碰了搜索引擎的高压线了。

云风网络是集昆山网站制作,昆山网页设计,昆山网站推广于一体的昆山网络公司,业务涵盖:昆山手机网站制作,昆山网站设计,昆山网络建设,昆山做网站,昆山网站建设,电话:13912673321

相关推荐
点击这里给我发消息 技术咨询
回到顶部