小編教教你如何識別百度蜘蛛爬蟲程序
來源:m.yokenpharm.com | 更新時間:2019/12/23 16:10:04百度蜘蛛是什么?如何識別百度蜘蛛?這是很多SEO從業人員在剛剛接觸這個行業的時候會需要了解的問題,那么今天小編教教你如何識別百度蜘蛛爬蟲程序。首先我們可以理解為百度蜘蛛就是用來抓取網站目標頁面的一個抓取程序。關于百度蜘蛛識別這個問題,小編經常會聽到百度蜘蛛來的太頻繁,服務器要被抓爆了,如果你無法識別百度蜘蛛,你怎么知道是百度蜘蛛抓爆的呢?也有出現百度蜘蛛都不來了的情況,還有很多站點想得到百度蜘蛛的IP段,想把IP加入白名單,但無法識別百度IP。那怎么才能識別正確的百度蜘蛛呢?來來來,只需做著兩點,就能正確識別百度蜘蛛(以下的兩種方法是小編通過采集的其它互聯網平臺的信息之后,再通過自身實踐操作后篩選總結的兩種方法)
一、查看UA,如果UA都不對,可以直接判斷非百度搜索的蜘蛛,目前對外公布過的UA是:
移動UA:Mozilla/5.0 (Linux;u;Android 4.2.2;zh-cn;) AppleWebKit/534.46 (KHTML,likeGecko) Version/5.1 Mobile Safari/10600.6.3 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)
PC UA:Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)
新增渲染UA:
移動UA:Mozilla/5.0 (iPhone; CPU iPhone OS 9_1 likeMac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko) Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)
PC UA:Mozilla/5.0 (compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)
二、反查IP
站長可以通過DNS反查IP的方式判斷某只spider是否來自百度搜索引擎。根據平臺不同驗證方法不同,如linux/windows/os三種平臺下的驗證方法分別如下:
正確識別百度蜘蛛
(1)、在linux平臺下,您可以使用host ip命令反解ip來判斷是否來自Baiduspider的抓取。Baiduspider的hostname以 *.baidu.com 或 *.baidu.jp 的格式命名,非 *.baidu.com 或 *.baidu.jp 即為冒充。
(2)、在windows平臺或者IBM OS/2平臺下,您可以使用nslookup ip命令反解ip來 判斷是否來自Baiduspider的抓取。打開命令處理器 輸入nslookup xxx.xxx.xxx.xxx(IP地 址)就能解析ip, 來判斷是否來自Baiduspider的抓取,Baiduspider的hostname以*.baidu.com 或*.baidu.jp 的格式命名,非 *.baidu.com 或 *.baidu.jp 即為冒充。
(3)、 在mac os平臺下,您可以使用dig 命令反解ip來 判斷是否來自Baiduspider的抓取。打開命令處理器 輸入dig xxx.xxx.xxx.xxx(IP地 址)就能解析ip, 來判斷是否來自Baiduspider的抓取,Baiduspider的hostname以 *.baidu.com 或*.baidu.jp 的格式命名,非 *.baidu.com 或 *.baidu.jp 即為冒充。
以上關于如何識別百度蜘蛛爬蟲程序的方法希望對大家有所幫助,運用到實際操作中實現良好的SEO優化排名效果。更多關于SEO優化排名的相關知識歡迎隨時來電咨詢了解,我們將竭誠為您提供服務。