国产成人精品999视频&日本一区二区亚洲人妻精品&久久久精品国产99久久精&99热这里只有成人精品国产&精品国产剧情av一区二区&成人亚洲精品久久久久app&国产精品美女高潮抽搐A片

Categories


Tags


【干貨】簡(jiǎn)單兩步,教你識(shí)別百度蜘蛛

近期,小編經(jīng)常收到開(kāi)發(fā)者關(guān)于“哪些蜘蛛是百度搜索的”、“如何才能正確識(shí)別百度蜘蛛”的提問(wèn)。

今日干貨帶你簡(jiǎn)單兩步即可識(shí)別百度蜘蛛

一、查看UA信息

如果UA信息不對(duì),可以直接判斷該蜘蛛為非百度搜索的蜘蛛。

目前UA分為移動(dòng)、PC、和小程序三個(gè)應(yīng)用場(chǎng)景,分別如下:

【移動(dòng)UA】

1、Mozilla/5.0(Linux;u;Android 4.2.2;zh-cn;) AppleWebKit/534.46 (KHTML,like Gecko)Version/5.1 Mobile Safari/10600.6.3 (compatible; Baiduspider/2.0;+http://www.baidu.com/search/spider.html)

2、Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;+http://www.baidu.com/search/spider.html)

【PC UA】

1、Mozilla/5.0(compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)

2、Mozilla/5.0(compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)

【小程序UA】

Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;Smartapp; +http://www.baidu.com/search/spider.html)

二、雙向DNS解析認(rèn)證

第一步:DNS反查IP

開(kāi)發(fā)者可以對(duì)日志中訪問(wèn)服務(wù)器的IP地址進(jìn)行反向DNS查找,判斷某只spider是否來(lái)自百度搜索引擎,Baiduspider的hostname以*.baidu.com或*.baidu.jp 的格式命名,非*.baidu.com或*.baidu.jp即為冒充。

在Linux/Windows/OS三種平臺(tái)下,驗(yàn)證方法分別如下:

1) 在Linux平臺(tái)下,可以使用host IP命令反解IP來(lái)判斷該抓取是否來(lái)自Baiduspider。

2) 在Windows平臺(tái)或者IBM OS/2平臺(tái)下,可以使用nslookup IP命令反解IP:打開(kāi)命令處理器,輸入nslookup xxx.xxx.xxx.xxx(IP地址)就能解析IP,判斷該抓取是否來(lái)自Baiduspider。

3) 在macOS平臺(tái)下,可以使用dig命令反解IP:打開(kāi)命令處理器輸入dig -x xxx.xxx.xxx.xxx(IP地址)就能解析IP,判斷該抓取是否來(lái)自Baiduspider。

第二步:對(duì)域名運(yùn)行正向DNS查找

對(duì)第一步中通過(guò)命令檢索到的域名運(yùn)行正向DNS查找,驗(yàn)證該域名與日志中訪問(wèn)服務(wù)器的原始IP地址是否一致,IP地址一致可確認(rèn)spider來(lái)自百度搜索引擎,IP地址不一致即為冒充。

【示例】

> host 111.206.198.69

69.198.206.111. in-addr.arpa domain name pointer baiduspider-111-206-198-69.crawl.baidu.com.

>hostbaiduspider-111-206-198-69.crawl.baidu.com

baiduspider-111-206-198-69.crawl.baidu.com has address 111.206.198.69

以上就是識(shí)別百度蜘蛛的方法,有需要的同學(xué)速速收藏哦!

來(lái)源:百度搜索資源平臺(tái) 百度搜索學(xué)堂


Public @ 2019-09-16 15:38:37

如何提高spider抓取網(wǎng)站?提高spider抓取策略(2)

上一篇文章中,給大家簡(jiǎn)單介紹了提高spider抓取網(wǎng)站策略的兩大方法,另外還有五個(gè)策略接著給分享給大家。如果沒(méi)有瀏覽上篇文章,可以通過(guò)以下鏈接查看:【如何提高spider抓取網(wǎng)站?提高spider抓取策略(1)】提高spider抓取策略有哪些?三、多種URL重定向的識(shí)別為了讓spider能夠?qū)Χ喾NURL重定向的識(shí)別,重定向分別有三類(lèi):HTTP 30x重定向、Meta refresh重定向和JS重定

Public @ 2013-03-16 16:22:34

各搜索引擎蜘蛛介紹

蜘蛛指的是通過(guò)互聯(lián)網(wǎng)上的鏈接自動(dòng)抓取網(wǎng)頁(yè)的程序,主要用于搜索引擎中的搜索內(nèi)容,以下是常見(jiàn)的搜索引擎蜘蛛介紹: 1. Google蜘蛛(Googlebot):Google的搜索引擎蜘蛛,通過(guò)自動(dòng)爬取互聯(lián)網(wǎng)上的網(wǎng)頁(yè)內(nèi)容,為Google搜索的相關(guān)結(jié)果提供支持。 2. 百度蜘蛛(Baiduspider):百度搜索的搜索引擎蜘蛛,通過(guò)抓取網(wǎng)頁(yè)內(nèi)容和鏈接,組成網(wǎng)頁(yè)庫(kù),支持百度搜索結(jié)果的呈現(xiàn)。 3. 必應(yīng)

Public @ 2023-03-30 10:00:26

什么是Baiduspider

什么是BaiduspiderBaiduspider是百度搜索引擎的一個(gè)自動(dòng)程序,它的作用是訪問(wèn)互聯(lián)網(wǎng)上的網(wǎng)頁(yè),建立索引數(shù)據(jù)庫(kù),使用戶(hù)能在百度搜索引擎中搜索到您網(wǎng)站上的網(wǎng)頁(yè)。來(lái)源:百度搜索資源平臺(tái) 百度搜索學(xué)堂

Public @ 2020-01-26 15:38:43

BaiDuSpider百度蜘蛛占用流量,robots.txt設(shè)置

在網(wǎng)站根目錄下的 robots.txt 文件可以用來(lái)告訴搜索引擎蜘蛛(包括百度蜘蛛)哪些頁(yè)面可以訪問(wèn),哪些頁(yè)面不可訪問(wèn)。通過(guò)設(shè)置 robots.txt 文件,可以控制蜘蛛的爬取范圍,減少不必要的流量消耗。 以下是一個(gè)提供給百度蜘蛛的 robots.txt 示例: ``` User-agent: Baiduspider Disallow: /path/to/disallowed/page.htm

Public @ 2023-07-28 12:00:44

更多您感興趣的搜索

0.475227s