国产成人精品999视频&日本一区二区亚洲人妻精品&久久久精品国产99久久精&99热这里只有成人精品国产&精品国产剧情av一区二区&成人亚洲精品久久久久app&国产精品美女高潮抽搐A片

Categories


Tags


輕松兩步,正確識別百度蜘蛛(User-Agent)

經(jīng)常聽到開發(fā)者問,百度蜘蛛是什么?最近百度蜘蛛來的太頻繁服務(wù)器抓爆了!最近百度蜘蛛都不來了怎么辦?還有很多站點(diǎn)想得到百度蜘蛛的IP段,想把IP加入白名單,但I(xiàn)P地址范圍動態(tài)變化不固定,我們無法對外公布。

那么如何才能識別正確的百度蜘蛛呢?今日干貨帶你輕松兩步正確識別百度蜘蛛:

一、查看UA信息

如果UA信息不對,可以直接判斷為非百度搜索的蜘蛛。目前UA分為移動、PC、和小程序三個應(yīng)用場景,這三個渠道UA分別如下:

移動UA:

Mozilla/5.0 (Linux;u;Android 4.2.2;zh-cn;) AppleWebKit/534.46 (KHTML,like Gecko)Version/5.1 Mobile Safari/10600.6.3 (compatible; Baiduspider/2.0;+http://www.baidu.com/search/spider.html)

Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;+http://www.baidu.com/search/spider.html)

PC UA:

Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)

Mozilla/5.0 (compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)

小程序UA:

Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;Smartapp; +http://www.baidu.com/search/spider.html)

二、雙向DNS解析認(rèn)證

第一步:DNS反查IP

開發(fā)者通過對日志中訪問服務(wù)器的IP地址運(yùn)行反向DNS查找,判斷某只spider是否來自百度搜索引擎,Baiduspider的hostname以*.baidu.com或*.baidu.jp 的格式命名,非*.baidu.com或*.baidu.jp即為冒充。

根據(jù)平臺不同驗證方法不同,如linux/windows/os三種平臺下的驗證方法分別如下:

1).在linux平臺下,您可以使用host ip命令反解ip來判斷是否來自Baiduspider的抓取。

2).在windows平臺或者IBM OS/2平臺下,您可以使用nslookup ip命令反解ip來 判斷是否來自Baiduspider的抓取。打開命令處理器 輸入nslookup xxx.xxx.xxx.xxx(IP地址)就能解析ip,來判斷是否來自Baiduspider的抓取。

3).在macos平臺下,您可以使用dig命令反解ip來判斷是否來自Baiduspider的抓取。打開命令處理器輸入dig -x xxx.xxx.xxx.xxx(IP地址)就能解析ip,來判斷是否來自Baiduspider的抓取。

第二步:對域名運(yùn)行正向DNS查找

對第一步中通過命令檢索到的域名運(yùn)行正向DNS查找,驗證該域名與您日志中訪問服務(wù)器的原始IP地址是否一致,IP地址一致可確認(rèn)spider來自百度搜索引擎,IP地址不一致即為冒充。

示例1:

> host 111.206.198.69

69.198.206.111. in-addr.arpa domain name pointer baiduspider-111-206-198-69.crawl.baidu.com.

> host baiduspider-111-206-198-69.crawl.baidu.com

baiduspider-111-206-198-69.crawl.baidu.com has address 111.206.198.69

來源:百度搜索資源平臺 百度搜索學(xué)堂


Public @ 2015-12-30 15:38:39

搜狗spider的抓取頻次是怎樣的?

sogou spider 對于同一個 IP 地址的服務(wù)器主機(jī),只建立一個連接,抓取間隔速度控制在幾秒一次。一個網(wǎng)頁被收錄后,最快也要過幾天以后才會去更新。如果持續(xù)不斷地抓取您的網(wǎng)站,請注意您的網(wǎng)站上的網(wǎng)頁是否每次訪問都產(chǎn)生新的鏈接。如果您認(rèn)為 sogou spider 對于您的網(wǎng)站抓取過快,請與我們聯(lián)系,并最好能提供訪問日志中sogou spider 訪問的部分,而不要直接將搜狗spider的ua

Public @ 2017-08-18 15:38:49

Baiduspider抓取造成的帶寬堵塞?

Baiduspider的正常抓取并不會造成您網(wǎng)站的帶寬堵塞,造成此現(xiàn)象可能是由于有人冒充Baiduspider惡意抓取。如果您發(fā)現(xiàn)有名為Baiduspider的agent抓取并且造成帶寬堵塞,請盡快和我們聯(lián)系。您可以將信息反饋至 投訴平臺 ,如果能夠提供您網(wǎng)站該時段的訪問日志將更加有利于我們的分析。

Public @ 2022-11-07 15:56:46

百度Spider新增渲染抓取UA公告

為了給搜索用戶更好的體驗、對站點(diǎn)實現(xiàn)更好地索引和呈現(xiàn),百度搜索需要訪問網(wǎng)站的CSS、Javascript和圖片信息,以便更精準(zhǔn)地理解頁面內(nèi)容,實現(xiàn)搜索結(jié)果最優(yōu)排名,百度搜索會全面啟用最新UA來訪問站點(diǎn)的上述資源。從3月24日(2017)開始,百度搜索抽取了部分優(yōu)質(zhì)站點(diǎn)進(jìn)行抓取內(nèi)測,可能會對站點(diǎn)服務(wù)器造成一定壓力影響,請盡量不要對UA進(jìn)行封禁,以免造成不可逆轉(zhuǎn)的損失。最新UA如下:PC:Mozill

Public @ 2020-05-17 15:56:38

更多您感興趣的搜索

0.417000s