国产成人精品999视频&日本一区二区亚洲人妻精品&久久久精品国产99久久精&99热这里只有成人精品国产&精品国产剧情av一区二区&成人亚洲精品久久久久app&国产精品美女高潮抽搐A片

Categories


Tags


利用百度蜘蛛referer找到報(bào)錯(cuò)頁面入口

大家應(yīng)該都知道百度已經(jīng)全站https并取消referer關(guān)鍵詞顯示了,那么“百度蜘蛛referer”又是什么?有什么妙用嗎?藝龍SEO負(fù)責(zé)人劉明發(fā)現(xiàn)通過百度蜘蛛referer可以快速定位部分站內(nèi)url的報(bào)錯(cuò)(4xx或者5xx)原因。隨后社區(qū)版主飛鷹正義也對(duì)文章做了補(bǔ)充修正,現(xiàn)推薦給各位同學(xué)們。

什么是百度蜘蛛的referer

百度蜘蛛的referer,是指當(dāng)百度蜘蛛抓取某一個(gè)URL的時(shí)候,在HTTP頭中帶的Referer字段。請(qǐng)注意,這個(gè)定義和百度最近聲明去除Referer中關(guān)鍵詞數(shù)據(jù)沒有任何關(guān)系。這次講的是spider發(fā)起的HTTP請(qǐng)求,百度而去除的是用戶發(fā)起的。如果百度蜘蛛抓取百度首頁的logo,會(huì)發(fā)起這樣的請(qǐng)求:

上面Referer字段很明確的表示了他是從www.baidu.com這個(gè)頁面上發(fā)現(xiàn)并抓取了www.baidu.com/img/bd_logo1.png。而大家在服務(wù)器訪問日志中也應(yīng)該能看到相應(yīng)的記錄。目前發(fā)現(xiàn)只有當(dāng)百度抓取一個(gè)網(wǎng)頁的同時(shí),又抓取了網(wǎng)頁中的:img、js和css才會(huì)帶上referer字段。這部分額外的抓取量,應(yīng)該不會(huì)占用百度分配的抓取配額,屬于“買1送1”。

對(duì)于站長(zhǎng)的意義

如果你發(fā)現(xiàn)有一批URL(僅限于img,js,css)報(bào)錯(cuò)(4xx或者5xx),但是一直找不到入口在哪,也就是說你不明白百度蜘蛛是從哪里發(fā)現(xiàn)這些錯(cuò)誤URL的。這個(gè)字段可以幫助你迅速定位。

舉個(gè)例子

比如我們的SEO日志分析系統(tǒng)中可以看到,符合下面這種URL Pattern的路徑每天有6萬到10萬的抓取而且全部報(bào)404。

從發(fā)現(xiàn)問題至今過了1個(gè)月,查遍整個(gè)網(wǎng)站我也沒找到入口。今天偶然仔細(xì)查了一下日志,想起了百度蜘蛛的referer,馬上就能定位問題了。這些404的URL來自于一套沒人維護(hù)也沒人關(guān)注的頁面(往往是這樣)。收錄流量都不錯(cuò)。由于最近公司圖片系統(tǒng)更新,圖片的URL全部更改了,但這套頁面并沒有跟著更新。

如果站點(diǎn)沒有記錄referer怎么辦

iis請(qǐng)?jiān)谶@里勾選“cs(Referer)”:

apache請(qǐng)參考:

apache log配置“Combined Log Format”章節(jié)

apache log配置的官方鏈接

Nginx請(qǐng)參考:

nginx log配置

nginx log配置的官方鏈接

結(jié)束語

· 很多SEO問題并不是立即致命的,所以沒有及時(shí)解決。流量就像螞蟻啃大象一樣一點(diǎn)一點(diǎn)啃掉了。

· 系統(tǒng)性的知識(shí)積累還是會(huì)在關(guān)鍵時(shí)刻發(fā)揮作用的。

· 感謝飛鷹對(duì)本文的修正。

至此文章雖然結(jié)束但是討論可以繼續(xù),大家可以到[學(xué)堂同學(xué)匯] 《利用百度蜘蛛referer找到報(bào)錯(cuò)頁面入口》討論帖,與作者劉明進(jìn)行探討。

來源:百度搜索資源平臺(tái) 百度搜索學(xué)堂


Public @ 2012-04-14 15:38:46

【官方說法】HTTPS改造,302也可以接受啦!

之前HTTPS改造中提過,要求做了HTTPS的網(wǎng)站,建議保留HTTP站點(diǎn)48小時(shí),且將HTTP站點(diǎn)301到HTTPS站中,而且是必須301才可以?,F(xiàn)在,HTTPS認(rèn)證工具升級(jí),HTTP站點(diǎn)301或者302到HTTPS站點(diǎn)都可以了,兩種跳轉(zhuǎn)方式都可以識(shí)別。再來回顧一下,如果網(wǎng)站做了HTTPS協(xié)議,站長(zhǎng)可使用HTTPS認(rèn)證工具,幫助百度搜索快速識(shí)別并收錄HTTPS站點(diǎn),使用HTTPS認(rèn)證工具,需要注意

Public @ 2013-10-16 15:35:52

手把手教您制作死鏈列表文件

死鏈(dead link)指的是網(wǎng)上某個(gè)鏈接已經(jīng)失效或者鏈接到了不存在的頁面。在網(wǎng)站開發(fā)和維護(hù)過程中,我們需要及時(shí)發(fā)現(xiàn)并修復(fù)死鏈,以提高用戶體驗(yàn)和SEO效果。制作死鏈列表文件是一種常見的方法,可以有效地幫助我們管理和修復(fù)死鏈問題。 以下是手把手教您制作死鏈列表文件的步驟: 1. 打開網(wǎng)站地圖或者網(wǎng)站目錄,找到所有頁面的URL地址。 2. 使用爬蟲工具或者在線工具掃描整個(gè)網(wǎng)站,找到所有的死鏈。

Public @ 2023-06-07 07:50:17

Baiduspider抓取造成的帶寬堵塞?

Baiduspider抓取造成的帶寬堵塞?Baiduspider的正常抓取并不會(huì)造成您網(wǎng)站的帶寬堵塞,造成此現(xiàn)象可能是由于有人冒充Baiduspider惡意抓取。如果您發(fā)現(xiàn)有名為Baiduspider的agent抓取并且造成帶寬堵塞,請(qǐng)盡快和我們聯(lián)系。您可以將信息反饋至反饋中心,如果能夠提供您網(wǎng)站該時(shí)段的訪問日志將更加有利于我們的分析。如果大家對(duì)百度spider還有別的疑問,大家可以到[學(xué)堂同學(xué)匯

Public @ 2019-04-06 15:38:40

【干貨】簡(jiǎn)單兩步,教你識(shí)別百度蜘蛛

”近期,小編經(jīng)常收到開發(fā)者關(guān)于“哪些蜘蛛是百度搜索的”、“如何才能正確識(shí)別百度蜘蛛”的提問。今日干貨帶你簡(jiǎn)單兩步即可識(shí)別百度蜘蛛一、查看UA信息如果UA信息不對(duì),可以直接判斷該蜘蛛為非百度搜索的蜘蛛。目前UA分為移動(dòng)、PC、和小程序三個(gè)應(yīng)用場(chǎng)景,分別如下:【移動(dòng)UA】1、Mozilla/5.0(Linux;u;Android 4.2.2;zh-cn;) AppleWebKit/534.46 (KH

Public @ 2019-09-16 15:38:37

更多您感興趣的搜索

0.587004s