當(dāng)前位置:首頁(yè) >  站長(zhǎng) >  搜索優(yōu)化 >  正文

百度lee給出 http返回碼的含義和建議

 2011-06-16 08:39  來(lái)源:   我來(lái)投稿 撤稿糾錯(cuò)

  域名預(yù)訂/競(jìng)價(jià),好“米”不錯(cuò)過(guò)

百度爬蟲(chóng)在進(jìn)行抓取和處理時(shí),是根據(jù)http協(xié)議規(guī)范來(lái)設(shè)置相應(yīng)的邏輯的,所以請(qǐng)站長(zhǎng)們也盡量參考http協(xié)議中關(guān)于返回碼的含義的定義來(lái)進(jìn)行設(shè)置。

百度spider對(duì)常用的http返回碼的處理邏輯是這樣的:

1、404

404返回碼的含義是“NOT FOUND”,百度會(huì)認(rèn)為網(wǎng)頁(yè)已經(jīng)失效,那么通常會(huì)從搜索結(jié)果中刪除,并且短期內(nèi)spider再次發(fā)現(xiàn)這條url也不會(huì)抓取。

2、503

503返回碼的含義是“Service Unavailable”,百度會(huì)認(rèn)為該網(wǎng)頁(yè)臨時(shí)不可訪問(wèn),通常網(wǎng)站臨時(shí)關(guān)閉,帶寬有限等會(huì)產(chǎn)生這種情況。對(duì)于網(wǎng)頁(yè)返回503,百度spider不會(huì)把這條url直接刪除,短期內(nèi)會(huì)再訪問(wèn)。屆時(shí)如果網(wǎng)頁(yè)已恢復(fù),則正常抓取;如果繼續(xù)返回503,短期內(nèi)還會(huì)反復(fù)訪問(wèn)幾次。但是如果網(wǎng)頁(yè)長(zhǎng)期返回503,那么這個(gè)url仍會(huì)被百度認(rèn)為是失效鏈接,從搜索結(jié)果中刪除。

3、403

403返回碼的含義是“Forbidden”,百度會(huì)認(rèn)為網(wǎng)頁(yè)當(dāng)前禁止訪問(wèn)。對(duì)于這種情況,如果是新發(fā)現(xiàn)的url,百度spider暫不會(huì)抓取,短期內(nèi)會(huì)再次檢查;如果是百度已收錄url,當(dāng)前也不會(huì)直接刪除,短期內(nèi)同樣會(huì)再訪問(wèn)。屆時(shí)如果網(wǎng)頁(yè)允許訪問(wèn),則正常抓取;如果仍不允許訪問(wèn),短期內(nèi)還會(huì)反復(fù)訪問(wèn)幾次。但是如果網(wǎng)頁(yè)長(zhǎng)期返回403,百度也會(huì)認(rèn)為是失效鏈接,從搜索結(jié)果中刪除。

4、301

301返回碼的含義是“Moved Permanently”,百度會(huì)認(rèn)為網(wǎng)頁(yè)當(dāng)前跳轉(zhuǎn)至新url。當(dāng)遇到站點(diǎn)遷移,域名更換、站點(diǎn)改版的情況時(shí),推薦使用301返回碼,盡量減少改版帶來(lái)的流量損失。雖然百度spider現(xiàn)在對(duì)301跳轉(zhuǎn)的響應(yīng)周期較長(zhǎng),但我們還是推薦大家這么做。

我們的建議

1、如果站點(diǎn)臨時(shí)關(guān)閉,當(dāng)網(wǎng)頁(yè)不能打開(kāi)時(shí),不要立即返回404,建議使用503狀態(tài)。503可以告知百度spider該頁(yè)面臨時(shí)不可訪問(wèn),請(qǐng)過(guò)段時(shí)間再重試。

2、如果百度spider對(duì)您的站點(diǎn)抓取壓力過(guò)大,請(qǐng)盡量不要使用404,同樣建議返回503。這樣百度spider會(huì)過(guò)段時(shí)間再來(lái)嘗試抓取這個(gè)鏈接,如果那個(gè)時(shí)間站點(diǎn)空閑,那它就會(huì)被成功抓取了。

3、有一些網(wǎng)站希望百度只收錄部分內(nèi)容,例如審核后的內(nèi)容,累積一段時(shí)間的新用戶頁(yè)等等。在這種情況,建議新發(fā)內(nèi)容暫時(shí)返回403,等審核或做好處理之后,再返回正常狀態(tài)的返回碼。

4、站點(diǎn)遷移,或域名更換時(shí),請(qǐng)使用301返回碼。

文章整理者:北京seo,文章地址:轉(zhuǎn)載請(qǐng)保留。

申請(qǐng)創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!

相關(guān)文章

  • 百度站長(zhǎng)平臺(tái):百度LEE漫談移動(dòng)化

    在3月19日的百度站長(zhǎng)平臺(tái)蝶變行動(dòng)專場(chǎng)沙龍現(xiàn)場(chǎng),百度LEE團(tuán)隊(duì)主要成員、移動(dòng)搜索產(chǎn)品負(fù)責(zé)人熊詠志老師針對(duì)現(xiàn)階段大熱的PC移動(dòng)化問(wèn)題闡述了自己的看法,值得同學(xué)們好好學(xué)習(xí)一下,匯總起來(lái)要點(diǎn)如下:?理清目標(biāo)用戶需求,切忌盲目移動(dòng)化?移動(dòng)適配要全面,以免流量流失?盡快在百度站長(zhǎng)平臺(tái)驗(yàn)證站點(diǎn),享受專項(xiàng)服務(wù)20

  • 百度lee:搜索引擎索引系統(tǒng)概述(二)

    10月21日,百度lee簡(jiǎn)要介紹了搜索引擎索引系統(tǒng)概述(一),主要講的就是搜索引擎的倒排索引,還是先來(lái)百科一下:Query,是查詢的意思,為了在數(shù)據(jù)庫(kù)中尋找某一特定文件、網(wǎng)站、記錄或一系列記錄,由搜索引擎或數(shù)據(jù)庫(kù)送出的消息;term是單詞文本,即關(guān)鍵詞。今天,百度Lee公布了搜索引擎索引系統(tǒng)概述第二

  • 百度站長(zhǎng)平臺(tái)沙龍:百度Lee解密新一代搜索引擎

    “百度之夜”百度站長(zhǎng)平臺(tái)高端沙龍?上海站紀(jì)實(shí)A5站長(zhǎng)網(wǎng)(findingchristbooks.com)消息,10月16日晚,“百度之夜”——百度站長(zhǎng)平臺(tái)高端沙龍?上海站在Caffebene咖啡召開(kāi)。來(lái)自攜程、大眾點(diǎn)評(píng)、1號(hào)店、途牛等60余家上海知名網(wǎng)站的互聯(lián)網(wǎng)精英濟(jì)濟(jì)一堂。百度的搜索專家Lee對(duì)百度最近推出的知心搜

    標(biāo)簽:
    百度lee
  • 百度lee:搜索引擎索引系統(tǒng)概述(一)

    從上次8月份百度站長(zhǎng)平臺(tái)lee發(fā)布關(guān)于搜索引擎抓取信息后2個(gè)月已經(jīng)過(guò)去,這次lee繼續(xù)發(fā)布了搜索引擎索引系統(tǒng)的信息。不管怎么樣,木木SEO認(rèn)為百度官方的公告我們還是要了解和分析的。下面是百度官方公告:

  • 百度lee:建立符合搜索抓取習(xí)慣的網(wǎng)站

    之前百度站長(zhǎng)lee給大家介紹了搜索抓取系統(tǒng)工作原理,根據(jù)該工作原理今天簡(jiǎn)要介紹一下如何建立網(wǎng)站是符合搜索引擎抓取系統(tǒng)習(xí)慣的。

    標(biāo)簽:
    搜索抓取
    百度lee

熱門排行

信息推薦