搜索引擎蜘蛛訪問和抓取的區別
我們在做網站SEO優化時有必要搞清楚搜索引擎的蜘蛛對網站的行為是存在訪問和抓取的,而且兩者是單獨存在,也就是說訪問不代表抓取,抓取不代表完全訪問過了。
什麼是蜘蛛訪問和抓取(爬取)。
蜘蛛訪問就是類似用戶一樣正常來訪閱讀,蜘蛛是有特徵UA標識,我們在網站日誌看到的就是蜘蛛訪問,並不是抓取,通常情況下我們通過分析蜘蛛訪問去瞭解哪些頁面被搜索引擎發現了,但是不意味着就會百分百被收錄,因為還要涉及抓取的問題。
理論上我們需要增加蜘蛛訪問數量頻率,這樣可以促進網站內容頁面更多的被發現,這是利於抓取收錄的,但是我們經常只知道引蜘蛛來訪,忽視了蜘蛛抓取因素。
蜘蛛抓取就是類似讀取分析,通過訪問頁面URL、提交頁面URL、引導頁面URL抓取裏面的信息屬性,這點我們可以從主動向搜索引擎提交頁面URL能察覺到細節,比如沒有蜘蛛訪問記錄,但是這個頁面被收錄了。
決定蜘蛛是否抓取的因素比較多,並且抓取是有配額的,所以我們要解決不能浪費蜘蛛抓取資源,而且較長時間的蜘蛛來訪不抓取的情況是很有可能被搜索引擎判斷為垃圾網站。
所以可以理解為蜘蛛訪問是正常來訪理解這個頁面內容是否正常和健康有用,頁面標註是否明確規範,而蜘蛛抓取就是進行對頁面參數屬性的分析判斷,決定是否收錄。
看到這是不是感覺出為什麼交換了大量外鏈提高了蜘蛛數量來訪,就是不收錄的原因了吧,這就是因為不知道蜘蛛訪問和抓取的區別, 誤認為有蜘蛛訪問就大功告成。
結語:所以我們在做網站的SEO優化時要先搞清楚搜索引擎的特徵外,還要弄明白蜘蛛的特性,不是隻要清楚規則算法就行的,SEO可是個細節活,需要掌握瞭解的知識可不少。