這篇內容保留 Facebook 貼文的原始脈絡,部分工具、介面與外部連結可能已經改變。
在瀏覽器輸入網址並按下 Enter 之後,瀏覽器會向伺服器送出請求,伺服器再回傳描述資源狀態的回應。
Request Headers 會帶上 User-Agent、目標路徑與支援的壓縮方式等資訊。
Response Headers 則會描述回傳檔案與伺服器處理結果,其中最常被 SEO 工作者使用的就是 Status Code。
2XX 通常代表成功,3XX 代表需要前往其他位置,4XX 通常是請求或資源本身有問題,5XX 則通常表示伺服器端發生錯誤。
理解這個基本流程後,404、301、HTTPS、快取與爬蟲抓取就不再是互相分離的名詞,而是同一個網頁請求生命週期中的不同訊號。
原文提到的連結
延伸閱讀
SEO搜尋引擎原理 - 爬蟲抓取篇
檢索是搜尋引擎的第一步,爬蟲有個網址,前去拜訪,然後發現更多的網址,如此循環下去。看似簡單的過程卻有很多的SEO細節。
利用Screaming Frog找出網站中的404頁面
在對一個網站做SEO診斷時,網站上的4XX頁面是個不可或缺的一環。這篇文章要教大家如何使用Screaming Frog這個強大的SEO工具來找出網站上無效的連結。
HTTPS 不只是登入與結帳時才需要
2018 年的一則基礎觀念分享,從加密、資料完整性與伺服器驗證三個角度說明為什麼整個網站都應該使用 HTTPS。
網址結尾斜線與重複內容:真正要統一的是整個 URL 訊號
整理網址結尾斜線、HTTP/HTTPS、www 與非 www 版本的差異,並說明 canonical、轉址、內部連結與 sitemap 應該共同指向同一版本。
行動版內容優先索引:Dynamic Serving 別忘了 Vary
保存一則工作案例,說明 Dynamic Serving 依 User-Agent 回傳不同 HTML 時,為什麼 HTTP 的 Vary: User-Agent 可能成為重要的快取訊號。