數位引擎文章

SEO電子報第四十九期 – 2022.01.16~2022.01.31

發文的當下還是美國的除夕,祝大家新年快樂! 這期電子報是在年假中寄出,但第六點的 Chrome DevTools 和第八點 Archive.org 都特別推薦自己動手操作一次,過年期間如果想認真發懶,就等到開工再回頭好好讀吧~

發文的當下還是美國的除夕,祝大家新年快樂! 這期電子報是在年假中寄出,但第六點的 Chrome DevTools 和第八點 Archive.org 都特別推薦自己動手操作一次,過年期間如果想認真發懶,就等到開工再回頭好好讀吧~

我會在初五左右寄另一封信,講一下數位引擎轉移平台的事,以及續訂的方法,但接下來的兩期算是新平台試營運,因此只要你收到了這份電子報,你就會自動收到下兩份,因此不用擔心會員突然到期被退訂,新的一年再請大家多多支持啦!


[新聞] SEMRush 收購 Backlinko (Brian Dean 公司)

這條新聞可能要在SEO圈待比較久才會感受到其震撼,SEMRush是知名的 SEO 分析工具,而 Backlinko.com 或創辦人 Brian Dean 則是提供 SEO 的知識型內容,若你曾用英文搜尋過 SEO 相關的問題,很難不看到 backlinko 的文章。在公告中表示收購後 Brian Dean 與其團隊會繼續留下來幫助 SEMRush Academy和社群的成長。

這條新聞之所以引起話題,我認為其中一個原因是 Brian Dean 在 SEO 圈中並不是特別受推崇的一個人,與 Neil Patel 的狀況類似,很多人認為他們都只是很會行銷自己的人;再來也有人認為 SEMRush 在內容 SEO 這塊打不贏就收購,完全體現了上市公司的資本主義至上;還有一個是 Backlinko 以前可以當個公正的第三方評論 SEMRush vs Ahrefs,但之後可能沒辦法不說東家才是最好的。

Backlinko 在一篇文章中曾說二選一的話他會給Ahrefs (圖片來源)

連結: SEMRush公關稿


[新聞] 新的 robots 標籤: indexifembedded

Google從2022年一月開始支援一個新的標籤: indexifembedded,此參數可以用在 meta robots tag 或是 X-Robots-Tag 中。新的標籤讓一個檔案在有noindex時能獲得額外的控制,換句話說,當一個檔案(不管文字、圖片、或PDF...)有以下的指令,該檔案本身不會被索引,但若被「崁入」在其他網頁上 (例如iframe),上面的內容就會被索引。

// HTML
<meta name="googlebot" content="noindex,indexifembedded" />

// HTTP Header
X-Robots-Tag: googlebot:noindex,indexifembedded

幾年前有個案例是網站將圖片都換成用 Instagram 崁入的方式,結果導致失去大量的圖片搜尋流量,原因就是 IG 對於被崁入的資源都放上的 noimageindex 的標籤。因此之後若要崁入資源,不妨檢查一下是否有noindex標籤在其中。

連結: 官方文檔 / Screaming Frog測試細節 / SEL報導


[討論] 網頁可能不會同時出現在 Top Story 和一般結果

在Twitter上一位知名的雜誌(The Verge) 編輯問為何搜尋文章標題,卻沒看到他的網站,反而結果都來自轉發其內容的網站。這雖是常見的問題,但卻引起了不小的討論,一方面因為該編輯的名氣,而另一方面則因為釣出了 Danny Sullivan 出來做官方回應

如何防止內容剽竊者或合作授權網站被判定為內容原創是另一個話題。有趣的點在於Danny認為這個截圖並不完整,而他的回答中包含了一個我原本不知道的資訊,那就是「當一個網頁是 Top Stories 的第一個結果」且「Top Stories 出現在一般結果前面」這兩個條件滿足時,該網頁將不會在一般結果中重複出現。(英文原話)

網頁可能不會同時出現在 Top Story 模塊和一般結果

連結: Twitter討論串與 Danny 回應


[討論] 網站付費牆內容的SEO做法

現在有很多新聞或內容型網站會將文章放在付費牆(paywall)或註冊牆(subscription)後,但要怎麼讓搜尋引擎能夠抓取並收錄完整的內容,讓一般使用者必須要付費(或註冊)才能看到文章,同時又避免被判定為「偽裝手法 (cloaking)」,很多SEO人員並不清楚其中的細節。

最近這個Twitter討論串討論了目前一般業界的做法,也是Google所建議的方法,相當推薦大家一讀。簡單來說,在伺服器端判斷請求來自搜尋引擎或者真人,回傳不同的檔案,並且在結構化資料的部分使用isAccessibleForFree屬性來告知哪個部分為付費牆內容;另外可以加上noarchive meta robots tag避免內容被存在快取中。

最後有個小技巧是,一般使用者可以透過結構化資料測試工具來跑有付費牆的網頁,由於該工具的請求是來自搜尋引擎,因此在其結果的原始碼中,有很大機率可以看到被蓋掉的內容!

範例 - 此頁的內容可以在rich result testing tool中的原始碼完整看到

[趣聞] Shopify 網頁標題被加上 (1)

前陣子發生了一個有趣的案例,很大數量Shopify的網頁標題都在前面被加上了一個(1),後來經過一番抽絲剝繭,發現是網頁上的聊天機器人,在網頁載入時會跳出一個訊息問好,而(1)就是代表有一則新訊息。

網頁上的腳本改寫標題很稀鬆平常,如果有拜訪過釣魚網站應該有看過瀏覽器上方的網頁標題閃來閃去要吸引注意。但這次是因為聊天機器人在網頁載入時即觸發標題改寫腳本 (而非經過某些互動),且沒有判斷對方是搜尋引擎或者用戶而導致的小悲劇。

受影響的Shopify網頁 (圖片來源)

連結: SER報導 / John回應 / 論壇公告


[好文] 如何使用 Chrome DevTools 找出網站分析問題

這篇指南是由 Simo Ahava 所寫,相信有接觸 Google Analytics 多少都曾聽過他的名字或看過他的文章,本篇內容在講如何透過瀏覽器內建的開發者工具來判斷某個代碼是否成功觸發,以及使用內建的功能來對網站做剖悉。

Chrome DevTools 不管在 SEO 或網站分析,都能名列我最推薦學習的工具前三名, 因為它的資料來源直接是瀏覽器本身,比任何的外掛或插件都還要更值得參考,推薦對這項工具不熟的讀者可以找個時間好好閱讀並跟著操作看看。

在 Chrome DevTools 中的 Network Tab 可以看出瀏覽器到底發送了甚麼資料給 GA

一些可以用 Chrome DevTools 所做到的事情包括:

  • 刻意限制網頁載入的速度 (可以看出網站在慢網速時的載入體驗,以及標籤觸發的順序)
  • 知道每個網頁上元件背後的代碼,將其更改或刪除,
  • 確切看到每個發送到 GA 伺服器的事件,和裡面的細節
  • 在資源中加入 breakpoint,讓瀏覽器執行該檔案時停在指定位置 (能用來判斷有問題的代碼發生在哪裡)
  • 利用 Local Override 來判斷某項資源被改寫的形況下網頁的載入情形

連結: Simo Ahava文章 / 使用 Local Overrides 測試網站速度變化


[工具] 大量檢查網頁是否有被收錄 (每月免費125個網址)

這項工具讓你能夠一次上傳大量網址,並及時檢查每個網址是否被收錄在Google中。檢查方法是將網址當作關鍵字在Google上搜尋,並看結果的前20名是否出現該網頁。必須要申請 Value SERP 這項工具的API Key,另外免費版有每個月125次的額度。

自己親身測試覺得還滿方便的,註冊帳號不需要綁信用卡,跑了30個網址大概一分鐘內就可以看到結果,整個流程不到10分鐘內就可以做完,推薦大家可以試著跑一遍看看。

連結: 收錄檢查工具


[工具] 下載網站在 Archive.org 的所有庫存頁面

這項工具與前一則是同一個開發者所做的,不需要任何API,只要輸入一個網域、開始和結束日期,該工具就會到 Archive.org 下載已知的該網域的頁面存檔,非常實用!

Archive.org 的 Wayback Machine 這個工具能讓你看到一個網頁過去的樣子,在做SEO檢測時,能用來看自家網站或對手網站的演進及過去的樣子。

下載下來的檔案格式,最右欄為庫存頁面網址

那些網頁要納入庫存主要由該站的機器人決定,但每個人也能夠主動提交,之前曾介紹另一個Python腳本能夠一次大量提交頁面。一個定期儲存大量網頁的畫面、一個快速拉出網站過去所有網頁存檔,兩者非常搭配!

連結: 數位引擎介紹 wayback machine


[影片] 網址結構改變是否影響SEO

在 YouTube 查看原始影片

這次影片的主題比較基礎,但卻有很多重要的觀念。Google的索引庫是以網址為單位的一個超大型資料庫,因此每當網址改動 (大至換網域、小至移除網址尾端的斜線),原本的數據就必須被轉移到新的網址上。

幾個建議包括: (1.) 做好功課;(2.) 建立一個新舊網頁的對照表 (URL Mapping);(3.) 執行 - 使用301轉址,更新網站上的連結、站點地圖、結構化資料...等等;(4.) 監控轉移過程,通常重要的網頁會較快被處理,但可能會需要超過數個月的時間來完全反映。

連結: 相關文件


[摘要] Google Search Podcast – Google搜尋小組2022展望

在 Spotify 查看原始內容

上一集討論了2021回顧,這集三人組討論Google搜尋2022的一些展望,個人聽完覺得沒有太多值得筆記的地方 (甚至有點陳悶),所以不用刻意點開來聽。

Gary 提到 sustainability (可持續性)是近期頗熱門的一個話題,Googlebot 在 refresh crawl (重新抓取已知的網頁來得知上面的內容沒有更改)的地方的確有很大的進步空間。雖然 sitemap 中有 last_modified 這個參數,但網頁上的內容究竟要有多大改變才算改變並沒有清楚的定義,另外雖然 Bing 和 Yandex 聯手推出了 IndexNow 協定,但這仍然沒有辦法防止不必要的抓取。三個人都一致認同很多 SEO 人員誤以為抓取的頻率與排名有關連,但其實兩者是完全不同的機制在掌握,Google 在乎 sustainability,但更在乎有一個真正有效的解決方案。

另外是 Google 搜尋自去年底開始有很多故障 (outage) 的新聞,不管是抓取或是索引上,但其實並非其系統越來越不可靠,而是他們內部決定將這樣的資訊盡可能地公開,所以儘管只是影響範圍不大的bug,Google 現在會選擇主動讓大家知道。

連結: 逐字稿


算算已經是第七年在美國過年了呀...