數位引擎文章

SEO電子報第五十九期 – 2022.06.16~2022.06.30

在整理這期電子報時,有相當多看到為之一亮的內容,尤其推薦information gain, screaming frog on cloud, 和SEO技能樹,希望大家在讀的時候跟我有一樣的感覺! 如果沒有特別受到啟發,一定是我摘要的不夠好,推薦找個時間閱讀原文~

在整理這期電子報時,有相當多看到為之一亮的內容,尤其推薦information gain, screaming frog on cloud, 和SEO技能樹,希望大家在讀的時候跟我有一樣的感覺! 如果沒有特別受到啟發,一定是我摘要的不夠好,推薦找個時間閱讀原文~


[官方] Google文件更新 - GBot僅爬前15MB

Google最近更新了幾份文件,其中一個是Googlebot只會抓並收錄一個HTML檔案的前15MB,超過的部分將被忽略。這個新增的部分引起了很多的回應,但可能是被標題殺人了,實務上其實幾乎不容易看到一個超過15MB的HTML檔案。

根據HTTPArchive的資料,8百萬個網站中僅有151個網站的首頁在為壓縮的情況下大於15MB,且網頁大小的中位數大概只有...30KB。另外,如果光HTML就大於15MB,那問題可能不只是SEO,而是整個網站的設計框架都需要好好被檢視。

光 HTML 本身就有 118MB 大的網頁 (source)

這個更新之所以會引起不小的回響 (Gary還發一篇文章回應),主要是很多人誤以為15MB包含了所有網頁的subresources (css, js, images...etc),但其實15MB只是HTML文本本身的檔案大小。

連結: Gbot 15MB報導 (by SEL) / 大於15MB的網頁範例


[情報] 2022 SMX Advanced研討會免費錄影

今年的SMX Advanced在六月舉行,現在所有的錄影都可以在網站上免費觀看,只要註冊個帳號就好。下面列幾個我有興趣的演講以及理由,還有很多paid search或數位行銷相關的影片,加起來應該有50個上下,就留給有興趣的人自己看看探索。

  • What you can learn from the largest link rot study ever performed
    演講者是 Patrix Stox,平時有在追蹤的一位SEO前輩。
  • 91 page one rankings in 6 weeks: How pillar-based marketing is changing SEO
    想聽看看這個這個方法,以及所謂的pilla-based marketing是什麼。
  • The May 24th Google Marketing Livestream: Reactions from the experts
    與廣告較為相關,今年的Google Marketing Live我只看了文字報導,沒有太印象深刻的東西因始想聽專家怎麼說。
  • Test web performance tweaks to boost Core Web Vitals rankings
    與網站效能有關的主題我都很有興趣,希望有我也能吸收的新招。
  • The declaration of SEO: 6 fundamental truths to live by
    演講者是Bruce Clay,資歷非常老的SEO人,個人對這個主題還好,但印象中沒看過他的演講卻久仰大名。
  • Going beyond 15%: The importance of accessibility in 2022
    想加強一下Web Assessibility這個主題。
  • Google, cybersecurity, and you: Being security savvy as an SEO
    同上,想加強一下網路安全性方面的知識。

連結: SMX Advanced活動網頁


[知識] 演算法如何排名網頁 by Neeva (搜尋引擎)

Neeva 是一個主打無廣告重隱私,營利模式是靠提供進階功能的會員制搜尋引擎,創辦人是前Google Ads的高管之一。近期他們在推特上分享了一些關於搜尋引擎排名的知識,個人覺得滿有趣的,科普了一些演算法的小知識。

Neeva 搜尋結果的外觀

首先,要將文件(documents)對於一個搜尋字(query)進行相關性排序,最為人所知的是用TF-IDF。簡單來說,一個字在一份文件中出現越多次就越重要,但當這個字在每個文件中都出現(ex: "我、你、他、的...")那就越不重要。

但這有個問題,一份相當長的文件,可能是因為其包含了很多不同的主題,因此在每個字的TF-IDF分數都不高,但並不代表在某個主題上其內容不好,因此通常會做一個document length normalization的動作,讓大篇幅文件也能被公平對待。

但這還是不能解決一些問題,例如搜尋neeva時,應該要給neeva.com還是neevaneevaneeva.com? 因為即使經過處理,兩者的相關性是一樣的。這時就需要文本以外的資訊來幫助判斷,一個排名演算法的重要原則是,你怎麼看你自己比別人怎麼看你還要來的不重要

文本以外的資訊包括大家都知道的反向連結,但還有一個很重要的東西是query-click data,每次在Neeva上的點擊,我們都將搜尋字與該網頁的網址記錄下來,並以此資料作為排名的參考之一。

當被問到 click data 是否容易被濫用時的回答

連結: Neeva介紹 / Neeva官網 / 推特討論串


[報告] 2022 Link Building 大調查

去年這時候的電子報也報告過這項年度調查,今年的報告收集了270位SEO的看法,我個人已經一陣子沒接觸link building,看這份報導覺得滿有趣的,不會太長看起來也很好消化。下面列幾個我覺得有意思的調查結果。

Aira公司每年做的state of link building調查
  • 最常被用來做link building的前五個工具是 Ahrefs, Google Sheets, SEMRush, HARO, Screaming Frog
  • 最常被用來衡量link building的指標前三名是 Ranking, Search Visibility, Volume od linking domains
  • 大略估計的話,平均花多久可以獲得一個連結? 32%的人回答1~2小時;24%的人回答3~5小時。
  • 69%的受測者回答會在報告時包括nofollow連結
  • 69%的受測者認為買連結隊排名有正面影響
  • 86%受測者回答他們生產內容的主要目的就是要獲得連結
  • 被認為獲得連結最有效的兩種內容形式是 長篇報導式的內容 & 互動式的內容

連結: the state of link building report 2022


[實用] 將Screaming Frog架在雲端上遠端遙控

還滿驚訝看到Screaming Frog自己出了怎麼在Google Cloud上跑青蛙的教學,因為在雲端上執行的話,那就能夠讓多人一起使用,僅需同一組啟動碼;另外一個好處是跑大型網站的時候,可以不占用太多電腦的資源。

架在Google Cloud並不是免費的,取決於你的使用程度,以及使用的virtual machine的效能,但花兩天跑310萬個網址大約只需要20歐元,而且新註冊用戶會有300美金的額度。

我公司有位同事親手下去測試,雖然聽起來很複雜(設立Google Cloud、架虛擬主機、遠端遙控虛擬主機...等等),但他說大概1~2時內就成功了,我自己也幫他測試了遙控該虛擬主機的部分,大概15分鐘內搞定。

幫同事測試遙控虛擬主機跑 Screaming Frog 的畫面

雖然這樣做能夠省不少錢(多人共用帳號),但也不是沒缺點,遙控雲端通常操作上都會卡卡的,另外跑出來的結果要從VM轉回Local也會多一些步驟,但還是推薦大家有需要可以玩玩看!

連結: Screaming Frog原文


[好文] SEO職業的技能樹

由Tom Critchlow所整理的SEO技能樹,非常非常推薦一讀,裡面分為在agency端或inhouse端的能力,各切分成五個等級、分為軟實力和硬實力、搭配上職位以及平均薪資(美國)、並解提供例子來幫助判斷你屬於哪個區間。

inhouse人員的SEO技能分級
越往上走,對於公司方向的掌握度以及領導能力比硬實力更顯重要

很多人在SEO待一段時間會有點茫然接下來的出路,我自己也陷入這胡同不只一次,有時候可能是個好事,代表你已經準備好下一個階段邁進,推薦大家看看裡面給的建議,另外下面還有兩篇以前介紹過Tom寫的文章。

連結: 對高層的SEO報告 / inhouse倡導並擴張SEO


[技術] Chrome v103 正式支援 Early Hints (status code 103)

第41期時Early Hints (status code 103)這個由Cloudflare主導開發的新協定,經過幾個月的實裝測試,最近Cludflare發了一篇文章說明這項技術可以提高網站效能最高到30%左右。

Early Hints 前後比較 (source)

當瀏覽器發出一個請求(request)給伺服器時,伺服器通常需要些時間(server think time)準備,再將回應(response)回傳給瀏覽器。而使用Early Hints技術,相當於伺服器在收到請求時,就說「你索取的網頁我要準備一下,但這個 CSS跟這個 JS等等會用到,你先去要這兩個檔案!」。

Google最近宣布將在Chrome v103開始支援這項技術,Shopify也配合測試這項技術並看到不錯的成績,感興趣的人可以丟給工程師們討論討論。如果有使用Cloudflare的CDN,就算免費版也可以一鍵開啟這功能。


[好文] Information Gain - 內容SEO的未來走向

我通常對內容SEO的文章比較沒興致,但這篇文章在twitter上看到不少尊敬的SEO前輩都有分享,果然點開看了前兩段就直接把我吸引住。

你知道那個感覺 - 當每個主題、每個關鍵字、每個所想的到的流量增加內容都被超級為人所知的品牌們寡頭壟斷,他們的內容又長又完整。他們的內容也無懈可擊的為SEO做了優化。而且如果你捫心自問,你會發現他們的內容就跟你想要寫的概念沒什麼兩樣...

文章中接著帶到一個Google在2020年獲得的專利,旨在解決多數文檔都提供相似資訊的問題,稱作「Information Gain」,換言之就是獎勵在某個主題上有新資訊的文檔。

Google 2020年申請的專利

作者也提供了3個他認為值得一試,來提高文章information gain的方法,這邊就賣個關子,半強迫推薦大家自行去閱讀這篇文章,真的不錯!

連結: Information Gain


[影片] Google怎麼推出演算法更新

影片中的問題是,「Google是怎麼推出演算法更新的,是都從英語系國家開始再逐漸釋放到其他國家嗎?

John的回答是通常Google會希望一個演算法可以適用於所有的國家與語言,而不是針對不同的市場做出變化,因為這樣較容易管理與測試。也就是說,當更新推出時,必要時會選擇最相關的語言測試,可能是英文但不是絕對,之後再慢慢擴充到其他語言市場。

在 YouTube 查看原始影片

[摘要] Podcast – 使用者體驗(UX)與SEO

在 YouTube 查看原始影片

這集Martin, Gary, 和Lizzi三個人討論User Experience,Lizzi是負責Google搜尋的主要編輯+寫手,她說在錄這集節目前她回顧了一下,官方的文檔中幾乎沒什麼提到UX,只有Page Experience (PX),她認為這可能是公司行銷的角度而創造了這個詞,並同意PX並不包含所有UX的範疇。

但在Google的搜尋最佳做法這些文件中,有提到「為了讀者而寫」之類的原則,Gary跳出來說當要解釋的概念很難定義,Google文檔中會傾向使用模糊的字眼,舉裡來說「為了讀者而寫」可能是指寫作時要「為了讀者的閱讀程度而寫」,但Google文件不會寫後者,因為閱讀程度很難嚴格定義。不過在UX的範疇中,一篇文章在閱讀上是否容易也是個需要考量的點。

其他例子還有「write high-quality descriptive headings」或「網站架構」,他們沒辦法給個標準。

中間有段討論到被藏在tab或折疊模組的內容,Martin問到Google之前說過如果內容沒能直接被使用者看到,是否相對於直接可見的內容來的更不重要? Gary回答的確以前Google以前有這個機制,但現在不再有了。Gary的話讓Martin有些驚訝,連SER都特別寫了一篇報導再次強調這個概念。

連結: 逐字稿


幫KKday的朋友徵個Technical SEO的缺,我有和他們幾位R&D與SEO聊過,感覺不管是當前的挑戰、同事、還有SEO在公司的資源與被重視程度,都是很不錯的機會,真心推薦!