數位引擎文章

SEO電子報第三十六期 – 2021.07.01~2021.07.15

2021不知不覺過了一半,希望大家都還適應遠距工作還有在家時間變長的生活步調。這期內容我最喜歡的是podcast中Gary

2021不知不覺過了一半,希望大家都還適應遠距工作還有在家時間變長的生活步調。這期內容我最喜歡的是podcast中Gary Illyes談論排名的部分,每次聽他講背後的運作原理都會覺得搜尋引擎真是個神奇的領域,充滿著各種奇奇怪怪的挑戰。另外還有近期的算法更新整理、相當現實的SEO從業人員薪水調查、關於WordPress的趣聞...等等。


小總結 - 近期算法更新

自從四月份以來陸陸續續有很多"官方有公告"的算法更新,那些已經完全推出、那些還在進行中,這邊做個小整理幫助大家釐清。

演算法更新開始日期結束日期相關資料
商品評論算法更新2021-04-08 2021-04-22 官方資料
六月核心算法更新 2021-06-02 2021-06-12 官方資料
網頁體驗更新 2021-06-152021 八月底 (暫定)官方資料
打擊垃圾內容 part 12021-06-23 2021-06-23 官方資料
打擊垃圾內容 part 2 2021-06-28 2021-06-28 官方資料
七月核心算法更新2021-07-01 2021-07-12 官方資料

如表所示,很多演算法更新的推出都不是一次到位,而是分好幾天甚至好幾周來釋出,因此若最近網站流量有所變化,很有可能不是單一原因造成的。電子報和臉書上有分享這些更新的資訊,如果特別對哪一項還不太了解,歡迎留言!


[趣聞] Google搞混WordPress.com & WordPress.org

twitter上看到的有趣案例,Google誤將WordPress.com和WordPress混淆,重寫其meta description,使.org的「下載」頁面出現了.com有多好多棒的文字,這可能大大的誤導原本對兩者差異不清楚的使用者!

簡單科普一下,WordPress是個開源技術,.org是背後維護的非營利組織,而.com則是使用這項技術的營利組織。這個差異大概是第一次接觸到的人都會有的疑惑。

很多人都知道Google會改寫網頁的meta description,使其更符合使用者的搜尋意圖(或搜尋字)。一般的建議是當被改寫時,應該回去審視原本的描述為何被判定為較不相關而被改寫,重新寫一個更好的版本;但在這種明顯是Google出包的情況下,SEO們可以使用data-nosnippet這個標籤讓Google不用把特定的句子用在snippet中。


網站伺服器搬家檢查清單

JR Oakes 寫了這篇網站伺服器搬家時的檢查清單,伺服器搬家本身不常遇到,但其中的流程在我換到inhouse後滿還常遇到的,讀完以後會對網站有更新時的背後過程有更全面的認識。

這個過程大致分為四個階段 1.)準備期、2.)測試環境 (staging environment)、3.)搬家、 4.)搬家後,文章中有列出每個階段要注意的東西。SEO人員雖然不太會是執行這些步驟的工程師,但通常會是QA的一個環節,推薦大家不管平常工作是否接觸到都可以稍微了解一下自己在這個過程的腳色。

連結: 伺服器搬家檢查清單


2021 SEO 從業人員薪水大調查

這是 Search Engine Journal 所做的調查,回覆的群體地區分布是61%美國、3.8%英國、2.4%加拿大。目前只是個預覽,完整的報告預計九月分第一週推出。雖然回覆人群以美國為主,國情不同,但其中有幾個有趣的點是:

  • SEO的自由業者的薪水比其他群體(正職)還要來的少,但這可能因為研究者中有12%的人來自印度,在現在SEO外包盛行的情況中拉低了整體平均。
  • 公司創辦人的薪水比較有機會超過$200,000/年,高於Director & C-Level等級的SEO 104%
SEJ 2021 薪水調查 - 年薪區間

連結: SEJ文章


Google搜尋VP談論MUM的長期發展

MUM(Multitask Unified Model)是Google在機器學習的一個新的里程碑,於今年Google I/O亮相,官方評估其能力比BERT還要強1000倍,在數位引擎第32期的電子報曾經介紹過。

Pandu Nayak, Google搜尋部門的VP接受訪問討論MUM的短期與長期發展。首先他說MUM不會只是一次性的產品更新,Google裡面有很多部門正在研究如何將MUM實裝到產品上,目前最為人所知的應用是透過MUM了解新冠疫苗在全球50種不同語言的800多種不同的稱呼。

中期來看,他們希望能實際應用MUM的multi-modal特性 (跨文字、圖片、影片...),舉例來說,使用者可以拍一張鞋子的照片,然後上傳並問Google「我可以穿他去爬富士山嗎?」。

而長期目標其實是回到更加了解使用者的搜尋意圖這一點,現在很多比較長的句子(搜尋詞)其實Google是沒辦法看"懂"的;另一個則是跨語言的應用,Pandu在另一篇文章中有一個很好的舉例 -- 想像你會中文和英文,看了一本英文書,再用中文告訴朋友書在說些什麼,你能做到這樣是因為你理解了書中的"資訊",而這個"資訊"是不受語言限制的。

連結: SEJ採訪Pandu / Google I/O MUM影片 / 數位引擎臉書介紹


Backlinko 分析36億篇文章來理解哪種文章最長期有效

第30期的電子報曾經介紹Buzzsumo的一份研究報告,指出怎樣的文章標題夠吸引人。而這次Backlinko (創辦人為Brian Dean)推出另一個研究,要分析哪種文章最能在長期取得成功。

在英文內容行銷領域中,大致可以分為文章有效期較長的everygreen content,或是針對短期熱門主題的topical content。兩者沒有絕對誰好誰壞,而這份分析是要指出成功的everygreen content有哪些共同特性。

Listicle 與 How-to 類型的文章較為長壽,而Podcast、Interview、Infographic等類型文章的時效性較短
在Reddit較成功的文章通常也較為evergreen,但Twitter上成功的文章卻較為偏較topical content

連結: Backlinko原文


Search Atlas - 比較不同地區的搜尋結果 (封測中)

無意間發現Search Atlas這個相當有趣的研究項目project,大家都知道Google會根據搜尋者的區域回傳不同結果,但研究者想要做出一個平台來比較不同國家的Google搜尋結果到底有多不一樣。

舉例來說,「神(god)」這個搜尋字,在日本、印度、或西方國家的搜尋結果就相當迥異。

這個不同也會被延伸到政治層面,例如克里米亞半島的問題。在俄羅斯的搜尋結果會說"主權有爭議";在烏克蘭則會說"侵占";而其他歐洲國家則會專注在"歐盟對俄的制裁"

最後這樣的分析也可以反映出不同經濟實力的國家看待事情的差異。例如「氣候變遷」,在高收入國家大家會討論"如何保護"或"氣候變遷有感";但在中低收入的海島國家,則有比較多形容氣候變遷有多可怕或多危及生計的搜尋結果。

這個project與SEO的關係比較低,但看完後我覺得相當有趣,尤其現在很多人開始反思,人類透過科技吸收資訊的方式究竟有沒有甚麼根本上的問題,分享給大家!

連結: Search Atlas官網 / 論文 / 註冊成為試用者


[官方影片] 網站被人工懲罰以及下一步該怎麼辦

Google用演算法抓到大部分的spam,但有少部分還是以人工審查的方式,也就是所謂的manual actions。這集影片中Aurora討論人工審查、違反內容營利政策、網站不慎違反了這些政策的後續處理步驟。

當網站被判定有spam情況時,部分網頁或甚至整個網站都會受影響,可能的影響是排名降低或者從搜尋中消失,取決於被懲罰的嚴重程度。Spam的種類有很多,舉例來說,「太多來自你的網站的非自然連結」、 「結構化資料中包含錯誤資訊」...等都是可能被懲罰的原因。

在 YouTube 查看原始影片

Google的這些內容政策有非常多,而且會因為不同的地方 (Google News, Google Discover, 結構化資料...etc) 而有些微的不同,推薦這篇官方文件,它把所有搜尋相關的政策整理在一個地方。


[官方影片] 新網頁的SEO要多久才會有效

如果你對John Mueller有點認識,你大概可以猜到他的答案是... it depends (不一定)!

首先,收錄並不是保證的,Google及其他搜尋引擎都不會索引網路上的所有頁面,要讓網頁被收錄,必須要讓搜尋引擎覺得它值得被收錄。其次,即便收錄了也不保證使用者會看到,網頁可能沒在任何搜尋字上有排名,也有可能隨著時間被移除索引庫。

如果你的網頁是有提供價值的,那技術的部分就是要確保伺服器運作正常,主動提交網址、適當的連結到新頁面、避免不必要的網頁...等等,讓Googlebot能夠輕易地抓取你的頁面,並將之收錄。

在 YouTube 查看原始影片

[摘要] Google Search Podcast – 網路垃圾 & Gary談論排名

這集請了一位來自Search Quality小組的Duy,他在加入Google前也是位SEO。

在 Spotify 查看原始內容

Webspam
Duy提到spam大部分都是透過機器學習的方法來偵測,可以把這過程想成訓練一個人讀網頁,要判斷出上面的內容是不是spam其實相當容易;Google每天都會發現400億個垃圾頁面,但只有不到1%的搜尋詞會讓這些垃圾頁面浮出來;現在他們面對比較棘手的情況是整個網路世界中有太多的"老"網站,上面使用的一些技術或外掛可能因為過時而成為駭客攻擊的對象,而Google正在與更多的架站平台合作,避免這些疏於照顧的老網站成為駭客入侵及垃圾內容的破口。

另外除了spam(垃圾),scam(詐騙)也是很大的一個問題,舉例來說很多人會想要排名在「XX公司客服」這個字上,假冒客服然後欺騙,自2018年以來有一些演算法更新避免了這樣的情形。

Gary 談論排名
前幾集的podcast提到了很多crawling和serving (#25#27#30#32-33#35),ranking的部分Gary不想講太多,畢竟是Google的產業秘密,所以這集講的是information retrivel (IR)的基本原理。

有點延續上一期的討論,排名系統有兩大階段,一個是簡單的分類找出最符合搜尋字的1000個網頁(or 文檔),再來才是用更複雜的排名演算法(ex: RankBrain)做最後的排序。排序的基本運作方式就是給每個文檔一個"分數",而這個第二階段是給每個文檔的分數一個"乘數(multiplier)"。

舉例來說,演算法判斷某文檔和搜尋字有極高度相關,那就會賦予一個高的乘數,使其最後分數很高,亦即排名往前。通常兩個網頁很難很難會有分數相當的情況,而有一些小演算法 (例如HTTPS) 就是設計來作為tie-braker。

連結: 逐字稿


上期電子報我寫道說SEO除了內容以外,呈現方式也很重要。過沒幾天我看到了這個網頁,沒有很炫的設計也沒有多餘的圖片,卻讓人不知不覺看完整段文章,相當有力的表現了"文字才是核心"這個重點,令人反思,推薦給大家!