搜尋觀點
User-Agent、Googlebot Smartphone 與 Cloaking:SEO 檢查不能只看瀏覽器畫面

User-Agent 檢查可以揭露普通瀏覽器看不到的搜尋問題。
Inspect The Path 有兩個很典型的 User-Agent 關卡:先用 Screaming Frog SEO Spider 才看到下一步,再用 Googlebot Smartphone 才看到另一個版本。這不是叫大家做 cloaking,而是提醒 SEO 人員:只用普通瀏覽器看網站,永遠不夠。
今日的網站往往會根據裝置、地區、cookie、登入狀態、User-Agent、JavaScript 執行能力和 CDN 規則回傳不同內容。搜尋引擎看到的版本,可能和你打開 Chrome 看到的版本不同。
甚麼是 User-Agent?
User-Agent 是瀏覽器或 crawler 在請求網頁時送出的識別字串。Googlebot、Bingbot、Facebook crawler、Screaming Frog、GPTBot、ClaudeBot、PerplexityBot 都可能帶有不同 User-Agent。
SEO 檢查會用 User-Agent 做幾件事:
- 模擬 Googlebot Smartphone 看到的 HTML
- 模擬 SEO crawler 是否能讀到內鏈和內容
- 檢查社交 crawler 是否能讀到 OG meta
- 檢查 AI agent 是否被 robots 或 WAF 阻擋
- 找出伺服器是否對 crawler 回傳不同狀態碼
Cloaking 的真正風險
Cloaking 是指網站向搜尋引擎呈現和普通用戶明顯不同的內容,意圖操控排名。不是所有 User-Agent 差異都是 cloaking;例如手機版和桌面版排版不同、A/B test、地區語言切換,都可能合理。但如果 Googlebot 看到大量關鍵字頁,而用戶看到完全不同內容,風險就很高。
Inspect The Path 把這個概念變成謎題:同一頁只有在特定 crawler 視角才露出線索。真實網站檢查時,我們不是為了找彩蛋,而是為了確認重要內容沒有隻在某個視角出現或消失。
Mobile-first indexing 要看手機視角
Google 主要以手機版內容作為索引基礎。若桌面版內容完整,但手機版缺少主要文案、內鏈、FAQ、Schema 或圖片 alt,排名可能受影響。
香港企業網站常見問題包括:
- 手機版隱藏了服務細節,只剩短文案
- 手機選單沒有收錄全部重要頁
- 手機載入依賴 JS,但 crawler 初始 HTML 太薄
- 地區頁或產品頁在手機版缺少內鏈
- FAQ 或 Schema 只在桌面模板輸出
AI agent 也要納入檢查
GEO / AISEO 時代,除了 Googlebot,也要看 AI agent 能否理解品牌實體、服務範圍、答案型內容和聯絡入口。Agent SEO 檢查不只是「允不允許抓」,而是看它能否在公開內容中讀到足夠清楚的資訊。
你可以先用 Agent SEO 檢測工具 做基礎盤點,再連到 GEO 服務 評估品牌在 AI 答案裏的可見度。
建議檢查方法
- 用普通瀏覽器看頁面是否完整。
- 用 SEO crawler 抽查 HTML、title、description、canonical、H1、內鏈。
- 用 Googlebot Smartphone User-Agent 檢查主要內容是否一致。
- 用社交 crawler debug OG 預覽。
- 用 AI agent / robots 策略檢查公開可讀性。
- 檢查 Vary: User-Agent、快取和 CDN 規則是否造成錯誤版本。
2026 年後還要多看兩件事:Googlebot 身份與 Google Search 的 2MB HTML 邊界
Google Search Central 在 2026 年 3 月 31 日補了兩個很實際的提醒。第一,Google crawler IP range 的 JSON 檔已搬到 developers.google.com/crawling/ipranges/;第二,官方在 Inside Googlebot 說明瞭 Google Search 的 Googlebot 在抓 HTML 時,超過 2MB 的部分會直接被忽略,索引系統和 Web Rendering Service 只處理最先拿到的那一段位元組。這個 2MB 邊界是針對文內說明的抓取情境,不應泛化成所有 Google crawler、社交 crawler 或 AI agent 都共用同一條上限。
這代表技術檢查不能只停在「我把 Googlebot User-Agent 模擬出來了」。如果 WAF、CDN 或 bot policy 還在用舊的 IP 清單,你可能會錯把真 Googlebot 擋在門外;如果 Google Search 要讀取的 HTML 前段塞滿大型 inline script、base64 圖片或過量 JSON,搜尋系統可能連主要文案、canonical 或結構化資料都未讀到。
| 檢查點 | 先看甚麼 | 為甚麼現在要做 |
|---|---|---|
| Google crawler IP range | 伺服器規則、WAF allowlist、bot 驗證腳本是否已改讀 developers.google.com/crawling/ipranges/ |
官方已把 JSON 檔搬家,舊 /search/apis/ipranges/ 之後只會過渡性保留;若系統長期不更新,驗證邏輯會愈來愈脆弱。 |
| Googlebot 身份驗證 | User-Agent 之外,再看官方 IP range、反向 DNS 與 server log 來源 | 單看字串很容易被偽裝;先確認來的是不是真 Googlebot,再談後續內容診斷,SOP 會清楚很多。 |
| Googlebot 請求結果 | 已驗證的 Googlebot 最終收到甚麼狀態碼、HTML、canonical、robots 指令與快取版本 | 身份驗證和內容診斷是兩步。真實 SEO 問題常出在 bot policy、CDN 防護或快取規則,而不是頁面表面看起來像不像 Googlebot。 |
| Google Search HTML 前 2MB | title、description、canonical、主文案、主要內鏈、Schema 是否已在初始 HTML 前段出現 | 官方說明很直接:在文中這個 Googlebot / Google Search 抓取情境下,超過 2MB 的 HTML bytes 不會再被抓、渲染或索引。把關鍵訊號塞到後段,等於主動增加漏讀風險。 |
| 大型 inline 資產 | base64 圖片、超長 JSON、追蹤腳本、過量 hydration payload | 這些內容最容易把真正重要的 SEO 訊號往後擠。若頁面很重,先減少前段噪音,再談更複雜的 rendering。 |
若你懷疑問題不只在 User-Agent,而是整條 request / response 鏈都有風險,可延伸看 HTTP Header、Redirect Chain 與 Cookie:技術 SEO 如何讀懂伺服器訊號?。
完整謎題路線可回看 Inspect The Path SEO 解密攻略。
Inspect The Path 對應關卡:兩種 crawler 視角
遊戲裏有兩次明確要求切換 User-Agent:第一次用 Screaming Frog SEO Spider 才看到 /shift-your-perspective;第二次用 Googlebot Smartphone 才看到 /at-the-edge-of-the-mountain。這不是單純炫技,而是技術 SEO 的基本功。
curl -iL -A 'Screaming Frog SEO Spider/20.2' https://inspectthepath.com/unlock-the-path-on-the-move
curl -iL -A 'Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/126.0.0.0 Mobile Safari/537.36 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)' https://inspectthepath.com/shift-your-perspective
技術原理:差異不一定是 cloaking,但一定要知道
User-Agent 差異可能有合理理由,例如手機版、桌面版、社交 crawler 預覽、CDN cache、語言自動切換。但若 Googlebot 看到一套內容,用戶看到另一套內容,而且差異會影響排名或轉化,就可能變成 cloaking 風險。
SEO 檢查應該同時看:
- 普通 Chrome / Safari 的用戶畫面。
- 初始 HTML 是否已有主要內容。
- Googlebot Smartphone 是否能看到同等內容。
- SEO Spider 是否能抓到內鏈、canonical、H1、Schema。
- Facebook / LinkedIn crawler 是否能讀到 OG。
- GPTBot、ClaudeBot、PerplexityBot 等 AI agent 是否被 robots / WAF 阻擋。
香港服務頁最常見問題
- 手機版為了美觀縮短內容,服務細節和 FAQ 消失。
- 重要內鏈只藏在桌面 mega menu,手機選單沒有。
- JavaScript 慢,crawler 初始 HTML 只有空殼。
- CDN 對 bot 回傳不同 cache 版本。
- 社交分享圖或 OG description 還是舊品牌。
- WAF 仍用舊 crawler IP 清單,導致真 Googlebot 被額外挑戰。
- 首屏放太多 inline script 或大型 base64 資產,真正重要的 canonical、主文案和 Schema 被擠到 HTML 後段。
檢查 SOP
先用 Agent SEO 檢測工具 看不同 agent 視角,再把有差異的 URL 丟進 Search Console URL Inspection、Screaming Frog 或 server log。若頁面本身很重,先用 header / log 檢查 bot 是否被錯擋,再檢查 Google Search 要讀的 HTML 前段是否已放好 title、canonical、主文案與 Schema。若你的目標進一步是 AI Overview / Gemini / GPT 等公開答案入口的引用,這已經屬於 YUSIHK 延伸的 GEO 盤點,不是 2026-03-31 兩篇 Google 官方更新本身的結論;可另外接到 GEO 服務 盤點品牌實體和答案型內容。完整流程可回看 Inspect The Path 完整攻略。
想把這套檢查用在自己網站?
如果你的網站剛搬站、改版、轉 static site,或者開始做 GEO / AISEO,最容易出事的往往不是單一關鍵字,而是 URL、canonical、headers、robots、Schema 與內容入口互相打架。你可以先用 YUSIHK 的 SEO 工具中心 做初步檢查,再把網站 URL 發給我們做 SEO / GEO 技術診斷。
參考資料
- Inspect The Path
- Google Search Central:robots.txt 簡介
- Google Search Central:建立與提交 Sitemap
- Google Search Central:指定 canonical URL
- Google Search Central:分頁與增量載入最佳做法
- Google Search Central:Googlebot 文件
- Google Search Central:Mobile-first indexing
- Google Search Central Blog:New Location for the Google Crawlers' IP Range Files
- Google Search Central Blog:Inside Googlebot: demystifying crawling, fetching, and the bytes we process
- Google Search Central:重新導向與 Google 搜尋
- Open Graph protocol
- Meta:Sharing for Webmasters
