可抓取性(Crawlability)是指搜尋引擎有效存取、抓取並瀏覽您網站的能力。如果搜尋引擎無法正常抓取您的網頁,無論內容品質如何,這些網頁都無法獲得排名。

搜尋引擎會為每個網站分配抓取預算(Crawl budget)。不佳的可抓取性會將預算浪費在不重要或失效的網址上,從而延誤對高價值網頁的發現。

某大型內容網站曾有數千個基於參數的網址被抓取。在透過 robots.txt 封鎖這些網址並改善內部連結後,重要網頁的抓取頻率顯著提高,排名也在數週內得到改善。

常見的抓取障礙

  • 損壞的內部連結(404 錯誤)
  • 錯誤的 robots.txt 規則
  • 重要網頁上的 Noindex 標籤
  • 網站結構過深(網頁距離首頁超過 4 次點擊)

即使是微小的抓取障礙,在大型網站中也會產生累積效應。

提升可抓取性的最佳實務

  • 維護清晰的內部連結結構
  • 使用 XML 網站地圖(Sitemap)引導爬蟲
  • 有意識地封鎖低價值網址
  • 定期監控 Google Search Console 中的抓取報告

應主動引導搜尋引擎,而非讓其自行摸索。