IKENSA暫定名 · 開發預覽

分頁(Pagination)處理

不要 noindex,要讓爬蟲走得完

a09檢核 自動網站結構在互動地圖中開啟 →

分頁像一本書的頁碼——你可以不喜歡翻頁,但把第 2 頁之後全部撕掉(noindex),書就只剩目錄。

03為什麼是現在學

列表分頁是爬蟲抵達深層內容的主要通道。處理錯了(全 noindex、或無限捲動沒有實體分頁),深層內容整批從索引消失。

04白話理解(對客戶簡報可直接引用)

原則:分頁讓它存在、可爬、各自有唯一網址(?page=2 或 /page/2)、不要 noindex——Google 已廢止 rel=prev/next,但分頁本身仍是爬蟲走到深層項目的路。無限捲動要配「有實體網址的分頁」當後備。

05工具箱

  • 爬取模擬 — 驗證爬蟲能沿分頁走到最深層項目
  • 分頁規格(模板層) — 每頁 canonical 指自己、title 帶頁碼

06怎麼做 · SOP 3 步(每步標產出物)

  1. 1確認分頁可爬、有唯一網址、canonical 指自己分頁規格驗證
  2. 2無限捲動站補實體分頁後備實作紀錄
  3. 3深層項目抽樣確認有被收錄收錄抽查

07場景應用(實戰經驗)

  • 電商把 page 2+ 全部 noindex 的老偏方——結果長尾商品從索引大量消失;移除 noindex 後逐步恢復。

08⚠️ 常見誤區

  • 分頁 canonical 全指第一頁——等於告訴 Google 後面每頁都是第一頁的副本,深層項目失去入口。
口訣

分頁是路,不是重複內容;路要留著。

10里程碑 · 完成標準(可驗證)

  • 分頁可爬且 canonical 指自己
  • 深層項目有收錄

學習者勾自己的進度;顧問勾客戶專案的交付——同一份標準,兩種用法。

12檢核方式與依據出處

程式自動判定:輸入網址,掃描引擎自己爬、自己打 API、自己判定。

依據等級決定計分權重(🟢×3/🔵×2/⚠️×1)——權重量的是「依據有多硬」, 不是「我們覺得多重要」。查無權威文件的判準,誠實標「業界慣例」。

← 上一節點
孤兒頁偵測
下一節點 →
篩選與參數(Facet)控管