搜尋結果頁處理
站內搜尋頁一律不索引
站內搜尋結果頁像便利貼——當下有用、用完即丟;把每張便利貼都裱框上架(收錄),牆就滿了。
03為什麼是現在學
站內搜尋頁是無限生成的(任何字串都是一頁),被收錄會形成無限薄頁,還可能被垃圾查詢注入利用。
04白話理解(對客戶簡報可直接引用)
站內搜尋結果頁(/search?q=…)一律不給收錄:meta noindex+robots.txt 擋爬雙保險。這是 Google 明文點名的做法——搜尋結果頁對搜尋引擎來說是「搜尋中的搜尋」,沒有價值。
05工具箱
- ▸site: 搜尋抽查 — 查有沒有 /search 網址已被收錄
- ▸模板層 noindex — 搜尋頁模板直接寫死
06怎麼做 · SOP 3 步(每步標產出物)
- 1搜尋頁模板加 noindex→ 模板更新
- 2robots.txt 擋搜尋路徑→ 規則更新
- 3已收錄的存量用 noindex 等退場→ 退場追蹤
07場景應用(實戰經驗)
- ◆被垃圾注入的經典案:搜尋頁被拿來生成賭博關鍵字頁面並取得外部連結——一開始就 noindex 的站不會中這招。
08⚠️ 常見誤區
- ✕只擋 robots 沒掛 noindex——外部連結照樣把它送進索引。
口訣
「搜尋頁給人用,不給搜尋引擎收。」
10里程碑 · 完成標準(可驗證)
- ☐搜尋頁 noindex+robots 雙保險
- ☐site: 查無殘留
學習者勾自己的進度;顧問勾客戶專案的交付——同一份標準,兩種用法。
12檢核方式與依據出處
程式自動判定:輸入網址,掃描引擎自己爬、自己打 API、自己判定。
依據等級決定計分權重(🟢×3/🔵×2/⚠️×1)——權重量的是「依據有多硬」, 不是「我們覺得多重要」。查無權威文件的判準,誠實標「業界慣例」。