XML Sitemap 生成
動態生成、分檔、只放可索引的 200 頁
sitemap 像給爬蟲的貨物清單——不保證每箱都上架,但至少讓對方知道倉庫裡有什麼、哪箱是新到的。
03為什麼是現在學
sitemap 是索引診斷的基準線:之後查「該收錄的有沒有漏」,比對的就是這份清單——清單本身是髒的,診斷就不成立。
04白話理解(對客戶簡報可直接引用)
sitemap.xml 列出你希望被收錄的所有網址。三個原則:①動態生成(新頁自動進、刪頁自動出),不要手工維護 ②只放「可收錄的 200 頁」——轉址頁、404、noindex 頁放進去等於給 Google 髒資料 ③在 robots.txt 宣告位置並提交到 GSC。大站拆多檔+sitemap index。
05工具箱
- ▸GSC Sitemaps 報表 — 提交狀態、讀取錯誤、發現的網址數
- ▸CMS/框架的 sitemap 產生器 — WordPress 內建或 next-sitemap 等
06怎麼做 · SOP 3 步(每步標產出物)
- 1確認 sitemap 是動態生成且涵蓋所有重要頁型→ 涵蓋範圍清單
- 2抽 20 條驗證全部回 200、非轉址、非 noindex→ 抽樣驗證紀錄
- 3robots.txt 宣告+GSC 提交→ 提交紀錄
07場景應用(實戰經驗)
- ◆電商常見:下架商品還留在 sitemap 裡,幾千條 404 讓 GSC 報表整片紅——下架流程要連動 sitemap。
08⚠️ 常見誤區
- ✕把 sitemap 當排名工具——它只影響「發現」,不影響「排名」。
- ✕lastmod 全部寫今天——謊報更新時間,Google 之後就不信你的 lastmod。
口訣
「只放想被收錄、而且真的能收錄的頁。」
10里程碑 · 完成標準(可驗證)
- ☐動態生成
- ☐抽樣 100% 為 200 可收錄頁
- ☐GSC 提交且零讀取錯誤
學習者勾自己的進度;顧問勾客戶專案的交付——同一份標準,兩種用法。
12檢核方式與依據出處
程式自動判定:輸入網址,掃描引擎自己爬、自己打 API、自己判定。
- 🟢 官方明文Google:Sitemap 總覽與規範 ↗
- 🟢 官方明文sitemaps.org 協定 ↗
依據等級決定計分權重(🟢×3/🔵×2/⚠️×1)——權重量的是「依據有多硬」, 不是「我們覺得多重要」。查無權威文件的判準,誠實標「業界慣例」。