IKENSA暫定名 · 開發預覽

XML Sitemap 生成

動態生成、分檔、只放可索引的 200 頁

f09檢核 自動基礎建置在互動地圖中開啟 →

sitemap 像給爬蟲的貨物清單——不保證每箱都上架,但至少讓對方知道倉庫裡有什麼、哪箱是新到的。

03為什麼是現在學

sitemap 是索引診斷的基準線:之後查「該收錄的有沒有漏」,比對的就是這份清單——清單本身是髒的,診斷就不成立。

04白話理解(對客戶簡報可直接引用)

sitemap.xml 列出你希望被收錄的所有網址。三個原則:①動態生成(新頁自動進、刪頁自動出),不要手工維護 ②只放「可收錄的 200 頁」——轉址頁、404、noindex 頁放進去等於給 Google 髒資料 ③在 robots.txt 宣告位置並提交到 GSC。大站拆多檔+sitemap index。

05工具箱

  • GSC Sitemaps 報表 — 提交狀態、讀取錯誤、發現的網址數
  • CMS/框架的 sitemap 產生器 — WordPress 內建或 next-sitemap 等

06怎麼做 · SOP 3 步(每步標產出物)

  1. 1確認 sitemap 是動態生成且涵蓋所有重要頁型涵蓋範圍清單
  2. 2抽 20 條驗證全部回 200、非轉址、非 noindex抽樣驗證紀錄
  3. 3robots.txt 宣告+GSC 提交提交紀錄

07場景應用(實戰經驗)

  • 電商常見:下架商品還留在 sitemap 裡,幾千條 404 讓 GSC 報表整片紅——下架流程要連動 sitemap。

08⚠️ 常見誤區

  • 把 sitemap 當排名工具——它只影響「發現」,不影響「排名」。
  • lastmod 全部寫今天——謊報更新時間,Google 之後就不信你的 lastmod。
口訣

只放想被收錄、而且真的能收錄的頁。

10里程碑 · 完成標準(可驗證)

  • 動態生成
  • 抽樣 100% 為 200 可收錄頁
  • GSC 提交且零讀取錯誤

學習者勾自己的進度;顧問勾客戶專案的交付——同一份標準,兩種用法。

12檢核方式與依據出處

程式自動判定:輸入網址,掃描引擎自己爬、自己打 API、自己判定。

依據等級決定計分權重(🟢×3/🔵×2/⚠️×1)——權重量的是「依據有多硬」, 不是「我們覺得多重要」。查無權威文件的判準,誠實標「業界慣例」。

← 上一節點
robots.txt 規則
下一節點 →
Google Search Console 驗證