網站文章沒收錄時,使用 GSC、Sitemap 與 Canonical 的七步排查指南

網站文章沒收錄怎麼辦?GSC、Sitemap、Canonical 的 7 步排查流程

文章沒收錄時,先確認網址狀態,再依序檢查 Google 是否發現、能否抓取、是否允許建立索引,以及 Canonical 是否指向正確代表網址。

網站文章沒被 Google 收錄時,先別反覆按「要求建立索引」。先用 Search Console 的「網址檢查」確認單一網址,接著查回應狀態、robots/noindex、Canonical、Sitemap 與內部連結;這些技術訊號都正常,再回頭看內容是否有獨立價值。GSC 裡的「未建立索引」網址也不全是文章,其中可能混有附件、Feed、參數頁或重複網址。排除數很多,不能直接推論網站文章全都消失。

資料查核:安佑編輯團隊依 Google Search Central 與 Search Console 官方文件整理,資料查核日為 2026 年 8 月 10 日,預定發佈日為 2026 年 8 月 17 日。本文提供診斷順序,不保證任何網址一定會被收錄,也不建議在未確認原因前大量修改 robots、Canonical 或網址。

先弄清楚:GSC 的「未收錄網址」不等於「未收錄文章」

很多人看到 GSC 顯示幾百、幾千個未建立索引網址,第一個反應是:「我的文章是不是都沒收錄?」這個判讀太快了。Search Console 報表整理的是 Google 在網站上發現的各種網址,不只 WordPress 的文章永久連結。

同一篇內容可能衍生圖片附件頁、Feed、分頁、搜尋結果頁、帶追蹤參數的網址;商店還可能產生購物車、篩選、排序與商品屬性網址。有些網址本來就不適合出現在搜尋結果。盤點時,先圈出網站真正想讓搜尋者找到的原創文章、服務頁或商品頁,再逐一確認哪些重要頁面缺漏;排除總數不必硬清成零。

網址類型通常是否需要索引SitemapCanonical/Noindex 重點
原創文章、核心服務頁通常需要應納入多半使用自我參照 Canonical,確認沒有 noindex
有整理價值的分類頁視內容而定需要索引才納入頁面要有清楚主題、說明與內鏈,不要只剩文章清單
圖片附件頁、Feed多數不需要通常不納入文章 Sitemap依網站用途關閉、重新導向或保留;不要誤當成文章缺漏
站內搜尋、購物車、登入頁通常不需要不納入依功能採 noindex 或存取控制,避免用 Canonical 掩蓋不同用途
排序、追蹤、篩選參數多數不需要,少數有搜尋需求只放正式代表頁先確認平台如何產生內容,再決定 Canonical、noindex 或保留
重複或非常相近版本通常只索引代表版本只放偏好的標準網址Canonical、重新導向、Sitemap 與內鏈方向應一致

實際盤點時,請先把網址依類型分組,再看每一組「應收錄」與「不必收錄」各有多少。這一步做完,問題通常會從一個嚇人的總數,縮小成幾個真正要檢查的文章或頁面群。

網站文章沒收錄的 7 步排查流程

第 1 步:用網址檢查工具查「完整網址」

先複製你在瀏覽器中實際打得開的完整網址,貼到 Search Console 上方的網址檢查列。不要只看「網頁索引」報表裡的群組數字,因為群組報表適合看趨勢,單一網址的診斷仍要回到網址檢查。

記下四件事:網址是否在 Google 索引中、上次檢索時間、使用者宣告的標準網址、Google 選擇的標準網址。如果頁面剛修改,也可以做即時測試,確認目前公開版本能否被存取。不過,即時測試顯示「可建立索引」,不代表 Google 最後一定會收錄,也無法預測 Google 會選哪個 Canonical。

第 2 步:確認公開頁真的回傳 200,內容也看得到

用無痕視窗開啟網址,確認不必登入、不會跳到首頁,也沒有 404、403、5xx 或重新導向迴圈。頁面回傳 200 只是起點;如果主要內容依賴登入、互動後才出現,或伺服器對 Googlebot 回傳不同結果,仍可能無法正常處理。

WordPress 這一段常卡在幾個不起眼的地方:快取仍提供舊版、資安外掛誤擋爬蟲、文章其實還是草稿或排程、永久連結規則異常,或網址被導到不相干的頁面。若整批網址都出現 5xx 或 403,先查主機與防火牆。這時逐篇要求索引,並不會繞過存取問題。

第 3 步:把 robots.txt、Meta Robots 與 X-Robots-Tag 分開看

robots.txt 控制的是檢索,不是可靠的移除索引方法;noindex 才是告訴搜尋系統不要將頁面放進索引的指示。兩者混用時最容易誤判:如果先用 robots.txt 擋住網址,Google 可能無法重新檢索頁面,也就看不到頁面上的 noindex 變更。

檢查文章原始碼中的 meta name="robots",也要留意伺服器回應標頭是否有 X-Robots-Tag。WordPress SEO 外掛、網站「阻擋搜尋引擎索引」設定、測試站搬正式站時遺留的規則,都可能造成全站或特定內容類型被 noindex。

第 4 步:比對你宣告的 Canonical 與 Google 選擇的 Canonical

如果文章明明可檢索,GSC 卻顯示「重複網頁」或「Google 選擇的標準網址與使用者不同」,就要檢查 Canonical。一般獨立文章通常應該自我參照;若 Canonical 指向首頁、分類頁、舊網址或另一篇不同任務的文章,Google 可能把目前網址當成非代表版本。

Canonical 是強烈信號,但不是按下後立刻生效的開關。Google 還會參考內容相似度、重新導向、Sitemap、內部連結與其他訊號。請讓這些方向一致:Sitemap 放正式網址、站內連結直接連正式網址、HTTP/HTTPS 與有無 www 的版本統一,不要一邊 Canonical 到 A,一邊又大量內鏈到 B。

網址從被發現、檢索、建立索引到標準網址選擇的四階段流程圖
先定位網址卡在哪一層,再處理對應原因;不要把所有未收錄狀態都當成同一種錯誤。

第 5 步:確認 Sitemap 與內部連結能讓 Google 找到正式網址

Sitemap 的作用是協助 Google 發現重要網址,也能表達你偏好的標準網址,但它不是收錄保證。打開文章 Sitemap,確認網址存在、格式正確、回傳 200,且沒有放入重新導向、404、noindex 或非標準版本。

再從網站實際可被找到的頁面檢查內鏈。新文章如果只存在 Sitemap,卻沒有分類頁、Hub 或相關文章連過去,搜尋系統與讀者都難以理解它在網站中的位置。至少要有一條來自核心主題頁的連結,再用一至兩篇相鄰文章補上情境連結。想做全站層級盤點,可先用WordPress SEO 健檢清單核對 Sitemap、索引設定與主要頁面。

第 6 步:判斷內容是否真的有獨立任務與可保留價值

技術檢查都正常,網址仍可能停在「已檢索—目前尚未建立索引」。這時只增加字數通常沒有用。請把文章和站內相近內容並排看:它回答的問題是否明確?讀者任務有沒有不同?標題答應要給的答案,前幾段是否已經交付?三題都答不清楚,才是內容層真正要補的地方。

如果五篇文章只是換標題重述同一套觀念,Google 沒有義務把每一篇都放進索引。比較實用的做法是建立清楚分工:Hub 說全貌、教學文解決步驟、比較文協助選擇、案例文說明情境。若內容長期沒有成效,也要先分清是索引問題、搜尋意圖問題,還是整體需求不足;可搭配SEO 沒成效的復甦排查,避免把所有問題都歸咎於技術。

第 7 步:修正後再要求索引,並留下觀察紀錄

完成實質修正後,再用網址檢查工具測試公開頁,確認主要問題已解除,接著要求建立索引。不要同一天重複送很多次;官方說明明確指出,即使提出要求,系統也不會立即建立索引,某些網址可能日後收錄,也可能不會。

建議在紀錄表留下網址、問題狀態、修正內容、修正日期、Canonical、Sitemap 與內鏈來源,並在 7、14、28 天回查。這三個時間點只是便於團隊追蹤,不是 Google 保證重新檢索的期限。若狀態沒有變化,再檢查網站整體檢索負載、重複意圖或內容價值;不要為了「刷新」任意改日期、改 slug 或搬網址。

GSC 狀態先看什麼安全的下一步常見誤區
已找到,目前尚未建立索引內鏈、Sitemap、網站負載、網址數量補強可發現性,降低低價值網址量,等待重新排程檢索每天重複要求索引
已檢索,目前尚未建立索引內容任務、重複度、Canonical、頁面品質改善獨立價值與站內分工,修正衝突訊號只補字數或換發布日期
使用適當標準標記的替代網頁Canonical 是否符合原本規劃若屬預期可不處理;非預期則統一 Canonical、Sitemap、內鏈把所有替代網頁都當錯誤
Google 選擇的標準網址與使用者不同內容相似度、重導、內鏈與網址版本消除衝突信號,確認代表頁真的最完整只重貼 Canonical,不查其他訊號
遭 robots.txt 封鎖是否真的要阻止檢索需要索引就解除封鎖;不需索引則選合適的 noindex/存取策略用 robots.txt 當移除索引工具
因 noindex 排除Meta Robots、外掛與回應標頭若屬誤設,移除 noindex 並允許重新檢索移除後立刻期待報表歸零
重新導向頁面目標是否正確且單一跳轉預期重導可保留;更新 Sitemap 與內鏈到最終網址把舊網址重新放回 Sitemap
404/5xx/403網址是否仍應存在、伺服器與防火牆重要頁恢復 200;已移除且無替代頁則保留真實 404/410全部導向首頁

一個實務例子:28 篇文章,為什麼 GSC 可能出現更多排除網址?

假設網站目前有 28 篇已公開文章,文章 Sitemap 也列出 28 個網址,這不代表 GSC 的未索引數只能是 28。Google 還可能發現舊 slug、附件頁、作者或標籤彙整、Feed、帶參數的商品網址,以及曾經存在但已刪除的網址。

這時先核對「文章 Sitemap 的有效網址數」是否接近公開文章數,再抽查重要文章是否自我 Canonical、回傳 200 且可在網址檢查中讀取。若這些都正常,接著分類排除清單裡的資產型與系統型網址。先別把報表總數解讀成「28 篇文章突然只剩 14 篇」;兩個數字統計的網址範圍可能根本不同。

文章、媒體、Feed、參數與商店網址的索引處置矩陣
同一個 GSC 排除總數裡,可能混有不同網址類型;應先分類,再決定哪些才是需要修正的核心頁。

送出索引要求前的 10 項檢查

  • 網址公開可開啟,不需登入,回傳 200。
  • 文章狀態確實為已發佈,不是草稿或未到期排程。
  • 頁面沒有誤設 noindex,回應標頭也沒有 X-Robots-Tag 阻擋。
  • robots.txt 沒有封鎖文章路徑與必要資源。
  • 使用者宣告 Canonical 指向正確正式網址。
  • HTTP、HTTPS、有無 www 與尾斜線版本沒有互相衝突。
  • 正式網址已在正確 Sitemap,Sitemap 本身可讀取。
  • 至少有一個主題 Hub 或重要頁面能直接連到本文。
  • 文章在前段直接回答搜尋問題,且和既有內容有清楚分工。
  • 已記錄修正內容與回查日期,不用頻繁改網址或發布日。

檢查表若只有一兩項不符合,就做最小修正,再觀察 Google 是否重新檢索。只有同一內容類型整批出錯,例如所有文章都帶 noindex,或 Canonical 全指向首頁,才處理範本或外掛層級設定。動手前先保存設定與頁面快照,修改後抽查代表網址,避免修一篇文章時連帶改壞其他正常頁面。

常見問題

Sitemap 顯示成功,文章就一定會收錄嗎?

不一定。Sitemap 能協助 Google 發現網址,也能提供偏好的標準網址訊號,但 Google 仍會依可檢索性、Canonical、內容、網站訊號與系統判斷決定是否建立索引。

「已檢索,目前尚未建立索引」要一直重送嗎?

不用。先確認 Canonical、索引指示、內容任務與站內重複度;有實質修正後再送一次即可。Google 官方也說明,這類網址日後可能收錄,也可能不會,反覆送出不是解法。

GSC 未建立索引數比文章數多,代表網站出問題嗎?

不必然。先把網址分成文章、頁面、媒體、Feed、參數、彙整與失效網址。只有應該收錄的重要頁面大量缺失,或 Sitemap/網址檢查出現共同錯誤時,才需要提高處理優先度。

site: 搜不到文章,就等於沒收錄嗎?

site: 可以當快速觀察,但不適合取代 Search Console。正式判斷應以網址檢查工具為主,因為它會顯示索引狀態、檢索資訊與 Canonical。

文章改日期會比較容易重新收錄嗎?

只改日期、沒有實質內容變更,不能解決索引原因,也可能讓讀者誤以為內容已更新。應先修正真正問題,重大更新時再如實調整更新日期。

需要把每一個未索引網址都改成 noindex 嗎?

不需要。404、重新導向、重複版本、Feed 與參數頁各有不同處置。先確認網址用途與平台行為,再決定 noindex、Canonical、重新導向或保留原狀。

資料來源與更新說明

本文技術事實以 Google 官方文件為主,包括 Search Console 網頁索引報表網址檢查工具建立並提交 Sitemap標準網址說明。Search Console 名稱、狀態與介面可能調整,實作時請以帳戶當下畫面與最新官方文件為準。

延伸閱讀

排除網址很多,卻不知道哪些才需要處理?

安佑可協助把文章、媒體、Feed、參數與商店網址分開盤點,確認真正影響搜尋服務頁與內容頁的原因,再提出有邊界的修正順序。

發佈留言

High Quality

我們致力於提供最高品質的服務,讓您安心無虞。

 

Fast Delivery

效率至上,為您節省寶貴時間,準時送達不延遲。

 

Best Warranty

完善的保固服務,為您打造無後顧之憂的體驗。