天問SEO研究站
外貿 Google SEO / GEO / 獨立站內容研究

Google收錄問題排查:196篇只收64篇,三個真實案例裡的卡點

发布:2026-08-20 · 更新:2026-08-20

Google收錄是外貿站的第一道坎:頁面進不了 Google 的索引庫,寫得再好也是零。網站不被Google收錄,到底該從哪查起?這篇不講通用理論,只拆我們天問團隊自己經手的三個真實案例——包括你正在看的這個站本身。這個站曾經 196 篇文章只被收錄 64 篇,剩下 132 篇對 Google 來說完全不存在。排查下來,卡點沒有一個出在”內容品質”上。

如果你的站也有類似情況,建議先照著做第一步,再對號入座看三個案例。

先查狀態:你的頁面卡在哪一檔

排查收錄問題最忌諱上來就改內容——內容品質隻影響“Crawled – currently not indexed”這一檔,而多數站真正卡住的是“unknown”和“Discovered”,改內容等於修錯了零件。開啟 Search Console 頂部的網址檢查框,貼入頁面地址,幾秒鐘就能看到你卡在哪一檔:

狀態 意思 該做什麼
URL is unknown to Google Google 根本不知道這個頁面存在 查 sitemap 是否真實收了它、有沒有內鏈指向它
Discovered – currently not indexed 知道了,但還沒來抓 加內鏈提權重,等待或手動請求收錄
Crawled – currently not indexed 抓了,看完決定先不收 這才輪到檢查內容價值和重複度
網址已收錄到 Google 在索引庫裡了 別動它,去救別的頁

先別急著動內容,把未收錄頁逐個過一遍狀態再決定下一步。我們把自己站 132 個隱形頁全查了一遍,問題分佈和想像的完全不一樣——詳細做法寫在用 Search Console 做 SEO 診斷的完整流程裡。

案例一:URL 裡的中文,是最被低估的收錄殺手

同一個中文內容站裡,英文 slug 頁被 Google 收錄 63 篇,中文編碼 slug 頁收錄 0 篇——兩組頁面內容都是中文,變數只有 URL 的編碼方式(196 篇樣本,2026 年 8 月 GSC 逐頁檢查)。

這是我們自己站上的對照實驗,不是刻意設計的,是日更偷懶的副產品:早期文章用英文語義 slug,後來圖省事直接拿中文標題生成 URL,瀏覽器裡看著正常,實際地址變成 %e8%b0%b7... 這樣的編碼串。63 比 0,零收錄的全是編碼串那一組。

中文 URL 不是Google官方都支援嗎?官方文件確實說支援,但實際抓取時編碼串又長又亂,排在佇列末尾。知乎、百科用中文路徑照樣收錄,那是權重扛得住;我們那批收錄為零的頁面全是編碼串——權重趨近於零的站,根本等不到 Google 來解碼。

修復要注意兩個坑。一是 34 個中文 slug 全部改成英文語義 slug 後,舊地址必須 301 到新地址;二是 WordPress 原生的 _wp_old_slug 重定向對編碼中文 slug 並不可靠,我們實測只能用 mu-plugin 寫硬對映才 100% 生效。改完記得清快取再驗證,帶快取的 200 是假象。

案例二:零報錯的靜默故障,比報錯的故障害人

一個機械外貿站,幾個月收錄零增長,內容和外鏈都沒問題。挖到底是兩個疊加的靜默故障——全程沒有任何報錯。

Rank Math 的 sitemap 快取檔名是 rank_math_{md5}.xml,不含 sitemap 字樣,按檔名排查永遠搜不到,而且預設存活 100 天(2026 年 7 月實測)。也就是說,站長以為 sitemap 天天在更新,Google 拿到的其實是三個月前的舊檔案,新文章根本不在裡面。

第二個故障更隱蔽:wp-config 裡關了 WP_CRON,伺服器端卻沒配系統 cron。後果是定時釋出的文章會無限期停在 Scheduled 狀態、零報錯——這個站積壓了 176 篇”已排期”卻永遠不會發布的文章。同伺服器其他站都配了,唯獨它漏了。

對付靜默故障只有一個辦法:不信配置,信探針。發一篇一分鐘後到期的測試定時文,看它到點發不釋出;用 Search Console 的 sitemap 報告核對 Google 實際下載的時間和條數,而不是看外掛後臺的綠勾。

案例三:頁面越多,收錄率反而越低

一個 2900 多個產品頁的類目站,索引率只有 36%:約 1916 個產品頁停在 Discovered 狀態,Google 知道它們存在,就是不來抓(90 天 GSC 全量資料,2026 年 8 月)。

這個站還有一個反直覺資料:型號類長尾查詢貢獻了 71% 的點選,而站長一直想主攻的”維修”類大詞只有展現沒有點選。大詞的流量是幻覺,真實生意藏在型號長尾裡——但長尾頁恰恰是沒被收錄的那批。

給這個站的建議只有一條:索引率修到 60% 之前,停掉所有內容動作——1916 個沒進索引的頁面,標題改得再漂亮 Google 也看不見。我們自己站的資料擺在那:一個月發 150 多篇,收錄率掉到 33%;後來怎麼救回來的,下一節細說。發得多不如讓 Google 先把已有的收進去——之前寫過一篇專門拆這個機制的:為什麼發得越多流量越少

內鏈:我們實測過槓桿最高的一招

給 98 個未收錄頁從 64 篇已收錄頁建了 294 條內鏈之後,4 天內全站已編入索引數從 64 升到 112(2026 年 8 月實測,無其他變數介入)。

為什麼內鏈能這麼快見效?未收錄頁大多是孤島,Google 從已收錄頁順著連結爬過來,才算真正”發現”了它們。做法上有講究——連結要從已收錄、主題相關的頁面發出,錨文本用目標頁的真實標題,別堆關鍵字。具體的組織方法看內鏈與主題叢集的實操指南

外鏈當然也有用,但對新站來說內鏈是你唯一能百分百控制、當天就能上線的槓桿。內鏈沒建完之前,先別急著花錢搞外鏈。

手動請求收錄:配額有限,先查後提

Search Console 的”請求編入索引”每個站每天大約只有 10 次配額,用一次少一次。我們踩過的浪費:給已經收錄的頁面提交了請求,白燒一格。正確姿勢是先看網址檢查的狀態,只給 Discovered 和 unknown 狀態的頁面提交。GSC 提交成功的彈窗裡寫得明明白白:多次提交同一網頁並不能改變佇列順序——我們誤重複提交過兩次,配額白燒,佇列紋絲不動。

還要認清它的定位:請求收錄是加速器,不是救命藥。頁面本身沒有內鏈、sitemap 裡也沒有它,請求十次也白搭。robots、canonical 和 sitemap 的索引控制這些基礎沒打好,加速器加速的是零。

一張排查順序表

順序 查什麼 工具 常見兇手
1 未收錄頁的狀態分佈 GSC 網址檢查(官方說明 大量 unknown = 發現層問題
2 URL 形態 肉眼看位址列 中文編碼串、引數、超長 URL
3 sitemap 的真實狀態 GSC sitemap 報告核對下載時間 快取凍結、新頁不在其中
4 內鏈入度 爬蟲工具或資料庫查詢 孤島頁、只有分頁入口
5 定時任務是否真在跑 探針法實測 WP_CRON 關閉且無系統 cron
6 這時才輪到內容 對照已收錄頁找差距 重複、拼湊、無獨立價值

順序很重要。市面上多數教學讓你直接從第 6 步開始改內容,而我們五臺伺服器上託管著 90 多個外貿站,今年經手的收錄排查裡,兇手幾乎都藏在前 5 步。

新站的現實預期

別指望速效。權重接近零的站,每個動作的反饋週期都以周計——我們自己這個站從改 slug、建內鏈到看見收錄翻倍,走了一個多月。另外,收錄只是入場券:頁面進了索引庫不等於有排名,更不等於有詢價。我們有個客戶站點選漲了 4.7 倍、詢價反而掉到原來的十二分之一,那是另一個話題,下篇細拆。

想知道自己站的收錄卡在哪一檔?可以找天問做一次免費的收錄體檢:拉一遍全站的狀態分佈,告訴你未收錄頁卡在哪一步、值不值得救。

按问题继续阅读

联系天问:电话/微信 135 2681 6415(微信同号) · 联系我们

加微信沟通SEO诊断需求

微信/电话:13526816415(微信同号)

独立站优化师刘宇微信二维码,微信/电话 13526816415