內容分發

Google Discover 內容資格檢查工具

貼上一個已經出咗街嘅文章 URL。我哋會擷取個頁面同佢嘅主圖,然後檢查所有影響 Google Discover 資格嘅真實訊號——唔係淨係睇「睇落似唔似分享得」。

由 reCAPTCHA 保護。我哋會喺伺服器端(已做 SSRF 防護)擷取你個頁面同主圖——乜都唔會儲存。

點解大部分 Discover 審核都會漏咗真正嘅阻礙

Google Discover 係出版者其中一個最大嘅自然流量來源,但佢靠嘅訊號好多一般 on-page 檢查清單都提都冇提過。最易漏嘅兩點:max-image-preview robots 指令,如果個頁面冇明確揀「large」(即係 Discover 真正會用嗰個尺寸),就會預設用「standard」(細細張縮圖);另外,一張吸引嘅圖只有真係夠大先算,呢樣嘢冇解碼真實圖片位元組係確認唔到嘅。呢個工具會擷取你真實嘅頁面同真實嘅主圖,直接量度兩者。

會檢查啲乜

五組真實訊號,每一項失敗都有具體修復方法。

max-image-preview 指令

讀取所有適用嘅 robots meta 標籤(robotsgooglebot)同 X-Robots-Tag 回應標頭,用 Google 嗰種方式合併(最嚴格嘅值贏),如果呢個指令冇設(預設「standard」)、設咗做「standard」、或者用「none」/noimageindex 完全封鎖,就會標記出嚟。

主圖真實嘅像素尺寸

揀出候選主圖(og:image,跟住 twitter:image,再跟住 JSON-LD 嘅 image),擷取真正嘅檔案,解碼出真實闊高——唔會信 URL 或者聲稱嘅屬性。凡係細過 Google 建議嘅約 1200px 闊度嘅圖片,同埋細到根本用唔到嘅圖片,都會標記出嚟。

Article 結構化數據同更新日期

Article / NewsArticle / BlogPosting 類型嘅 JSON-LD,同埋驗證 headlinedatePublisheddateModified 係咪存在、格式啱唔啱、同埋合唔合邏輯(修改日期唔應該早過發佈日期)。

可索引性

喺合併嘅 robots 訊號入面任何地方出現 noindex 指令,個頁面就會完全俾 Discover 摒除——因為呢一項唔通過嘅話,其他都冇意思,所以最先檢查。

標題質素(只供參考)

一個保守、只供參考嘅推斷方法,用嚟睇標點過多、全大寫比例、同常見嘅聳動措辭。Google 真正嘅內容政策執行冇辦法完全自動化——呢個當提示就得,唔好當最終判定。

常見問題

想喺 Google Discover 出現使唔使 AMP?

唔使。Google 喺 2021 年已經取消咗 Discover 嘅 AMP 要求。呢個工具淨係將 AMP 當做資訊——有冇都好,都唔會影響分數。

max-image-preview:standard 實際上會令你蝕咩?

如果冇明確設「large」,Google 喺 Discover 度就淨係會顯示細細張縮圖,而唔係全闊卡片格式,會明顯減低點擊率。大部分網站根本冇設過呢個指令,仲唔知預設值已經喺度限制緊自己。

點解要擷取真正嘅圖片,而唔係淨係check og:image 標籤存唔存在?

一個指向真實檔案、但闊度啱啱得 400px 嘅標籤,會通過「標籤存在」呢個check,但仍然唔會符合 Discover 嘅圖片質素標準。呢個工具會落載張圖,然後由位元組解碼出真實像素尺寸——同人手覆核做嘅係同一類check。

有 Article 結構化數據係咪即係保證有 Discover 資格?

冇一個單一訊號可以保證俾人揀中——Discover 嘅揀選仲要睇內容質素、新鮮度、同 Google 冇公開嘅用戶興趣訊號。有準確日期同標題嘅 Article 結構化數據係一個強而有力、有充分文件記錄嘅輔助訊號,但唔係保證。

我嘅 URL 或者內容會唔會儲存喺邊度?

唔會。擷取只係為咗呢一次check喺伺服器端進行,結果會直接送返去你個瀏覽器;除咗頻率限制計數器之外,乜都唔會寫入資料庫或者記錄。