nosnippet 在 Google Search 的作用,是禁止頁面內容出現在搜尋結果的文字摘要,同時禁止該內容成為 Google AI Overviews 和 AI Mode 的直接輸入;max-snippet 限制可用的文字長度,data-nosnippet 標記頁面中的特定區塊。這適用於要控制 Google 端摘要的頁面;robots.txt 把頁面擋住的時候,這些 meta 指令連被讀到的機會都沒有,就談不上生效。本文提供的是可以直接對照的東西:三個指令各自控制什麼、和 noindex/robots.txt 的分工、部署後怎麼驗收,以及跨平台推論的界線。
這三個指令的關係,可以想成一本書和圖書館的規則。noindex 是「這本書不要進館藏目錄」;nosnippet 是「書可以進目錄,但別把內文印在索引卡上」;robots.txt 則是「這個書架不要進去」——最後這條一旦生效,書上貼的任何標籤都沒有人看得到。
這些規則描述的是 Google 端的摘要與直接輸入。其他來源會不會提到同一主題,要另外查。
可控制的 HTML 指令與不可保證的 AI citation 應分開記錄。
先回答 nosnippet 控制什麼
Google 的 robots meta tag 文件 將 nosnippet 定義為不顯示文字摘要,並說明它適用 Google Web Search、Google Images、Discover、AI Overviews 和 AI Mode。這裡的關鍵在於分清兩件事:Google 讀到的頁面內容,以及 Google 產品的摘要或直接輸入。網頁本身照樣存在、讀者照樣打得開——被限制的是摘要這一層。第三方服務怎麼處理,按各自政策查。
如果目標是讓 Google 仍可索引頁面,但不希望頁面文字成為 Google 搜尋摘要或 AI features 的直接輸入,應先研究 nosnippet 或 max-snippet;若只要排除 HTML 某段的搜尋摘要,則研究 data-nosnippet,不能從該標記直接推導 AI direct-input 行為。如果目標是讓頁面不出現在 Google 搜尋索引,則應研究 noindex,而不是把 nosnippet 當成索引控制。若目標是禁止 crawler 請求,則是 robots.txt 或權限控制的議題。
四種控制方式的責任差異
| 指令或機制 | 主要作用 | Google 讀到後的效果 | 不能直接推出的事 |
|---|---|---|---|
nosnippet | 不提供文字摘要 | 該內容也不作為 AI Overviews、AI Mode 的直接輸入 | 其他 AI 產品是否讀到需另查 |
max-snippet | 設定可用摘要的最大文字長度 | Google 依限制產生摘要,長度為 0 時等同 nosnippet,不提供文字摘要 | 不能保證某個答案完全不提到主題 |
data-nosnippet | 在 HTML 中標記特定文字區塊 | 被標記文字不作為 Google 搜尋摘要;AI features 的預覽效果需按當前文件核對 | 它不是整頁 noindex |
noindex | 要求 Google 不將頁面編入索引 | 需要 Google 能抓到指令,並以 Google 的索引處理為準 | 不控制其他搜尋引擎或所有 AI crawler |
表格只描述 Google 官方文件的適用範圍。Google 仍可能依產品和頁面情況處理 URL,其他平台也有自己的 crawler 政策。若需要跨平台矩陣,請參考 robots.txt 管理 AI crawler,不要把本篇 Google 指令擴張成全平台規則。
設定範例與適用範圍
整頁限制可以放在 HTML <head> 的 robots meta tag:
<meta name="robots" content="nosnippet">
若要設定摘要長度,Google 文件提供 max-snippet 的 robots meta 形式:
<meta name="robots" content="max-snippet:120">
若只有一段不應進入 Google 摘要或 AI 直接輸入,可以在頁面可見 HTML 中標記:
<p data-nosnippet>
這段文字仍可供頁面讀者閱讀,但不作為 Google 搜尋摘要。
</p>
這些範例只示範語法,是否加入特定頁面要由控制目標決定。部署前要先核對 HTML 實際輸出,並讓內容負責人知道摘要可能因此變少。Google 的文件也提醒,robots meta tag 只有在 crawler 可以存取頁面時才讀得到;如果 robots.txt 先阻擋 URL,Google 可能無法看到這些指令。
另外,Google robots meta 文件列出部分 structured-data usage 例外,例如 Article 的 description 欄位;因此 nosnippet 不應被寫成清除所有 machine-readable data 的總開關。若要控制 JSON-LD 的顯示或使用,仍要另查該結構化資料類型的官方文件。
依目的選擇規則
可以用以下決策順序降低誤用:
- 你要隱藏整個頁面,還是只限制摘要中的一段文字?整頁索引問題先看
noindex,區塊問題再看data-nosnippet。 - 你是否仍希望 Google 使用頁面內容理解主題?若只控制摘要長度,
max-snippet和nosnippet的後果不同,先確認產品需求。 - 你是否只在意 Google?若還要控制 OpenAI、Anthropic、Perplexity 或其他 crawler,需另外查看其官方政策和 robots 行為。
- 頁面是否需要 crawler 讀取 meta 指令?若 WAF 或 robots.txt 阻擋,必須把存取層與指令層分開查。
- 你要驗證的是搜尋摘要、AI Overviews、AI Mode,還是頁面是否被索引?先固定產品和指標,再選規則。
一個常見誤區是把「摘要沒有出現」當成「Google 沒有看到頁面」,或把「頁面仍可被打開」當成「它一定能成為 AI 直接輸入」。這兩種結論都超過了指令本身可證明的範圍。
設定後如何驗收
本地或測試環境可以先完成檢查,正式環境則需要另有授權與讀回證據:
| 驗收層 | 檢查內容 | 結果記錄 |
|---|---|---|
| HTML | 初始 HTML、rendered HTML 是否保留預期 meta 或 data-nosnippet | 原始碼版本、時間、URL |
| 存取 | Google crawler 是否收到 200、是否被 robots 或 WAF 擋下 | HTTP 狀態、response header、log 範圍 |
| 索引 | 若使用 noindex,透過 Google 官方工具檢查指令是否被讀到 | URL、檢查時間、工具結果 |
| 摘要 | 在限定產品、查詢與日期下觀察 Google 摘要或 AI features | 查詢、裝置、結果截圖或文字證據 |
| 外部平台 | 若要驗證其他 AI 產品,單獨記錄其 crawler 或答案觀測 | 平台、時間、取樣方法、無資料狀態 |
不要因為一次搜尋沒有摘要,就聲稱規則已經對所有搜尋結果生效。Google 可能需要重新抓取,搜尋結果也受查詢、語言、位置和產品狀態影響。若沒有足夠的重複觀測,請保留「尚未驗證」而不是補成成功或失敗。
不能由 nosnippet 推出的結果
nosnippet 只限制 Google 的摘要和 AI 直接輸入,不會刪除頁面,也不會同時執行 noindex 或跨平台禁止。它也不會移除其他網站、使用者提供的資料或已被獨立取得的事實。Google 文件只支持它對 Google 搜尋摘要和 AI Overviews、AI Mode 直接輸入的控制範圍;至於其他產品或已存在於其他來源的資訊,這篇沒有足夠證據替它們下結論。
同樣地,沒有設定 nosnippet,也無法據此判定 Google 一定會把頁面內容放入 AI Overview。Google 的 AI features 文件 說明 AI features 使用現有 Search 基礎,頁面需要符合索引與摘要資格,抓取、索引和顯示仍由產品狀態決定。指令是限制條件,不是曝光承諾。
常見問題
nosnippet 會讓頁面完全不出現在 AI Overviews 嗎?
它防止的是你的頁面內容成為 Google AI Overviews 和 AI Mode 的直接輸入,也禁止 Google 顯示文字摘要。同一個主題若有其他來源寫過,那些內容不受你的指令影響——你關的是自己那扇門,不是整條走廊。要更廣泛的控制,分開查各平台政策。
nosnippet 和 noindex 有什麼差別?
nosnippet 控制的是 Google 摘要和 AI 直接輸入,noindex 控制的是索引——回到圖書館那個比喻:一個管索引卡上印什麼,一個管書進不進目錄。兩者都要 Google 抓得到、讀得到指令才成立,實際處理以 Google 的索引系統為準。
data-nosnippet 可以標記一個 FAQ 答案嗎?
技術上可以,要不要這樣做則看內容目標。它限制那一段出現在 Google 搜尋摘要;AI features 的預覽效果按當前文件核對,讀者在頁面上仍然看得到那個答案。FAQ 若是這頁的主要回答,部署前先想清楚這個取捨——你擋掉的可能正是讀者搜尋時最需要看到的那一句。
robots.txt 阻擋後,nosnippet 還有效嗎?
這時候它是一個沒有人讀過的指令。Google 官方說明要求 crawler 能存取頁面,才看得到 robots meta tag——擋住存取和傳遞頁面指令是兩個層次,而前者會讓後者失去意義。在 log、HTTP 和實際工具結果中分開記錄。
nosnippet 會影響其他 AI crawler 嗎?
Google 的 robots meta 文件描述的是 Google 產品的行為。其他 crawler 讀不讀同一個標記、讀了遵不遵守,查各自的官方文件——同一行 HTML,七家平台可能有七種處理方式。跨平台政策可從 AI crawler 檢查表開始,仍要按平台驗證。
如果需要把 Google 指令和整體內容治理放回服務範圍,可先查看 EthorX GEO 服務,再按實際平台和資料範圍決定工作邊界。
若要查看產品層的內容與可觀測性工作入口,也可參考 Otlex;本文不把產品頁視為 Google 結果證據。
查證邊界
本文整理 Google robots meta、AI features 與 robots.txt 文件的適用範圍;nosnippet、max-snippet 和 data-nosnippet 的跨產品行為沒有在本文泛化。沒有指定 URL、HTTP response、正式環境 log 或固定查詢結果時,不能由語法範例推出指令已生效,也不能把 Google 的控制範圍當成其他 AI crawler 的政策。