跳至主要內容
Lizely

Meta Robots 產生器

依據目前 Google 支援的索引與預覽控制,建立一個經過驗證的 robots meta tag 與對應的 X-Robots-Tag 頭部資訊,避免出現矛盾組合。

隱私權:你的檔案不會離開裝置,所有處理均在瀏覽器本機完成。

使用方式

  1. 1.選擇爬蟲目標,並僅選擇與資源政策相符的索引、追蹤與預覽限制。
  2. 2.產生並複製頁面的 HTML meta 元素,或伺服器回應的 X-Robots-Tag 頭部資訊。
  3. 3.部署時需允許爬蟲存取,然後檢視公開來源與標頭,確認無重複或衝突規則,直到重新爬取發生為止。

關於Meta Robots 產生器

Meta Robots Generator 會根據選擇的設定,產生一個頁面層級的 robots meta 元素以及對應的 X-Robots-Tag 響應標頭。選擇該規則針對一般搜尋爬蟲、Googlebot 文字結果或 Googlebot News,僅加入你希望設定的索引與呈現限制。整個產生過程皆為本機執行,輸出內容可複製使用,無需與搜尋服務互動。

針對一般爬蟲的設定,會產生一個名為 robots 的 meta 元素,以及一個無限定的 X-Robots-Tag 頭部資訊。針對 Google 特定的設定,則使用 googlebot 或 googlebot-news 作為 meta 名稱,並在 HTTP 頭部值中加入使用者代理(user agent)字首。Google 對這兩個標籤用於文字與新聞結果有明確說明。其他爬蟲名稱與廠商特定行為則不在本介面的範疇內。

noindex 要求頁面或資源不出現於搜尋結果中;nofollow 要求頁面中的連結不被追蹤。這些是爬蟲指令,並非身份驗證或存取控制。只要知道 URL 的人仍可請求內容,且忽略此規則的爬蟲仍可處理內容。敏感資訊必須透過真實的授權機制來保護,而非僅靠元資料標籤。

nosnippet 要求 Google 不顯示文字摘要或影片預覽。Google 同時說明,此設定會阻止頁面內容被用作 AI 概要或 AI 模式中的直接輸入,但靜態圖片縮圖仍可能出現。若設定數值型的 max-snippet 值,則會限制文字摘要的字數。本工具拒絕同時輸出兩者,因為較嚴格的 nosnippet 設定會使數值選擇失去意義。

max-snippet 接受 -1 或非負整數。Google 定義零等同於無摘要,-1 則表示允許其選擇有效長度。max-video-preview 使用秒為單位,零表示最多僅顯示圖片縮圖(依圖片規則),-1 表示無時間限制。非整數或小於 -1 的值將被拒絕,以免被 Google 忽略。

最大圖片預覽支援已記錄的無、標準與大型設定。無表示不顯示圖片預覽,標準允許使用預設預覽,大型則允許較大預覽,上限為視窗寬度。若發布者透過結構化資料、AMP 關係或授權另行授予特定權限,此限制將被覆蓋,因此產生的字串並非通用內容使用開關。

notranslate 要求 Google 不提供翻譯標題與摘要;noimageindex 要求 Google 不索引頁面中的圖片;indexifembedded 允許內容在透過 iframe 或類似元素嵌入時被索引,即使設定 noindex,Google 也說明此功能僅在搭配 noindex 時才有效。生成器在顯示輸出前會強制確認此依賴關係。

介面刻意省略 noarchive。Google 已將此規則標為歷史性且無效,因為其快取連結功能已不復存在。加入一個熟悉但被忽略的選項會產生錯誤信心。同時也省略 unavailable_after,因為正確的日期時間格式、時區與發布流程需要更多上下文,小而泛用的表單無法正確猜測。

爬蟲必須能取得資源後才能讀取任一形式。若 robots.txt 禁止爬取,Google 可能永遠看不到 noindex 規則,因此 URL 可透過外部連結得知,但頁面內容不會被處理。若要移除可訪問頁面的結果,必須允許爬取並提供此指令,直到搜尋引擎處理完畢。

使用 HTML 元素來設定 HTML 頁面的機器人標籤,用於你控制的標籤語言。對於非 HTML 資源,例如 PDF、圖片或影片,或當回應頭管理更可靠時,請使用 X-Robots-Tag。這個標籤必須由網頁伺服器、應用程式或 CDN 進行設定。將顯示的標籤文字貼到頁面內容中將不會有任何效果。

若存在多個 meta 標籤、HTTP 頭或爬蟲特定宣告之間的衝突,將根據合併限制進行解析,Google 說明較嚴格的規則將適用。請在新增標籤前先檢查現有輸出。CMS、SEO 外掛、反向代理與CDN 都可能加入指令,因此應檢視實際傳遞的 HTML 與實際響應標頭,而非僅依賴編輯器設定。

八個基於來源的測試案例涵蓋所有情境:noindex、組合 noindex 與 nofollow、nosnippet、20 字元文字限制、大尺寸圖片預覽、無限影片預覽以及組合翻譯/圖片控制。負面測試涵蓋無 noindex 情況下的 indexifembedded、帶有數值摘要限制的 nosnippet、錯誤數值與低於檔案規定最小值的情況。

部署後,請讓目標爬蟲可存取該 URL,檢視來源或響應標頭,確認無衝突宣告。搜尋引擎會依照自身爬取排程處理變更,其他引擎對 Google 特定指令的解讀可能不同。本工具僅提供精確語法,無法保證脫索、時間或特定搜尋結果呈現。

方法與來源

輸入的選項集合會依照穩定順序轉換為 Google 檔案中所記載的標籤,數值預覽限制僅接受 -1 或非負整數,nosnippet 與 max-snippet 會衝突,indexifembedded 時必須設定 noindex,相同內容將序列化為 HTML 標記資料加上可選的由爬蟲驗證的 HTTP 標頭。

常見問題

noindex 能保護私人資訊嗎?
不能。這僅是搜尋指令,非存取控制;敏感內容應透過身份驗證與授權來保護。
為何不提供 noarchive 選項?
Google 已將 noarchive 列為歷史性且被忽略的設定,因為快取連結功能已不復存在。
我該選擇 meta 標籤還是 X-Robots-Tag?
對於 HTML 頁面,使用 meta 標籤標記;對於非 HTML 的資源或部署,若使用標頭作為控制通道,則採用 HTTP 標頭。

SEO 與網站管理 使用指南

查看全部