跳至主要內容
Lizely

XML 檔案圖譜產生器

將已審核的頁面 URL 清單轉換為符合標準的 XML 檔案圖譜,無需爬取或上傳網站。

隱私權:你的檔案不會離開裝置,所有處理均在瀏覽器本機完成。

使用方式

  1. 1.每行貼入一個絕對 HTTP 或 HTTPS 頁面 URL,每檔僅限一個主機,包含任何非預設埠。
  2. 2.對於僅限於 loc 的 XML,請將選擇性欄位留空,或應用一個真實的共享 lastmod、changefreq 或 priority。
  3. 3.產生並審查完整的 XML 與統計數值,然後下載 sitemap.xml 以發布至對應網站。

關於XML 檔案圖譜產生器

網站地圖產生器可將你已有的 URL 清單轉換為一個 XML 網站地圖檔案。將每個絕對頁面 URL 一行貼上,可選擇提供一個共用的最後修改時間、更新頻率或優先順序,並產生 sitemap.xml。這個工具會驗證完整請求、規範 、移除重複專案同時保留首次出現順序、轉義 XML 資料、顯示完成的 XML,並準備本機下載。所有解析與檔案建立動作都在當前瀏覽器分頁中進行。 與產生的 XML 不會上傳。這是一個清單轉 XML 的工具,不是爬蟲。它不會訪問頁面、追蹤連結、檢查 canonical 標籤、讀取修改日期、發現轉址、驗證 HTTP 狀態、判斷是否可索引,或將結果提交至搜尋引擎。產生的檔案準確度僅取決於提供的 與可選元資料。在釋出前請檢查轉址、重複內容、被阻擋頁面、私有頁面與遺失頁面。每一行非空白內容都必須是絕對 HTTP 或 HTTPS URL。裸露的網域、相對路徑、FTP 網址、原始空白字元、控制字元、格式錯誤的百分比轉義、嵌入憑證與片段會被拒絕。 非空白行若有前置或尾端空白會視為錯誤,不會自動修剪;只含空白的行則會忽略。系統會拒絕認證資訊,避免使用者名稱或密碼被複製到公開 sitemap。片段不會隨 HTTP 請求傳送至伺服器,也不應讓同一個擷取資源產生多筆 sitemap 項目,因此會被拒絕。有效 URL 會先由瀏覽器 URL 解析器序列化,再去除重複項目並輸出。此過程會將主機名稱轉為小寫、移除預設連接埠、視需要補上根路徑斜線,並對非 ASCII 網址元件進行百分比編碼;既有的有效百分比逸出仍會維持 URL 逸出形式。每個產生的檔案僅限一個序列化主機,包含任何非預設連接埠,這符合 Sitemap 通訊協定的單一主機規則。同一主機的 HTTP 與 HTTPS 網址可放在同一個檔案中;比較主機時不會誤把通訊協定視為主機的一部分。非預設連接埠屬於序列化主機,因此混用 example.com 與 example.com:8443 會失敗。產生器無法驗證 sitemap 將託管於何處,也無法確認是否具備跨網站提交權限。去除重複項目會在 URL 序列化之後進行。 大寫主機與其小寫形式識別為相同的 URL,明確預設埠與其標準形式亦同。首次出現決定輸出順序,後續出現則會增加重複計數。無效行從不被跳過,過多有效 也從不被靜默刪除。XML 開始於 UTF-8 宣告與使用官方 http://www.sitemaps.org/schemas/sitemap/0.9 名稱空間的 urlset 元素。每個專案包含 url 與 loc。位置在 URL 正規化後使用 XML 進行轉義。與號、單引號、雙引號、大於號與小於號使用 XML 進行轉換,與號會先被轉換,以避免產生的轉換碼被再次轉義。選項欄位預設為省略。若提供值,則會應用於每個 URL。最後修改日期可接受真實格里曆的 YYYY-MM-DD 日期或包含秒數與 Z 或有效 UTC 偏移量的完整日期時間。曆曆日期、閏年、時鐘欄位與時區限制會被檢查。前導或後導空白字元會被拒絕而非移除。僅在頁面有實際重大修改時使用 lastmod,且僅在所有專案共享同一真實值時使用。 變更頻率可接受 always、hourly、daily、weekly、monthly、yearly 或 never。優先順序可接受 0.0 到 1.0 的十進位值。這些都是通訊協定提示,不是檢索指令或排名保證。任何無效的選填中繼資料都會使整次產生失敗。通訊協定規定每個 loc 必須少於 2,048 個字元、最多可有 50,000 個網址,且未壓縮大小最多為 52,428,800 位元組。這個互動式瀏覽器工具刻意採用較低的整體檔案預算:10,000 個不重複網址、5,000,000 個 UTF-16 輸入碼元,以及 10,485,760 位元組的 UTF-8 XML。正規化後的位置最多可包含 2,047 個字元。較低的限制用來約束解析、預覽、Blob 與瀏覽器記憶體,不會假裝它們是通訊協定上限。每項限制都採全有或全無原則:達到上限的最後一個不重複 URL 可接受,下一個不重複 URL 就會失敗;重複行不會占用輸出名額。XML 大小是在完成 URL 序列化、XML 逸出、選填標籤、縮排及 UTF-8 編碼後測量。恰好 10,485,760 位元組可接受,多一個位元組即拒絕。不會傳回縮短的 XML、刪節號、截斷預覽或部分下載。下載使用由目前結果持有的暫時 Object URL。 編輯網址或任何選項時,系統會立即撤銷目前的下載並清除舊 XML、下載與錯誤。再次產生時,會先撤銷前一次下載,再執行驗證。Blob 或 Object URL 建立失敗時不會留下過期結果;卸載元件時也會撤銷目前的 URL。測試涵蓋源自通訊協定的正規化基準、認證資訊與片段、跨配置與連接埠的單一主機行為、XML 實體、選填中繼資料、去除重複項目的順序、URL 長度、恰好達到及超過 URL 數量限制、恰好達到及超過 UTF-8 預算,以及明確的禁止截斷失敗。此產生器不會建立 sitemap 索引、圖片、影片或新聞擴充、hreflang 標記、gzip 檔案、robots.txt 規則,也不會提交至 Search Console。

方法與來源

將換行符(LF、CRLF 或 CR)輸入分割為獨立行,並忽略僅含空白字元的行。對非空行的首尾空白字元進行清除,拒絕原始控制字元、錯誤的百分比轉義、憑證、片段、非絕對路徑輸入,以及非 HTTP 或 HTTPS 的協定。針對每項接受的 URL 檔案,使用 WHATWG 瀏覽器 URL 解析器進行序列化,強制序列化字元數量少於 2,048,且必須包含一個主機名稱(含非預設埠),並允許該主機使用 HTTP 或 HTTPS。依首次出現順序去重 href 連結。驗證真實的 lastmod 日期與時區值、七種 changefreq 值以及 priority(從 0.0 至 1.0)內容,不得預設裁減。轉義五個 XML 特殊字元,並輸出符合規範的 UTF-8 urlset。使用 TextEncoder 量測最終 XML 的大小,僅接受恰好 10,485,760 位元組的內容,拒絕多出一位元組。輸出結果最多限制為 10,000 個唯一 ,不進行截斷。測試涵蓋外部協定連結以及所有明確的邊界情境。

常見問題

這個工具會爬取我的網站來找出 URL 嗎?
不會。它僅轉換貼入編輯器中的 URL。它不會請求頁面、追蹤連結、檢查標準標籤、驗證狀態碼,或提交圖譜。
為何拒絕憑證與片段?
憑證不應出現在圖譜位置中。URL 片段不會作為 HTTP 請求的一部分傳送至伺服器,也不應為單一取得資源產生多個圖譜條目。
HTTP 與 HTTPS URL 可以同時出現嗎?
可以,只要其序列化主機(含任何非預設埠)相同。協議規則為單一主機,而非單一來源。不同主機或非預設埠需分開檔案。
為何工具限制低於協議最大值?
協議允許 50,000 URL 與 52,428,800 位元組,而此瀏覽器工具使用 10,000 URL 與 10 MiB 來限制預覽與 Blob 記憶體。若超出限制將直接失敗,不會截斷。

SEO 與網站管理 使用指南

查看全部