若要取得 llms.txt 檔案,請在本地端產生一份精簡的 Markdown 文件,其中包含策劃過的網站名稱、選擇性的摘要,以及依照 llmstxt.org 提案所描述之順序分組排列的標準連結。最快速的方式是使用一個用戶端表單,序列化一個必要的 H1(內含專案或網站名稱)、一個選擇性的 blockquote 摘要、自由格式的細節,以及零個或多個 H2 區段(內含帶有連結目標的 Markdown 列表項目),完全不需要爬取網域或聯絡外部服務。由於 llms.txt 是一項新興的提案,而非任何爬蟲都必須遵守的指令,其價值來自策劃:挑選語言模型在推論時實際可以使用的標準文件、產品說明、政策以及穩定的參考頁面。同一個工具也接受現有的草稿,並依據文件所述的 Markdown 順序回報具體的逐行問題。內容不會自動發布;你可以複製或下載該檔案、進行驗證,然後自行放置於 /llms.txt。

llms.txt 究竟是什麼
llms.txt 檔案是一份純文字的 Markdown 文件,被提案作為網站最實用資源的精簡、策劃式索引。該格式的實作指引記載於 DeveloperHub 的 llms.txt 實作參考,並於開源的 AnswerDotAI llms-txt 儲存庫 中重現。這個格式刻意保持精簡,以便人與語言模型都能毫無歧義地閱讀。它以一個含有專案或網站名稱的 H1 開頭,後面可選擇性地接著一段 blockquote 摘要,再接著自由格式的非標題細節,最後是零個或多個 H2 區段。每個 H2 包含 Markdown 列表項目,其必要核心是一個連結;冒號與簡短說明可用於解釋連結資源的內容。
該提案保留了一個特定的區段標題——Optional(選擇性)——用於當消費者想要較短上下文時可以略過的次要素材。將資源標示為選擇性是一項編輯決策,工具不會替你做出這項決定。順序很重要,因為解析器以及審閱你檔案的人都預期一個可預測的序列:先 H1,接著是摘要(如有),再來是細節置於任何 H2 連結區段之前,最後才是連結區段本身。生成器會掌控該順序,而非接受可能產生重複頂層標題或錯置區段的任意 Markdown 片段。
為何策劃過的檔案勝過逐頁擷取
一個連結到網站地圖中每一頁的檔案,可能會重複網站地圖本身已造成的過載問題,並可能浪費語言模型的上下文視窗於低價值內容。該提案明確指出,策劃的重要性遠大於篇幅。實用的候選項目包括標準文件、產品說明、政策頁面以及穩定的參考素材。當網站能穩定地提供 Markdown 版本時,會優先採用,但你絕不應虛構會回傳錯誤或產生不可預測重新導向的 .md 網址。
由於該格式精簡且可預測,提案理論上可以手動重現。實務上,為真實網站手動編輯檔案很快就會遇到歧義:H1 應該放哪裡、摘要是否必要、什麼算作重複的網址,以及哪些字元需要跳脫。本地端生成器透過掌控順序、標準化標籤、說明、標題與摘要,消除了這種歧義,使零散的控制字元或意外的 Markdown 分隔符無法破壞輸出。重複的標準化網址會被回報,而不會靜默地增加條目;此外,若草稿缺少必要的 H1,工具會拒絕將其序列化。
如何使用生成器取得 llms.txt
llms.txt 生成器完全在您的瀏覽器中執行,並產生確定性的純文字,您可以將其複製或下載為 llms.txt。其操作步呼應您需要做出的編輯決策。
- 輸入網站或專案名稱。這會成為必要的 H1;若缺少此項,工具會拒絕將草稿序列化。
- 加入選擇性的 blockquote 摘要,以及任何用於說明網站目的、受眾或範圍的非標題細節。
- 僅在明確的 H2 標題下分組收錄標準且高價值的連結。逐一檢視每個網址——工具接受 HTTP 與 HTTPS,但會拒絕含有認證資訊的網址,以及可執行或嵌入資料的協定。
- 生成確定性的 Markdown。檢視 Optional(選擇性)區段的慣例以及每一則說明,以確保沒有任何內容主張它並不具備的權威性。
- 複製或下載檔案,然後在將其發布至 /llms.txt 或適當的子路徑之前,驗證最終編輯過的草稿。
驗證模式與生成是分開的。您可以貼上現有的草稿,工具會檢查必要的 H1、標題順序、連結清單語法、重複的標準化目標以及有界的檔案大小。它會回報具體的問題與警告;它不會重寫您的檔案,也不會存取任何列出的網址。
工具誠實遵守的界線
llms.txt 檔案並非 robots 指令、安全控管、網站地圖的替代品,也不是保證有效的探索協定。發布它並不會強制爬蟲或助理去請求它。它無法授予對被封鎖頁面的存取權、無法覆寫身分驗證、無法將內容從模型訓練中移除,也無法證明 AI 回答會引用該網站。生成器會在其說明中直接表明這項界線,而非暗示採用效果會自動發生。
該工具同樣絕不掃描網域或網站地圖。這項限制是有意的:純粹的用戶端表單無法證明哪些動態頁面是標準的、現行、可存取的,或適合推薦的。您仍須負責挑選來源,並確認每個公開網址都回傳預期的內容。標籤、說明、標題與摘要皆經過標準化,使 Markdown 注入攻擊和控制字元無法破檔案結構;驗證器會回報重複的標準化網址,而非靜默地允許它們增生。
llms.txt 與其他網頁控管的比較
網站上的每種機制各有其用途。下表說明每個產物的官方角色——它們彼此並非替代關係,加入 llms.txt 檔案並不會取代其中任何一項。
| 檔案或機制 | 主要角色 | 它不會做的事 |
|---|---|---|
| llms.txt | 策劃式的 Markdown 概覽與高價值參考的簡短清單,供推論時使用。 | 不會指示爬蟲、無法取代網站地圖,也無法保證被引用。 |
| robots.txt | 為參與的爬蟲表達爬取偏好,包括針對 user-agent 的指定以及允許或不允許的路徑。 | 不會強制執行存取,也不會從任何索引中移除內容。 |
| sitemap.xml | 盤點可供索引的網址,供搜尋探索以及 lastmod 等中繼資料使用。 | 不會進行策劃或摘要;檔案大小並非品質指標。 |
| 結構化資料(JSON-LD、Microdata) | 為搜尋與助理情境中的機器讀取器描述實體與頁面內容。 | 並非推論時的資源地圖,也無法取代可見內容。 |
如果您已維護一份簡潔的 robots.txt,可以使用這份實用的 robots.txt 建立逐步指南,將其決策與您在 llms.txt 中揭露的資源一併檢視,但這兩份檔案解決的是不同的問題。提案本身仍在演進,生成器背後的方法論與來源連結皆為公開可見,您可以在自動化之前再次確認。
驗證、發布與確認檔案
下載之後,請將其視為內容而非機械式的 SEO 產物。確認標題與摘要符合該網站、每個連結都是標準的、說明皆屬事實、選擇性的資源確實為次要內容,且未出現任何私人或測試環境的網址。以純文字或 Markdown 相容的內容類型,將檔案發布至 /llms.txt 或適當的子路徑。
驗證成功僅代表該草稿符合本工具對現行提案的文件化詮釋;並不證明更廣泛的廠商支援。請定期重新檢視該檔案——連結會失效、頁面會搬遷,提案本身也可能改變。請衡量您自己的工具與工作流程是否實際使用了該檔案,而非僅將發布本身視為搜尋或引用改善的證據。