llms.txt 檔案是一份簡短、純文字的 Markdown 文件,放在網站根目錄,向語言模型提供可預期的摘要,說明您是誰,以及權威頁面位於何處。llmstxt.org 所提出的格式圍繞著單一必要的 H1 標題建立,內容為專案或網站名稱,後面接著一個選擇性的引用區塊摘要、選擇性的自由格式細節,以及零個或多個 H2 區段,用以分組 Markdown 連結到最有用的資源。由於該文件需同時供語言模型和一般解析器閱讀,這些部分的順序是固定的:H1 標題行在最前面,引用區塊摘要接在後面(若有),自由格式細節出現在 H2 連結區段之前,而一個名為 Optional 的 H2 則標記可讓消費者在較短推理時略過的次要內容。若要產生 llms.txt 檔案,您可以使用本機瀏覽器工具,從您輸入的內容以確定的方式序列化這些區段,然後依據文件規定的順序驗證草稿,而無需將資料傳送到任何地方或對您的網域進行爬取。

how to generate llm txt
如何在發布前產生 llms.txt 並進行驗證

llms.txt 提案實際上要求的內容

llms.txt 提案記載於 llmstxt.org,並維護於 AnswerDotAI llms-txt 參考儲存庫,其將該檔案視為一份小型 Markdown 索引,而非組態指令。其結構規則刻意嚴格,因為解析器必須確切知道標題在哪裡結束、摘要從哪裡開始、自由格式細節在哪裡停止,以及每個連結區段從哪裡開始。llms.txt 產生器 已將這些規則編碼進去,因此您無須背誦它們,且手動編輯的檔案也不會意外產生重複的頂層標題或位置錯置的區段。

完整必要的順序整理如下。

位置元素是否必要用途
1包含專案或網站名稱的 H1 行單一文件標題;僅允許出現一次
2引用區塊摘要(以 > 開頭的行)簡短說明專案的段落
3自由格式 Markdown 細節(不含標題)在任何連結清單之前的延伸背景說明
4 以上H2 區段,每個區段後接 Markdown 清單項目分組連結至權威資源
最後名為「Optional」的 H2,包含次要連結可在較短情境下略過的資源

H2 下方的每個清單項目都必須是 Markdown 連結,其必要的核心為 URL。連結後可接選擇性的冒號與說明,解釋該資源的內容。該提案不允許可執行的配置、嵌入式資料 URI 或帶有憑證的 URL,因此遵循此格式的產生器會在序列化之前拒絕這類輸入,並回報重複的標準化 URL,而非默默產生多筆項目。

為何雙模式產生器勝過手寫的 Markdown

大多數嘗試手寫 llms.txt 的人都會遇到同樣的三個問題:重複的頂層標題、區段順序錯誤,以及在說明包含冒號或雜散控制字元時 Markdown 失效。手動編輯的檔案在預覽中可能看似正確,但在更嚴格的解析器讀取時就會失敗。雙模式的本機工具將撰寫工作分為兩個明確界定的步驟,讓每個步驟都有單一、可審閱的結果。

在產生模式下,工具接收一組明確的小型輸入(網站名稱、選擇性摘要、選擇性細節,以及分組連結),並序列化為確定性的 Markdown 文件。標籤、說明、標題與摘要皆經標準化,使意外的 Markdown 分隔符號不會破壞產生的結構。在驗證模式下,同一個工具接受貼上的草稿,並回報具體的逐行問題,例如缺少 H1、H2 置於細節區塊之上、清單項目缺少必要的連結核心、重複的標準化目標,或超過大小限制的檔案。

這種區隔很重要,因為 llms.txt 是一項新興的提案,而非強制標準。DeveloperHub llms.txt 實作文件 追蹤現實世界的採用情況,而提案本身也可能演進。擁有自己對目前格式詮釋的本機產生器可提供已知的起點,而驗證器則讓您能在檔案離開本機之前,確認您編輯過的草稿符合該詮釋。

逐步產生 llms.txt

若要產生符合文件規定順序的 llms.txt 檔案,請依序在 llms.txt 產生器中執行以下步驟。一切都在您的瀏覽器中本機進行;不會上傳任何內容,也不會進行任何爬取。

  1. 輸入專案或網站名稱。這將成為單一的 H1 行,且必須在檔案最頂端恰好出現一次。
  2. 新增選擇性的引用區塊摘要。一兩行以 > 開頭的內容,即足以描述該網站是什麼,以及其服務對象。
  3. 新增選擇性的非標題細節。純文字段落或簡短的 Markdown(不含 H2 或 H3 標題)可置於摘要與連結區段之間,提供額外背景說明。
  4. 建立 H2 區段,僅新增權威且高價值的連結。每個區段標題為 H2,其下項目為 Markdown 連結。僅在說明確實有用時,才在 URL 後加上冒號與說明。
  5. 產生確定性的 Markdown。工具會以固定順序序列化文件、標準化控制字元,並回報重複的標準化 URL,而非默默產生多筆項目。
  6. 審閱 Optional 區段與每一則說明。確認置於名為 Optional 的 H2 之下的連結確實為次要內容,並可在消費者想要較短情境時予以略過。
  7. 複製或下載 llms.txt。下載的檔案命名為 llms.txt,內容為純文字;若需要進行小幅編輯調整,請將其複製到您的編輯器中。

若您的工作流程是從既有的草稿而非空白表單開始,可直接跳至下一節所述的驗證路徑。

在發布前驗證草稿

驗證與產生是分開的階段。將最終編輯完成的 Markdown 貼入驗證器,並仔細閱讀每一則回報,而非將警告視為單純的外觀問題。驗證器會逐行檢查文件,並凸顯具體的問題,但不會重寫該檔案、不會存取任何列出的 URL,也不會聲明連結資源是正確的。

檢查項目驗證器檢視的內容為何重要
必要 H1恰好一個包含網站名稱的頂層標題多個或缺少 H1 行會破壞解析器合約
標題順序摘要在細節之前、細節在任何 H2 區段之前重新排序會破壞語言模型的可預期解析
連結語法H2 下的每個清單項目皆以 Markdown 連結開頭純文字清單項目違反連結清單的規定
重複的 URL不得有兩個清單項目指向相同的標準化目標默默重複會浪費消費者的情境
URL 安全性不得包含憑證、可執行的配置或嵌入式資料 URI不安全的 URL 可能洩漏機密或觸發處理程序
大小限制總位元組長度在合理範圍內呼應提案策展式概覽的精神

成功的驗證執行代表草稿符合此工具對目前提案的文件化詮釋。它並不保證更廣泛的供應商支援,也不保證任何爬取器或助理實際上會請求或引用該檔案。

產生器不會做的事

此工具刻意不做以下幾件事,這對安全地使用它至關重要。它不會爬取您的網域、擷取您的 sitemap,或掃描您的頁面,因為純用戶端的表單無法證明哪些動態頁面是權威的、最新的、可存取的,或是值得推薦的。它不會捏造您網站實際上未提供的 .md URL,也不會在您不知情的情況下重寫既有的草稿。若您需要尚未存在的頁面 Markdown 版本,請先撰寫或轉換它們。

此工具亦不對結果做任何承諾。llms.txt 不是 robots 指令、安全控制、sitemap 替代品,也不是保證有效的探索通訊協定。發布該檔案並不會強制爬取器或助理請求它,無法授予對封鎖頁面的存取權、無法覆寫驗證機制、無法從模型訓練中移除內容,也無法證明 AI 回答會引用該網站。請將此檔案視為策展式的推論時期資源地圖,並實際衡量您自己的工具和工作流程是否使用它,而非僅以發布本身作為搜尋或引用改善的證據。

如需特別強調無爬取特性的逐步說明,請參閱 如何在不爬取網站的情況下產生 llms.txt 一文。

llms.txt 如何與 robots.txt 和 sitemap.xml 並存

llms.txt 是網站可能發布的多個機制層級檔案之一,每個機制各有其用途。將這四種格式視為相互競爭的選項,會掩蓋一個事實:它們其實在回答不同的問題——誰被允許爬取、哪些 URL 存在、頁面的內容為何,以及模型在形成答案時應優先參考哪些資料。

檔案格式對象用途
robots.txt純文字指令參與的爬取器為特定使用者代理程式表達爬取偏好
sitemap.xmlXML URL 集合搜尋引擎盤點可供搜尋探索的索引 URL
結構化資料(JSON-LD / Microdata)嵌入式標記搜尋與 AI 系統描述實體與頁面內容供解析
llms.txt策展式 Markdown 索引語言模型與人類提供簡短概覽與高價值參考資料,供推論時期使用

robots.txt 表達偏好,sitemap.xml 盤點 URL,結構化資料描述頁面的內容,llms.txt 則策展一組小量且高價值的參考資料。一份列出大型網站每個頁面的冗長檔案,可能會重蹈大型 sitemap 的過載問題,並浪費消費者的情境,因此策展比長度更重要。請優先採用權威文件、產品說明、政策與穩定的參考頁面,並在網站能穩定提供 Markdown 版本時加以連結。如需以順序為重點的逐步說明,請參閱 以正確順序為網站產生 llms.txt 一文。

發布、驗證,並定期重新檢查

一旦草稿通過驗證,請將檔案發布至 /llms.txt(或適當的子路徑),並使用純文字或相容 Markdown 的內容類型。接後將其視為內容本身,而非機械式的 SEO 產物。請確認標題與摘要與網站相符、所有連結皆為標準網址、註記內容屬實、Optional H2 底下的資源確實屬於次要內容,且最終草稿中未出現任何私密或測試環境的網址。

提案與生態系可能會演進,因此請定期重新檢查所引用的網址,並在建立依賴精確語法的自動化流程之前,重新審視該提案與工具的方法論。請衡量您的內部工具與工作流程是否確實會取用該檔案,而不是僅將發布本身視為搜尋或引用成效改善的證據。