當 ChatGPT、Perplexity 與 Google AI Overviews 開始參與使用者的搜尋行為,網站內容不只要被搜尋引擎理解,也要更容易被大型語言模型讀取與引用。llms.txt 正是在這個背景下出現的新型網站檔案。本文說明它的用途、格式、與現有檔案的差異,以及台灣中小企業該不該投入。
本篇目錄
llms.txt 是什麼?
llms.txt 是一個提供給大型語言模型與 AI Agent 參考的網站摘要檔案,通常放在網站根目錄,例如 https://example.com/llms.txt。它以 Markdown 撰寫,內容多半包含網站名稱、簡短說明、重點頁面、文件連結與政策頁面。
換句話說,它整理的是 AI 在理解一個網站時,應該優先讀取的那一小批資料,而不是網站的全部內容。
這份提案由 Answer.AI(同時也是 fast.ai)共同創辦人 Jeremy Howard 提出,目標是讓網站提供一個更適合 LLM 在推論階段使用的資訊入口。官方提案文件指出,它的用途是提供背景資訊、指引,以及連向詳細 Markdown 文件的連結。
所以 llms.txt 不是寫給一般使用者看的行銷頁,也不是要取代網站導覽列,而是幫 AI 快速建立「這個網站重點在哪裡」的判斷依據。
llms.txt 是網站提供給 AI 模型閱讀的內容地圖,用來整理網站定位、重要頁面與可引用資訊。
這種一句話定義特別適合放進 AEO 內容,因為它不需要額外上下文就能被理解,AI 摘要時也不容易失真。
不過要先強調:llms.txt 目前仍屬於社群提案的新興慣例,不是正式標準,也不是排名因素,更不保證 AI 一定會讀取它。
llms.txt 為什麼會出現?
llms.txt 會出現,主要是因為大型語言模型讀網站的方式,和傳統搜尋引擎不完全相同。
搜尋引擎可以透過長期爬取、索引與排名系統來理解網站;但 AI Agent 或具備搜尋能力的聊天機器人在回答問題時,往往需要在有限的上下文裡,快速找到可用、可信、精簡的內容來源。
提案也指出,複雜的 HTML、JavaScript、廣告、導覽列與大量頁面內容,會讓 LLM 難以直接取得乾淨且有上下文的資訊。
AI 需要的是整理後的重點,不是整站資料
llms.txt 的核心價值不是列出所有網址,而是挑出最值得 AI 讀取的內容。以一個 SaaS 網站為例,站內可能有上百篇部落格文章,但 AI 在回答產品支援哪些功能時,真正需要讀的其實只有幾頁。
那幾頁通常是產品總覽、功能說明、API 文件、定價頁與常見問題,而不是活動公告或促銷文章。
網站內容越複雜,越需要清楚的 AI 入口
對大型網站來說,內容分散在不同分類、語言版本與頁面模板中。llms.txt 可以把「最能代表網站」的內容集中列出,降低 AI 抓錯頁面、引用過期資訊或忽略核心頁面的機率。
這不代表 llms.txt 能控制 AI 如何回答,它只是提供一個更清楚的內容入口,讓模型少走冤枉路。
llms.txt 和 robots.txt、sitemap.xml 有什麼不同?
很多人會把 llms.txt 誤解成 AI 版的 robots.txt,但這個說法並不準確。robots.txt 是用來管理爬蟲可以存取哪些網址;llms.txt 則是用來告訴 AI 哪些內容最值得理解。
Google 官方文件也說明,robots.txt 主要用於管理搜尋引擎爬蟲能否存取網站 URL,它並不是讓頁面完全不出現在 Google 的安全機制。
| 檔案 | 主要用途 | 給誰看 | 重點 |
|---|---|---|---|
| robots.txt | 管理爬蟲可否存取特定路徑 | 搜尋引擎與爬蟲 | 控制存取權限 |
| sitemap.xml | 列出網站可索引頁面 | 搜尋引擎 | 幫助發現網址 |
| llms.txt | 整理網站重點與 AI 可讀內容 | LLM、AI Agent、AI 搜尋工具 | 提供內容脈絡與重點連結 |
llms.txt 不能取代 robots.txt
robots.txt 負責哪些地方可以爬,llms.txt 負責哪些內容值得讀,兩者任務不同,不應互相取代。
實務上,OpenAI 的爬蟲文件目前也是以 robots.txt 說明站長如何管理 OAI-SearchBot 與 GPTBot 的存取設定,而不是以 llms.txt 作為存取控制依據。
llms.txt 也不能取代 sitemap.xml
sitemap.xml 通常列出網站可索引頁面,但它不負責解釋哪些頁面最重要,也不會說明這個網站的核心產品、品牌定位與政策應該怎麼理解。
llms.txt 的提案也明確指出,它是設計來與現有標準共存,而不是取代 sitemap.xml 或 robots.txt。三者並存才是正常狀態。
llms.txt 對 SEO 和 AEO 有幫助嗎?
這一點很重要,要先把話說清楚:llms.txt 目前不能保證提升 Google 排名,也不能保證讓品牌出現在 AI 回答中。
它仍是新興慣例,不是 Google 搜尋公開確認的排名項目,也不是所有 AI 平台都正式承諾會讀取的標準。
值得注意的是,Google 內部不同團隊的訊號目前是分開的,理解這一點能避免誤判。Google Search 官方已明確指出:要出現在 AI Overviews、AI Mode 等生成式 AI 搜尋功能中,您不需要額外建立 llms.txt 或特殊機器可讀檔案。
後續的補充說明更直接:您要為其他服務維護這類檔案完全沒問題,但它不會提升、也不會傷害您在 Google 搜尋的能見度與排名,因為 Google 搜尋會忽略它。
另一邊,Google Chrome 的 Lighthouse 工具,卻在 agentic browsing 稽核類別中加入了 llms.txt 檢查。兩邊看似矛盾,其實是因為衡量的事情不同:一個是搜尋能見度,一個是瀏覽器代理操作網站的就緒度。
對 SEO 的可能價值
llms.txt 對傳統 SEO 的直接效果有限,但它可以促使網站重新整理內容架構。當您動手建立這份檔案時,必須先回答幾個問題:
- 網站最重要的頁面是哪些?
- 哪些內容最能代表品牌專業?
- 哪些頁面提供最完整、最新、可信的資訊?
- 哪些內容應該被 AI 優先理解?
這些問題本身就與 SEO 內容策略高度相關。即使 AI 不一定讀取這份檔案,整理的過程也能幫您檢查內容是否清楚、重點頁是否完整、資訊架構是否混亂。
如果您想先把這層內容架構打好底,可以參考新視野 SEO 教學指南建立基本盤。
對 AEO 的可能價值
AEO 的核心是讓答案更容易被 AI 搜尋工具理解、摘要與引用。llms.txt 可以把網站中最適合被引用的內容集中整理,例如教學文件、產品規格、服務說明、FAQ 與案例研究。
對 AI 來說,這比在整個網站中自行猜測重點更有效率,也比較不會把促銷頁誤認成核心說明。
在工具支援面,Chrome Lighthouse 已將 llms.txt 納入 agentic browsing 相關稽核,並說明它是提供給 LLM 與 AI Agent 的機器可讀網站摘要。
不過 Lighthouse 同時指出,當網站沒有提供這個檔案(回傳 404)時,稽核結果會標示為不適用(N/A),因為它仍是選用項目,缺少並不會被視為扣分。
實際被讀取的比例仍然偏低
談完可能性,也要看實際狀況。一份涵蓋約 137,000 個網域的伺服器日誌研究指出,其中約 97% 的 llms.txt 檔案,在單月內完全沒有被請求過。
請求來源的結構更值得注意:真正回答使用者問題的 AI 助理,只佔全部請求的百分之一左右,反而 SEO 稽核工具佔了約兩成。多數檔案目前是被檢測工具讀走,不是被 AI 讀走。
另有研究比對數萬個曾被 AI 引用的網域,發現有無 llms.txt 的引用次數幾乎沒有差別,統計上看不出優勢。
哪些網站適合建立 llms.txt?
不是所有網站都急著需要 llms.txt。判斷重點不是別人有沒有做,而是您的網站是否有明確資訊需要 AI 正確理解。
從目前的採用情況也能看出方向:一份針對約 300,000 個網域的調查顯示,建立 llms.txt 的網站僅約一成;另一份針對美國大型企業的研究,比例更低到不足一成,但同一批公司有九成以上都有 robots.txt。
採用族群也高度集中在開發者工具與技術平台,例如基礎建設型的雲端與金流服務;金融、醫療、法律這類受規範產業則相對罕見。
適合建立 llms.txt 的網站類型
| 網站類型 | 建議原因 |
|---|---|
| SaaS 與軟體產品網站 | 功能、定價、API、文件通常需要被精準理解 |
| 技術文件網站 | AI 常被用來查文件、寫程式、比對 API 用法 |
| 電商網站 | 可整理產品分類、退換貨政策、配送規則與品牌資訊 |
| 專業服務網站 | 可集中說明服務範圍、流程、案例與適合客群 |
| 教育與課程網站 | 可整理課程架構、適合對象、學習路徑與報名資訊 |
| 媒體與知識型網站 | 可整理主題分類、權威文章與常見引用頁面 |
| 多語系網站 | 可降低 AI 抓錯語言版本或混淆地區資訊的風險 |
不一定需要優先做的網站
如果網站只有少量頁面、內容更新很少,或目前沒有經營 AI 搜尋可見度的需求,llms.txt 可以排在較後面。
這類網站更應該先處理基本 SEO,例如頁面標題、內容品質、內部連結、結構化資料與 sitemap.xml。
llms.txt 應該放哪些內容?
一份好的 llms.txt 不應該只是把網站所有連結貼上去。它需要經過篩選,讓 AI 能快速判斷哪些內容最重要。
網站名稱與一句話定位
開頭應該用 H1 寫出網站或品牌名稱,接著用簡短摘要說明網站提供什麼。依照目前的提案格式,H1 是唯一必要的區塊,摘要則通常以 blockquote 呈現。
這段內容要避免寫得像廣告標語。AI 需要的是清楚描述,不是最強、第一、顛覆市場這類難以驗證的說法。提案也特別提醒:H1 要寫的是網站或專案名稱,而不是行銷口號。
核心頁面連結
核心頁面是最能代表網站主題與價值的頁面,例如產品總覽、服務介紹、定價方案、使用案例、API 文件、退換貨政策、常見問題與聯絡方式。
每個連結後面最好加上簡短描述,讓 AI 不只看到 URL,也知道該頁面的用途與適合回答哪類問題。
權威內容與可引用資料
若網站有研究報告、白皮書、教學指南、產業分析或資料頁,應該優先放入。這類內容通常比一般部落格文章更適合被 AI 引用,也比較不會過期。
更新頻率高的內容要謹慎放入
促銷活動、限時優惠、短期公告與新聞稿如果放進 llms.txt,可能需要頻繁維護。若沒有自動更新機制,建議只放長期有效的頁面,避免 AI 讀到過期資訊。
llms.txt 範例格式
先看基本結構骨架。整體就是:一個 H1 網站名稱、一段 blockquote 摘要、可選的補充說明,再用 H2 分區列出連結,每個連結後面接一個冒號與簡短說明。
# 網站或品牌名稱 > 一到兩句話的網站摘要,說明這是什麼網站、服務誰。 這裡可以放補充說明文字(不使用標題),協助 AI 理解內容。 ## Section name - [連結標題](https://example.com/page): 這個頁面提供什麼資訊。 ## Optional - [延伸閱讀](https://example.com/extra): 次要資訊,上下文有限時可略過。
這裡有一個容易被忽略的實作細節:連結一定要用 Markdown 語法寫。Lighthouse 的稽核是把檔案內容當成 Markdown 解析,直接貼裸網址不會被算成連結,實務上已有網站因此被判定為沒有任何連結。
以下是一個適合企業網站使用的較完整範例:
# Example Digital Agency > Example Digital Agency 是一家提供 SEO、網站設計、內容行銷與 AI 搜尋優化服務的數位顧問公司,主要服務中小企業與 B2B 品牌。 本網站內容以網站成長、搜尋能見度、內容策略與轉換率優化為主。若需要理解本公司的服務範圍,請優先參考 Services、Case Studies 與 Guides 區塊。 ## Services - [SEO 顧問服務](https://example.com/seo-service): 說明 SEO 技術健檢、關鍵字策略、內容規劃與成效追蹤方式。 - [網站設計服務](https://example.com/website-design): 說明企業網站、形象網站與行銷型網站的規劃流程。 - [AI 搜尋優化服務](https://example.com/ai-search-optimization): 說明 AEO、GEO 與 AI 引用優化的服務內容。 ## Guides - [SEO 是什麼](https://example.com/blog/what-is-seo): 適合初學者理解 SEO 基礎概念與執行流程。 - [AEO 是什麼](https://example.com/blog/what-is-aeo): 說明如何讓內容更容易被 AI 搜尋工具摘要與引用。 - [網站架構規劃指南](https://example.com/blog/website-structure): 說明網站分類、內部連結與內容層級設計。 ## Case Studies - [B2B 官網 SEO 成長案例](https://example.com/case/b2b-seo): 說明如何透過內容架構與技術 SEO 提升詢問量。 - [電商網站內容優化案例](https://example.com/case/ecommerce-content): 說明商品分類頁與購物指南如何改善自然流量。 ## Optional - [公司部落格](https://example.com/blog): 收錄所有文章,涵蓋 SEO、網站設計、內容行銷與 AI 搜尋趨勢。 - [聯絡我們](https://example.com/contact): 提供合作詢問與專案諮詢方式。
Optional 區塊的用途
Optional 區塊可放入次要資訊。根據提案,這個區塊具有特殊意義:表示在需要較短上下文時,這些 URL 可以被略過。
因此不建議把最重要的產品頁、服務頁或文件頁放在 Optional,它比較適合放總覽型頁面、輔助說明或延伸閱讀。
llms.txt,部分大型文件網站還會額外提供 llms-full.txt,把重點頁面的完整內容彙整成一個檔案,讓 AI 一次讀完整份知識庫。核心的 llms.txt 維持輕量、以連結為主;llms-full.txt 則用體積換取完整度,內容量大的技術文件網站才比較需要。
建立 llms.txt 的實作流程
下面把建立 llms.txt 拆成五個可執行步驟:
- 盤點網站最重要的內容 先不要急著開檔案。第一步應該是盤點網站內容,選出最能代表網站價值的頁面。判斷標準可以包含:這個頁面是否能清楚說明品牌或產品?是否提供可被引用的資訊?是否長期有效?AI 讀到後是否更容易正確回答使用者問題?
- 依照使用情境分區 llms.txt 不應該只是一串連結,而應該依用途分區,例如 Products、Services、Documentation、Pricing、Policies、Guides、Case Studies、FAQ 與 Optional。這樣能讓 AI 快速判斷每個區塊的資訊用途,而不是在沒有脈絡的連結清單中猜測。
-
為每個連結補上描述
每個連結後面建議加上一句說明,清楚指出頁面內容,不要只寫了解更多。
不佳:
[SEO 服務](https://example.com/seo): 點此了解更多。較佳:[SEO 服務](https://example.com/seo): 說明技術 SEO、內容策略、關鍵字規劃與每月成效追蹤方式。 -
上傳到網站根目錄
完成後,將檔案放在網站根目錄,例如
https://yourdomain.com/llms.txt,並確認它以純文字形式回傳、狀態碼為 200、內容是有效的 Markdown。若網站有多語系,可以視情況建立不同語言版本,並在主檔案中清楚標示語言與地區對應頁面。 - 定期維護 llms.txt 不是寫完就不用管的檔案。當網站新增重要服務、調整價格、重寫文件、修改品牌定位或更換重要頁面 URL 時,都應該同步更新。若檔案內容長期過期,反而可能讓 AI 取得錯誤脈絡。
常見錯誤與注意事項
- 把 llms.txt 當成排名保證 llms.txt 不是 SEO 捷徑,不能保證搜尋排名上升,也不能保證 AI Overviews 或 ChatGPT 一定引用您的網站。正確心態是把它當成 AI 可讀性優化的一部分,搭配高品質內容、結構化資料、清楚網站架構與良好內部連結一起處理。
- 放入太多不重要連結 llms.txt 的重點是精選,不是完整收錄。若把所有分類頁、標籤頁、活動頁和低品質文章全部放進去,AI 仍需自行判斷重點,檔案價值就會下降。實務上建議控制在約十到四十個連結之間。
- 內容描述太模糊 這是我們的服務頁、這是產品介紹,這類描述資訊量不足。好的描述應該說明頁面提供什麼資訊,以及適合回答哪類問題,讓 AI 不必自行推測。
- 與網站實際內容不一致 llms.txt 只能整理已存在的內容,不能替網站創造不存在的專業性。如果檔案宣稱網站提供某項服務,但站內沒有清楚頁面支撐,反而會造成資訊不一致。另外也要避免連結指向 404 或錯誤轉址,AI 一旦讀到死連結,可能降低對整份檔案的信任。
- 忽略敏感資訊 不要在 llms.txt 放入不希望被廣泛讀取或引用的資料,例如內部文件、未公開價格、客戶個資、商業機密或需要登入才能看的內容。這份檔案是公開的,任何人都能直接開啟。
結論:llms.txt 值得做,但不要神化它
llms.txt 是 AI 搜尋時代下值得關注的新興網站檔案。它的用途不是控制爬蟲,也不是保證排名,而是用更清楚、精簡、可機器讀取的方式,幫助 AI 理解網站的核心內容。
對內容量較大、資訊較複雜、需要被 AI 正確理解的網站來說,建立這份檔案的成本不高,卻能順便整理內容架構、確認核心頁面與強化 AEO 思維。
如果您正在評估要不要做,可以先用幾個問題自我檢查:
- 您的網站是否有大量、複雜、需要被 AI 正確理解的內容?
- 網站本身的內容品質、架構、FAQ 與結構化資料是否已經做好?
- 您是否能持續維護這份檔案,確保它與網站實際內容一致?
最實務的做法是:先把網站本身的內容品質、架構、FAQ、結構化資料與 sitemap 做好,再用 llms.txt 補上一份給 AI 看的重點地圖。
若想把基礎 SEO 與內容架構一次補齊,可以延伸閱讀新視野 SEO 教學指南。
延伸閱讀
- 想掌握 AI 搜尋帶來的整體變化,可參考AI 時代的 SEO 轉型。
- 容易混淆的名詞,可參考GEO(生成式引擎優化),以及一次看懂SEO、AEO、GEO 的差別。