llms.txt 是什麼?格式、實作與效果評估

llms.txt 是 2024 年由社群提出的檔案格式提案,用一份精簡的 Markdown 讓 AI 系統快速理解網站結構與重點內容。本站有部署它,但我們要先把話說在前面:Google 已表明不使用 llms.txt,它不是收錄或引用的門票。這篇文章教你怎麼做,也告訴你該對它抱多少期待。

本文章節

  • · 由來與定位
  • · 格式規範
  • · 本站實作方式
  • · 效果的誠實評估
  • · 該不該部署
  • · 部署後驗證

llms.txt 從哪來?定位是什麼?

llms.txt 由 Answer.AI 的 Jeremy Howard 在 2024 年 9 月提出,動機很實際:網頁塞滿導覽、廣告與腳本,對上下文長度有限的語言模型不友善,不如提供一份乾淨的 Markdown 摘要,列出網站是什麼、重點頁面在哪。要注意它的身分:這是社群提案,不是任何搜尋引擎或 AI 平台的官方標準——這個定位決定了你該投資多少心力在上面。

格式長什麼樣?

規範刻意簡單,就是一份放在網站根目錄的 Markdown 檔。結構依序是:H1 寫網站名稱、引言區塊(blockquote)寫一段網站摘要、之後用 H2 分區放連結清單,每個連結附一句說明。另外有一個選配的 llms-full.txt,直接放入完整的頁面內容,給願意讀長文件的系統使用。兩個檔案都以純文字回應,不需要任何特殊標頭。

  • H1:網站或專案名稱(必要)
  • Blockquote:一段話的網站摘要
  • H2 區塊:分類的連結清單,每條附說明
  • llms-full.txt(選配):完整內容的展開版本

本站的實作:動態生成,不手寫

我們在 Next.js App Router 用 Route Handler 提供 /llms.txt 與 /llms-full.txt,內容不是手寫的靜態檔,而是從跟網頁同一份資料層(服務、案例、價格的 TypeScript 內容檔)動態組出來,並以 force-static 在建置時輸出。這個設計解決了手寫檔案最大的問題:內容漂移。價格改了、服務改了,llms.txt 在下次建置自動同步,不會出現網頁說一套、llms.txt 說另一套的情況——對 AI 系統輸出過期資訊,比沒有這個檔案更糟。

效果的誠實評估:Google 不用它

這是多數教學不會告訴你的部分。Google 官方文件明確說明 AI 功能沒有額外的技術門檻,搜尋團隊成員也公開表示不使用 llms.txt;其他 AI 平台是否讀取、讀了是否影響引用,目前都沒有官方承諾。我們檢視自己的伺服器紀錄,能看到部分 AI 爬蟲抓取過這兩個檔案,但「被抓取」與「影響引用」是兩件事,後者無法驗證。所以我們的結論是:llms.txt 是成本極低的補充措施,不是 GEO 的核心工作——真正的核心仍是可索引的內容與一手證據。

該不該部署?判斷方式

值得做的理由:成本極低(一個檔案)、沒有任何已知風險、萬一未來有平台正式採用你已就位。不值得投入的情況:有人要你為此付顧問費,或把它包裝成「AI 收錄必備」來賣——這與平台官方立場不符,可以直接當成判斷廠商誠信的試金石。我們對客戶的說法是一致的:做,但它排在技術 SEO、內容證據與量測之後,優先序很後面。

部署後怎麼驗證?

三件事:一是用 curl 或瀏覽器直接開 /llms.txt,確認回應 200、內容是最新的;二是檢查內容過濾與 sitemap 一致——noindex 的頁面不應該出現在 llms.txt 裡,否則等於把你不想曝光的內容主動遞給 AI;三是定期看伺服器紀錄,記錄哪些爬蟲實際抓取過,這是你判斷「有沒有人在讀」的唯一一手資料。

參考資料

常見問題

llms.txt 跟 sitemap.xml 有什麼不同?
sitemap.xml 是搜尋引擎官方支援的標準,列出所有可索引 URL 供爬蟲發現;llms.txt 是社群提案,用人類可讀的 Markdown 描述網站重點。前者有明確的官方用途,後者目前沒有平台承諾使用——兩者不互相取代。
一定要有 llms-full.txt 嗎?
不一定。llms-full.txt 是選配的完整內容版本,適合內容量可控的網站;頁面很多的網站全文展開會過大,反而稀釋重點。本站的做法是 llms.txt 放結構化清單、llms-full.txt 放服務與案例的完整段落。
沒有 llms.txt 會影響 AI 引用嗎?
以目前各平台的公開文件來看,不會。Google 明確不使用;其他平台也沒有把它列為條件。決定引用的仍是內容能不能被抓取、有沒有可信的一手價值。把它當加分題,不要當必考題。

有相關需求?

聯絡我們