llms.txt 從哪來?定位是什麼?
llms.txt 由 Answer.AI 的 Jeremy Howard 在 2024 年 9 月提出,動機很實際:網頁塞滿導覽、廣告與腳本,對上下文長度有限的語言模型不友善,不如提供一份乾淨的 Markdown 摘要,列出網站是什麼、重點頁面在哪。要注意它的身分:這是社群提案,不是任何搜尋引擎或 AI 平台的官方標準——這個定位決定了你該投資多少心力在上面。
llms.txt 是 2024 年由社群提出的檔案格式提案,用一份精簡的 Markdown 讓 AI 系統快速理解網站結構與重點內容。本站有部署它,但我們要先把話說在前面:Google 已表明不使用 llms.txt,它不是收錄或引用的門票。這篇文章教你怎麼做,也告訴你該對它抱多少期待。
llms.txt 由 Answer.AI 的 Jeremy Howard 在 2024 年 9 月提出,動機很實際:網頁塞滿導覽、廣告與腳本,對上下文長度有限的語言模型不友善,不如提供一份乾淨的 Markdown 摘要,列出網站是什麼、重點頁面在哪。要注意它的身分:這是社群提案,不是任何搜尋引擎或 AI 平台的官方標準——這個定位決定了你該投資多少心力在上面。
規範刻意簡單,就是一份放在網站根目錄的 Markdown 檔。結構依序是:H1 寫網站名稱、引言區塊(blockquote)寫一段網站摘要、之後用 H2 分區放連結清單,每個連結附一句說明。另外有一個選配的 llms-full.txt,直接放入完整的頁面內容,給願意讀長文件的系統使用。兩個檔案都以純文字回應,不需要任何特殊標頭。
我們在 Next.js App Router 用 Route Handler 提供 /llms.txt 與 /llms-full.txt,內容不是手寫的靜態檔,而是從跟網頁同一份資料層(服務、案例、價格的 TypeScript 內容檔)動態組出來,並以 force-static 在建置時輸出。這個設計解決了手寫檔案最大的問題:內容漂移。價格改了、服務改了,llms.txt 在下次建置自動同步,不會出現網頁說一套、llms.txt 說另一套的情況——對 AI 系統輸出過期資訊,比沒有這個檔案更糟。
這是多數教學不會告訴你的部分。Google 官方文件明確說明 AI 功能沒有額外的技術門檻,搜尋團隊成員也公開表示不使用 llms.txt;其他 AI 平台是否讀取、讀了是否影響引用,目前都沒有官方承諾。我們檢視自己的伺服器紀錄,能看到部分 AI 爬蟲抓取過這兩個檔案,但「被抓取」與「影響引用」是兩件事,後者無法驗證。所以我們的結論是:llms.txt 是成本極低的補充措施,不是 GEO 的核心工作——真正的核心仍是可索引的內容與一手證據。
值得做的理由:成本極低(一個檔案)、沒有任何已知風險、萬一未來有平台正式採用你已就位。不值得投入的情況:有人要你為此付顧問費,或把它包裝成「AI 收錄必備」來賣——這與平台官方立場不符,可以直接當成判斷廠商誠信的試金石。我們對客戶的說法是一致的:做,但它排在技術 SEO、內容證據與量測之後,優先序很後面。
三件事:一是用 curl 或瀏覽器直接開 /llms.txt,確認回應 200、內容是最新的;二是檢查內容過濾與 sitemap 一致——noindex 的頁面不應該出現在 llms.txt 裡,否則等於把你不想曝光的內容主動遞給 AI;三是定期看伺服器紀錄,記錄哪些爬蟲實際抓取過,這是你判斷「有沒有人在讀」的唯一一手資料。