GEO
llms.txt 是什麼?跟 robots.txt 差在哪、要不要放
用白話解釋 llms.txt 這個給 AI 引擎看的站點導覽檔:依 llmstxt.org 提案的格式與用途、跟 robots.txt 與 sitemap 的差別、目前各 AI 引擎有沒有承諾會讀、來客旺自己的 llms.txt 怎麼從內容自動產生,以及老闆到底要不要放。
張耐德・SEO 策略負責人・
先講結論
llms.txt 是放在網站根目錄(例如 likewant.net/llms.txt)的 Markdown 純文字檔,依 llmstxt.org 的提案,內容是網站名稱、一段摘要與重要頁面的連結清單,讓大型語言模型(LLM)與 AI 引擎用最少的字讀懂這個網站是什麼、哪些頁面值得讀;它與管爬蟲權限的 robots.txt、列出所有網址的 sitemap 是三個不同用途的檔案。
- llms.txt 是放在網站根目錄的 Markdown 純文字檔,內容是網站名稱、一段摘要與重要頁面的連結清單,目的是讓 AI 引擎用最少的字讀懂這個網站是什麼、哪些頁面值得讀。
- robots.txt 管的是「哪些爬蟲可以進來、哪些路徑不能抓」,sitemap 管的是「網站有哪些網址」,llms.txt 管的是「這個網站是誰、重點在哪」,三個檔案各做各的事,互相不能取代。
- llms.txt 目前是 llmstxt.org 的社群提案,OpenAI、Anthropic、Google 都沒有在官方文件承諾會讀取它,放了不代表 AI 就會用。
- 來客旺的 /llms.txt 與 /llms-full.txt 是從網站內容自動產生的,不手寫;新文章上線後檔案自動更新,不會過期。
- 老闆要不要放 llms.txt 的答案是「可以放、成本很低、沒有壞處,但不要期待奇效」;真正決定 AI 引擎會不會引用你的,還是頁面本身有沒有回答問題。
先講結論:llms.txt 是什麼?
llms.txt 是放在網站根目錄的一個 Markdown 純文字檔,裡面寫網站名稱、一段摘要,以及重要頁面的連結清單,目的是讓 ChatGPT、Claude 這類大型語言模型與 AI 引擎,用最少的字讀懂「這個網站是什麼、重點在哪幾頁」。它是 llmstxt.org 在 2024 年提出的社群提案,目前沒有任何 AI 引擎在官方文件承諾會讀,所以放了沒有壞處,但也不要期待奇效。
你可以把它想成給 AI 看的「店門口簡介」:一般網頁是給人看的,版面、選單、圖片很多;AI 引擎要理解一個網站,得把這些東西全部讀完再自己整理,很沒效率。llms.txt 就是先幫它整理好:我們是誰、做什麼、收費怎麼算、想深入看哪幾頁。
這篇文章會講清楚四件事:llms.txt 長什麼樣、跟 robots.txt 與 sitemap 差在哪、各 AI 引擎目前到底有沒有在用、以及一個中小企業老闆到底要不要放。它是GEO(生成式引擎優化)裡很小的一個環節,不是重點,但因為名字很像 robots.txt,常被問到。
llms.txt 裡面要寫什麼?格式長什麼樣?
依 llmstxt.org 的提案,llms.txt 是一個 Markdown 檔,只有一個必填項目:第一行用 H1 寫網站或專案的名稱。接著可以放一段用引言格式(開頭一個 >)寫的短摘要,再放幾段補充說明,最後用 H2 分區列出重要頁面的連結,每條連結是「頁面名稱: 一句話說明」的格式。全部都是純文字,沒有程式碼,用記事本就寫得出來。
以來客旺自己的 /llms.txt 為例,結構大概是這樣(內容有簡化):
# 來客旺(LikeWant)— 成效型長尾 SEO
> 來客旺是台灣的成效型長尾 SEO 服務:免費建立長尾 SEO 網站,
> 只依 Google Search Console 記錄的有效自然搜尋 Click 收費,每個 NT$20……
## 事實(可直接引用)
- 品牌:來客旺(英文 LikeWant,網址 https://likewant.net)……
- 收費:網站建置 NT$0;有效 Google 自然搜尋 Click 每個 NT$20……
- 不做:排名承諾、SEO 月租套餐、社群代操、短影音。
## 核心頁面
- [合作方式(五步驟)](likewant.net/how-it-works)
- [有效 Google Click 的定義](likewant.net/valid-click)
……
## 名詞定義
- 成效型 SEO:成效型 SEO 是依實際成果收費的 SEO 合作模式……
幾個提案裡的細節,寫的時候可以留意:
- H1 名稱是唯一必填,其他都是選填。一個只有一行名稱的 llms.txt 也是合法的。
- 摘要放在引言區塊(每行開頭一個
>),這段是 AI 最先讀到的「這個網站是什麼」。 - 連結清單用 H2 分區,每條連結可以帶一句說明,讓 AI 決定要不要點進去讀。
- 可以有一個叫「Optional」的區段,放次要頁面,提案的意思是當 AI 的閱讀空間有限時可以略過這一區。
- 提案也建議網站另外提供每一頁的 Markdown 版本(在網址後面加
.md),讓 AI 讀到乾淨的內文而不是整頁 HTML;這部分做不做看網站技術能力,不是必要條件。
寫進去的東西要跟網頁上的內容一致。llms.txt 不是可以另外講一套的地方,AI 引擎讀了摘要之後還是會去讀網頁,兩邊講的不一樣反而讓它不知道該信哪個。
llms.txt 跟 robots.txt、sitemap 差在哪?
llms.txt、robots.txt、sitemap 是三個用途完全不同的檔案:robots.txt 管「哪些爬蟲可以進來、哪些路徑不能抓」,是權限;sitemap 管「網站有哪些網址、什麼時候更新的」,是清單;llms.txt 管「這個網站是誰、重點在哪幾頁」,是導覽。三者互相不能取代,放了 llms.txt 不等於允許 AI 爬蟲,放了 robots.txt 也不等於 AI 讀得懂你的網站。
用一張表對照:
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| 給誰看 | 所有爬蟲(Google、Bing、AI 爬蟲) | 搜尋引擎 | 大型語言模型與 AI 引擎 |
| 回答的問題 | 你可以抓哪裡、不能抓哪裡 | 我有哪些網址 | 我是誰、重點在哪 |
| 格式 | 純文字指令(User-agent、Allow、Disallow) | XML | Markdown |
| 誰定的規則 | 業界標準,Google、OpenAI、Anthropic 都在官方文件說會遵守 | 業界標準,Google 官方支援 | llmstxt.org 社群提案,各引擎沒有官方承諾 |
| 不放會怎樣 | 爬蟲預設全部可抓 | 搜尋引擎還是會靠連結找到頁面,只是慢 | AI 引擎自己讀網頁,只是沒有整理好的摘要 |
三個檔案各自要注意的事:
robots.txt 才是決定 AI 爬蟲能不能進來的地方。 依 OpenAI 的說明,GPTBot(用於訓練)、OAI-SearchBot(用於 ChatGPT 搜尋)、ChatGPT-User(使用者當下要求讀某一頁)都會看 robots.txt;Anthropic 的 ClaudeBot 也一樣。Google 另外有一個 Google-Extended 這個 robots.txt 代號,依 Google 文件,它控制的是你的內容能不能用在 Gemini 等 AI 產品上,不影響網站在 Google 搜尋的收錄與排名。如果你把這些爬蟲全擋了,llms.txt 寫得再好也沒用。
sitemap 是給搜尋引擎的。 它讓 Google、Bing 知道你有哪些頁、哪些更新了。依 Google 文件,AI 摘要和 AI 模式引用的是 Google 已經收錄的網頁,所以 sitemap 對「被 Google AI 摘要引用」反而比 llms.txt 重要得多。
llms.txt 是額外的方便,不是門票。 它不會讓沒被收錄的頁面被引用,也不會讓被擋掉的爬蟲進來。
各 AI 引擎目前有採用 llms.txt 嗎?
目前沒有任何主要 AI 引擎在官方文件承諾會讀取 llms.txt。截至 2026 年 9 月,OpenAI 的爬蟲文件只提到 robots.txt,Anthropic 的 ClaudeBot 說明也只提到 robots.txt,Google 搜尋中心關於 AI 功能的文件則說 AI 摘要與 AI 模式不需要特殊標記、靠的是正常收錄與既有的 robots 控制。llms.txt 是一個「提案」,有不少網站在用,但採用與否是各引擎自己的事。
這件事老闆一定要知道,因為市面上有些說法把 llms.txt 講得像「不放就會被 AI 忽略」,這沒有根據。實際狀況比較像這樣:
- 有些工具和文件型網站在放,主要是程式開發領域,因為開發者常把整份技術文件餵給 AI 助理,一個整理好的 llms.txt 對他們很實用。
- AI 引擎怎麼用它,沒有公開說明。 沒有任何一家說「我們讀 llms.txt 來決定引用誰」。
- Google 沒有把它列入搜尋相關檔案。 Google 搜尋與 AI 摘要用的還是 robots.txt、sitemap、meta 標記那一套。
所以我們對 llms.txt 的態度是:它是一個成本接近零的善意動作,有人來讀就讀,沒人讀也不損失。真正決定 AI 引擎會不會引用你的,是網頁本身能不能回答問題、有沒有被收錄、公司資訊是不是一致。這部分在AI 摘要的引用來源怎麼選那篇有更完整的說明。
來客旺自己的 llms.txt 是怎麼產生的?
來客旺的 /llms.txt 與 /llms-full.txt 不是手寫的,而是網站程式在每次建置時從內容自動產生:品牌描述、收費規則來自網站設定檔,頁面清單來自所有已發布的指南、文章與產業頁,名詞定義來自名詞定義頁。新文章上線,檔案自動多一條;改了收費說明,檔案跟著改。不手寫的原因只有一個:手寫的清單遲早過期。
兩個檔案分工如下:
| 檔案 | 內容 | 給誰用 |
|---|---|---|
| /llms.txt | 品牌一句話描述、可直接引用的事實(收費 NT$20 / 有效 Click、不做什麼)、核心頁面、所有指南與文章的連結加一句說明、名詞定義 | 想快速知道來客旺是什麼、該去讀哪一頁的 AI 引擎 |
| /llms-full.txt | 每一頁已經整理好的重點:一句話定義、可獨立引用的結論、FAQ 問答 | 想一次讀完整站可引用內容的 AI 引擎 |
之所以能自動產生,是因為我們每一篇文章的重點本來就已經整理在固定的欄位裡:
- 每篇有一句「X 是 …」的定義句,能單獨成立。
- 每篇有 3 到 5 條可獨立引用的結論,每一條主詞完整,不寫「這樣做」「上述」這種要靠上下文才看得懂的字。
- 每篇有至少 3 條 FAQ,問題不跨頁重複。
這些欄位是為了讓文章本身好讀、好引用而寫的,不是為了 llms.txt 才加的。llms.txt 只是把已經存在的東西集中列出來。換句話說,先有能被引用的內容,llms.txt 才有東西可放;順序反過來,就只是一個空殼。
同一套內容還被用在網頁上的「先講結論」框、Article 結構化資料的摘要、名詞定義頁的結構化資料。一份內容、多個出口,這是我們做GEO 的基本原則:不為 AI 另外寫一套內容,給人看的和給 AI 看的必須是同一份。
如果你想知道自己的網站要從哪裡開始整理內容、哪些頁面值得先寫,可以先做一次免費的產業 SEO 評估。
一般中小企業的網站要不要放 llms.txt?
一般中小企業的網站可以放 llms.txt,理由是成本很低、沒有壞處,但不要期待放了之後 AI 就會推薦你。它排在該做的事情裡很後面:先確認網站有被 Google 收錄、robots.txt 沒有擋掉 AI 爬蟲、客人常問的問題有專屬頁面、公司描述各處一致,這四件做完再花十分鐘放 llms.txt,順序才對。
要不要放,可以這樣判斷:
放的理由
- 成本幾乎是零:一個純文字檔,會打字就能寫。
- 沒有已知的壞處:Google 文件沒有說它會影響搜尋,也沒有任何引擎說放了會被扣分。
- 有機會被讀:即使沒有官方承諾,有些 AI 工具在使用者要求讀網站時,會先找有沒有整理好的摘要。
- 順便整理自己:寫 llms.txt 的過程會逼你用一句話講清楚「我們是誰、做什麼、收費怎麼算」,這句話本來就該有。
先不用放的情況
- 網站還沒被 Google 收錄:先開通 Google Search Console、提交 sitemap,這比 llms.txt 重要一百倍。
- 網站只有一頁:沒有東西可以列,先把客人常問的問題寫成頁面。
- robots.txt 把 AI 爬蟲全擋了:先決定要不要開放,開放了 llms.txt 才有意義。
放的時候要注意
- 內容要跟網頁一致,不要寫網頁上沒有的承諾或數字。
- 有新頁面就要更新,最好像來客旺一樣用程式產生;做不到的話,至少每季看一次。
- 不要把它當成「AI 專用內容」的地方塞關鍵字或另一套說法,那是 cloaking(給爬蟲和給人不同內容),Google 垃圾內容政策明文禁止。
一句話總結:llms.txt 是 GEO 裡最便宜、也最不重要的一步。該做,但做完不要覺得 GEO 就做完了。
延伸閱讀
- GEO 完整指南:來客旺自己怎麼做 GEO,從實體資訊、內容結構到爬蟲設定。
- AI 摘要的引用來源怎麼選:比 llms.txt 重要得多的事,什麼樣的頁面會被 AI 引用。
- GEO、AEO、AIO 差在哪:被一堆新名詞搞混的話,先看這篇。
這篇的常見問題
llms.txt 要用什麼工具才能做?
llms.txt 跟 llms-full.txt 有什麼不同?
放了 llms.txt 之後,還需要允許 AI 爬蟲嗎?
llms.txt 會不會影響 Google 排名?
參考資料
- llms.txt 提案(llmstxt.org)(查閱日期 2026-09-13)
- Google 搜尋中心:AI 功能與你的網站(查閱日期 2026-09-13)
- Google 搜尋中心:Google 檢索器(Google-Extended)(查閱日期 2026-09-13)
- OpenAI:爬蟲說明(GPTBot / OAI-SearchBot / ChatGPT-User)(查閱日期 2026-09-13)
- Anthropic:ClaudeBot 爬蟲說明(查閱日期 2026-09-13)
內容由張耐德(SEO 策略負責人)撰寫 / 審核。 本文為一般性說明,不構成對特定排名、流量或營收的承諾;SEO 需要時間累積。
- llms.txt
- robots.txt
- GEO
- AI 爬蟲