llms.txt 是什么?和 robots.txt、sitemap.xml 有何不同
核心要点
- robots.txt 管能不能抓;sitemap 管有哪些 URL;llms.txt 管建议读哪些、每页是什么。
- 内容必须和真实页面一致,过期链接会降低信任。
- 有 llms.txt 不等于一定被引用,它只降低模型找权威页的成本。
llms.txt 是一种面向大语言模型的站点说明文件,通常放在根目录,用 Markdown 告诉模型:这个站点是谁、哪些页面是权威入口、最新文章在哪。
三种文件的分工
| 文件 | 主要读者 | 解决的问题 |
|---|---|---|
| robots.txt | 爬虫 | 允许或禁止抓取哪些路径 |
| sitemap.xml | 搜索引擎 | 有哪些 URL、何时更新 |
| llms.txt | 大模型与 AI 检索 | 哪些页值得作为官方说明来读 |
建议写进去的内容
- 一句话定位和主体名称
- 服务、百科、案例、资讯等稳定入口
- 最近更新的可引用文章标题与链接
- 明确不提供的业务,避免模型夸大
GEO.YUN 官网提供 /llms.txt 与 /llms-full.txt,并随文章发布自动更新列表。技术项总览见 官网 GEO 技术清单。
本文问答
llms.txt 要放在网站根目录吗?
是。约定地址是 https://你的域名/llms.txt,可用 Markdown 列出核心栏目和文章。
写得很长会不会更好?
先保证核心页准确。可另做 llms-full.txt 放摘要,但不要堆无法核对的广告语。