← 博客
llms.txt:它是什么、为什么重要、怎么写
llms.txt 是放在网站根目录(/llms.txt)的 Markdown 文本文件。它紧凑地描述这个网站是什么、语言模型应该阅读哪些页面。该标准由 Jeremy Howard(Answer.AI)于 2024 年 9 月提出——类似 robots.txt,但目的是帮助理解内容,而非限制访问。
要点
- llms.txt 是社区提出的标准;格式就是普通 Markdown。
- 结构:H1 写名称,引用块写简介,H2 小节放带注释的链接列表。
- 采用它几乎零成本、零风险,但也没有保证:主要提供商尚未正式确认会自动读取它。
- 唯一重要的规则:文件必须真实,并与网站保持同步。
格式
一个最小可用示例:
# 项目名称
> 一到两句话:这是什么、为谁而做。
## 核心
- 首页:https://example.com/ — 首页上有什么
- 文档:https://example.com/docs/ — 里面有什么
## 可选
- 博客:https://example.com/blog/ — 你们写什么
对于大型网站,该标准还允许 llms-full.txt——一个包含关键页面完整 Markdown 文本的扩展版本。
llms.txt 实际能带来什么
- 节省模型上下文。代理或回答引擎一次请求就能拿到网站摘要,无需爬遍导航。
- 设定重点。由你决定哪些页面是核心、你的服务如何表述。
- 约束团队。这个文件迫使你把公司事实一次性表述清楚——同样的表述随后会传播到各种回答中。
坦诚说明:截至 2026 年,OpenAI、Anthropic 和 Google 都没有正式声明其系统会自动抓取 llms.txt。这是一笔零成本的对未来的押注——正因如此,我们把它列入 GEO 实践的基础清单。
常见错误
- 用营销话术代替事实。模型不会引用「市场上最好的解决方案」;它会引用「一家做 X 的工作室」。
- 与网站脱节。文件描述了已不存在的页面,或与内容矛盾——这会损害对整个来源的信任。
- 文件过于庞大。几万字的长文不是摘要;那是 llms-full.txt 的职责。
- 链接失效或非规范。使用与站点地图和 canonical 一致的 URL。
如何在一小时内上线
- 整理关键页面清单,每个页面配一句话说明。
- 用一两行事实性的语言描述公司——不用最高级形容词。
- 把文件放到网站根目录,并注明更新日期。
- 设置提醒:每次发布时核对文件与网站是否一致。
我们自己的文件是公开的:geo-rank.ai/llms.txt。想要一份为你的网站定制的版本——联系我们。
发布日期: 2026-08-09 · geo-rank.ai