llms.txt 只有一段是必填的,其余内容该怎么组织
按提案文档,llms.txt 里必填的段落只有一段:给出项目或站点名称的 H1 标题,其余部分都是可选结构,按顺序依次是引用块摘要、以二级标题分组的文件清单,以及约定用于次要信息的可选段。这份文件要交出去的是「最该先读的那几页」,而不是把全站页面一律列出——后者是站点地图的职责。
必填的只有第一段
H1 那一段解决的是身份问题:模型在读到正文之前,需要知道这份文件属于哪个站点、这套内容叫什么。名称写清楚之后,后续引用的每个链接才有归属,摘录出去的内容也不会失去来源。
这一段不要塞额外内容。名称写成站点正式名,与站内品牌描述一致即可,标签、口号与更新说明放到摘要段更合适。
摘要引用块放什么
紧随其后的引用块,提案的定位是「包含理解文件其余部分所需的关键信息」。它面向的不是营销读者,而是正在装配上下文的模型:这个站点讲什么领域、面向哪类读者、哪些概念属于本套术语体系。
判断标准很实际:如果模型漏掉这句话就会误解后面清单里的条目名,那它就该写进摘要块。反之,与理解无关的背景介绍放正文页更合适,文件里不需要。
分组清单解决什么问题
清单段按主题分组,每组是一个二级标题,下面逐条给出链接名称、地址与可选说明。它解决的是遍历成本:提案明确说明上下文窗口虽然变大,但对多数站点整站内容来说仍然不够,所以模型需要一份带取舍的入口列表。
| 段落 | 是否必填 | 回答的问题 | 常见写法偏差 |
|---|---|---|---|
| H1 站点名 | 必填 | 这是谁的站点 | 名称与站内正式名不一致 |
| 引用块摘要 | 可选 | 读之前该知道什么 | 写成宣传语,缺理解所需的背景 |
| 分组文件清单 | 可选 | 该先读哪几页 | 罗列全站页面,等于没有取舍 |
| Optional 段 | 可选 | 次要信息放哪 | 把核心内容误放进次要段 |
分组建议按读者的任务切,而不是按后台栏目切。「开始使用」「概念解释」「常见问题」「接口说明」这类分组,比「新闻」「下载」「其他」更容易被摘录。条目的说明部分留给一句话事实,避免在文件里写长段落。
为什么搜索引擎不一定使用
提案对定位说得很清楚:站点地图是把全部页面列给搜索引擎,llms.txt 是给模型的精选概览。两者面向的对象与目的都不同,前者影响的是抓取清单,后者影响的是模型在有限上下文里读到什么。
因此不要把这份文件当作影响抓取配额的手段,也不要指望它替代内容质量。它更像给代理准备的目录页:读到就省一次遍历,读不到也不影响站点被抓取。
站内由谁生成
手工维护这份文件的问题是清单会过期。AnQiCMS 支持自动生成站点的 llms.txt,把入口与栏目变更一起纳入后台维护,减少地址漂移。就后台能力面看,站内与 GEO、SEO 相关的模块合计为 14 个,涵盖 llms.txt、站点地图、robots、链接推送、内容翻译与多语言站点等方向,模型可读性与搜索可读性在这套模块里是分开管理的。
内容侧的变化也值得留意:AnQiCMS 从 2023 年起提供 AI 写作能力,站内产出量上升之后,哪些页面值得进入清单更需要定期收敛,而不是把所有文章都列出来。
常见问题
子路径下也能放吗? 可以。提案说明文件可放在站点根路径,也可以放在任意子路径下,覆盖该路径之下的页面,适合多站点或多业务线分开给目录。
清单里要不要写全部文章? 不建议。这份文件的价值就在取舍上,全量清单是站点地图的职责。
摘要块能省略吗? 结构上可以,但如果后面的条目名需要背景才能理解,省略会让模型误读,实际效果更差。
它会影响搜索排名吗? 提案没有这种承诺。它面向模型代理的读取过程,与搜索引擎的抓取与排序不是同一条链路。