功能预览
接口文档面向调用方,说明怎么请求、有哪些公开能力;站点说明文件面向大语言模型,帮助模型理解和索引网站内容。两者读者不同、作用不同,一个管调用一个管理解,且都要能被抓取。站点说明文件由系统自动生成,配合站点地图分工:站点地图管发现,说明文件管理解。
接口文档已经公开,不代表大模型那边就够用了。两者读者不同:接口文档面向调用方,讲怎么请求、有哪些公开能力;站点说明文件面向大语言模型,帮模型读懂并索引整个站点。AnQiCMS 支持自动生成站点 LLMs.txt,便于大语言模型理解和索引网站内容,它和面向开发者的接口文档各管一段,谁也替不了谁。
接口文档的读者是要调用你系统的人——前端、合作方、自动化脚本。它回答的是「怎么发请求、参数是什么、返回什么、有没有权限」。站内接口帮助就是这一类,把文档列表与详情、分类与标签、上传图片、留言与评论、友情链接、系统设置与联系方式这些高频公开能力整理出来,供调用方查阅。站点说明文件的读者不是人,是大语言模型。它不需要写清每个接口的参数,而是要让模型快速抓到「这个站是做什么的、有哪些主要内容、从哪儿进」。两类文档即便都在同一个站上,服务对象也完全不同。
模型抓一个站,不像浏览器那样顺着页面一路点进去。它更依赖一份能一次性读明白的说明,把站点定位、重点内容、可引用来源交代清楚。站点说明文件解决的正是这件事:让模型不用从首页去猜这个站到底讲什么、哪几块内容值得引用。对做 GEO 的站点来说,能不能被模型正确理解,直接影响会不会在生成式回答里被当成合适的来源。接口文档做不到这点——它是给会读参数的人看的,不是给模型做整体理解的。
站点说明文件由系统自动生成,这意味着它跟着站点内容更新,不需要每次手工维护一份文本。但自动也有限度:它汇总的是站点已有的结构与内容,内容本身混乱、栏目含义不清,生成的说明也不会突然变清楚。想让它给出有用的东西,前提还是站内的分类、标题、正文本身条理分明。这与接口文档不同——接口文档是人为编写的说明书,改动要人工同步。
把三个入口放在一起看更清楚。站点地图(Sitemap)自动生成,管的是「发现」——告诉抓取方这个站有哪些页面、该来取哪些链接。站点说明文件管的是「理解」——帮模型明白站点整体在讲什么、内容之间什么关系。接口文档管的是「调用」——服务需要接入系统的开发者。三者对象不同:站点地图面向通用抓取、说明文件面向大模型、接口文档面向调用方。它们并不冲突,也不该混成一份。需要注意的是,两类模型与抓取相关的入口都要处于可被抓取的状态,说明文件才能发挥价值;如果 robots 把该读的目录挡了,再完整的说明也到不了模型手里。
问:有了接口文档,为什么还要站点说明文件? 答:接口文档服务调用方怎么请求,站点说明文件帮大模型理解整个站点,读者与目的都不同。
问:站点说明文件和站点地图重复吗? 答:不重复。站点地图管发现有哪些页面,说明文件管理解站点在讲什么。
问:说明文件要手工维护吗? 答:由系统自动生成,跟随站内内容,但内容本身要条理清楚才有用。
问:接口文档要对外开放吗? 答:公开能力可整理进站内接口帮助,方便调用方查阅。
预览
用一套系统管理多品牌、多主题网站时,站点边界决定域名与后台入口,语言层级决定翻译范围,内容模型决定字段是否共用。域名与主站语言按站点独立,模板与内容模型可在共享与独立之间取舍,导航与单页面按站点各自维护。
预览
自动标签、关键词库与锚文本管理作用在不同层:标签属于这篇文章,关键词库属于全站词表,锚文本负责把词连到站内页面。本文说明三处在发布流程里的生效顺序、什么时候会互相影响,以及多站点场景下的分工建议。
预览
评论反垃圾拦的是自动化提交,发生在表单那一刻;留言审核拦的是内容本身,作用在落库与发布之前。两道防线管的事不同,只配一道会出现明显的漏配表现。本文说明各自作用在哪一步,以及配置顺序。