配置了llms.txt为什么AI还是不引用我的网站?7个排查点
"llms.txt 配了,AI 还是不引用,是不是这玩意儿没用?"这是 GEO 实践里被问最多的问题。 大多数情况不是 llms.txt 无效,而是配置没到位,或者期望放错了位置。 这篇按概率从高到低给你 7 个排查点,每个都能自查、能动手修。查到最后如果还不是, 直接上本站的 AI 品牌可见度模拟器 实测 当前状态,用数据再说话。
排查点 1:文件位置对不对、是不是 200
最常见、也最好查:浏览器直接访问 https://你的域名/llms.txt。结果只有
三种:
- 404:文件没在根目录,或被 CDN 拦了。检查上传位置是否与 index.html 同级。
- 301 跳转:www/裸域、http/https 重定向没有带上新地址,AI 抓的时候可能拿不到最终内容。统一域名并确认跳转后 200。
- 200 正常:位置 OK,看下面几项。
排查点 2:格式是否完全符合规范
很多"配了没用"其实是格式不达标。对照 llmstxt.org 规范(查询时间 2026-09-13)检查 三点:
- 第一行必须是
#开头的 H1 标题 - 紧跟的简介用
>引用块 - 链接是
[文字](https://绝对地址)格式,带可选描述
规范不允许的写法(表格、HTML 片段、相对路径)会让部分 AI 解析器直接放弃这个文件。 不确定就对着一份标准文件改:llms.txt 格式规范详解 里有完整拆解。
排查点 3:内容质量是否足够"信息密度"
AI 引用你的网站,前提是它认为你的内容值得引用。llms.txt 写得再好,也只是 "入场券",入场后的胜负交给内容本身。自查三句话:
- 页面有没有直接回答用户会问的问题?(而不是产品愿景)
- 页面内容是否足够长期稳定?临时活动页被引用了也没意义。
- 简介和描述里有没有把"你凭什么被引用"说清楚?
如果内容短、空、泛,llms.txt 救不了你——AI 抓进去读完发现没料,一样不引用。
排查点 4:网站本身的其他信号
AI 检索排名不只依赖 llms.txt,还会综合考量:外链与品牌提及(别处提到你、别的 页面链接你)、品牌实体(结构化数据是否讲清"你是谁")、内容深度与一致性。 llms.txt 是加分项,不是救命稻草。网站整体在互联网上的"存在感"越强,llms.txt 的推荐越容易被采信——这是个正循环。
排查点 5:AI 检索有延迟,更新后要等
你以为的"配完没效果",相当一部分只是还没被索引到。AI 检索器的抓取间隔 从几天到几周不等,且各家节奏不同。判断标准:刚配置完不到两周,先别下结论; 同时确认你没有禁止 AI 爬虫的 UA 规则(见排查点 6)。
排查点 6:爬虫 UA 限制与 CDN 拦截
robots.txt 里如果 Disallow 了 AI 爬虫的 User-agent(比如 GPTBot、PerplexityBot、 ClaudeBot 等),或者 CDN/WAF 按 UA 拦截了非浏览器流量,那么你的 llms.txt 和页面 都会一起被挡在外面。检查方法:
- 看 robots.txt 是否有
User-agent: GPTBot+Disallow: / - 看 CDN 配置是否区分"浏览器"和"bot"请求
- 用 curl 模拟 bot UA 访问
/llms.txt,看返回码
特别注意:robots 和 llms 是两套逻辑,别把"挡垃圾路径"误写成"挡所有 AI"。 怎么配合可以复习 robots.txt 与 llms.txt 的区别。
排查点 7:竞争对手内容更优的本质差距
最后一个,也是最难接受的:AI 不引用你,可能只是别人确实比你更合适。 同一问题下,AI 只给 5-10 个引用位,而候选页面可能上百个。当你的内容、权威性、 相关度都排在后面时,llms.txt 只能保证你"被考虑",不能保证你"被选中"。
这时要做的不是反复改 llms.txt,而是回去补内容、攒外链、做实体建设——这些慢功夫 才是 GEO 的地基,llms.txt 是上面的加速器。
配完还得测:用工具看现状
排查完 7 项,别靠感觉判断"到底有没有效果"。用本站的 AI 品牌可见度模拟器:输入品牌名称、 行业、核心关键词,就能看到品牌在 AI 回答曝光维度的模拟评估,把"没效果"变成 一个可量化的分数,隔段时间重测一次就知道有没有进步。想把这套能力做完整, 再看 GEO 完整落地指南。