《llms.txt 使用指南》从零部署,让AI精准读懂你的网站

[复制链接]
sheep 发表于 2026-9-11 22:14 | 显示全部楼层 |阅读模式
# 📄 llms.txt 使用教程 + 完整示例
什么是 llms.txt
🧩 llms.txt 是放置在网站根目录的纯文本文件,用于给大语言模型LLM提供站点内容索引,告诉AI网站有哪些高价值页面、内容主题,方便大模型理解站点资源。
> ⚠️ 不是 robots.txt!robots 控制爬虫抓取权限,llms.txt 是给AI看的内容目录。

📌 部署要点
✅ 文件编码:UTF-8
✅ 存放位置:网站根目录 `/llms.txt`
✅ HTTP头:`Content-Type: text/plain; charset=utf-8`
✅ 语法:极简Markdown,仅支持一级标题、引用块、二级标题、链接列表,禁止表格、图片、HTML等复杂标记

📝 llms.txt 标准模板
  1. # 网站名称
  2. > 一句话描述网站是做什么的,面向谁。
  3. 这里写补充说明:版权、AI引用规则、更新时间等(可选段落)
  4. ## 核心内容
  5. - [页面1标题]([https://example.com/page1](https://example.com/page1)): 页面内容说明
  6. - [页面2标题]([https://example.com/page2](https://example.com/page2)): 页面内容说明
  7. ## 次要内容
  8. - [页面3标题]([https://example.com/page3](https://example.com/page3)): 页面内容说明
  9. ## Optional
  10. - [页面4标题]([https://example.com/page4](https://example.com/page4)): 补充资料,AI上下文不够可以忽略
复制代码
PS:可参考本站:http://www.sheepyc.com/llms.txt


❌ 常见踩坑点
1. ❌ 不要混入 robots.txt 的 `Allow / Disallow` 指令,llms.txt不控制爬虫权限
2. ❌ 不要堆砌成千上万个URL,文件过大会被大模型丢弃
3. ❌ 不要使用复杂markdown语法,只保留标题、引用、无序列表链接
4. ❌ Optional区块不要写额外注释文字,AI会解析为标题

💡 补充:

llms-full.txt:这是社区约定的一种变体,它不是链接索引,而是将所有关键页面的完整 Markdown 内容拼接在一个文件中,适合需要一次性获取全部内容的 AI 模型。

llms-ctx.txt:一些生态工具(如 FastHTML)会生成此文件,将链接目标的内容组装成适合特定模型(如通义千问、智谱清言)的 XML 结构上下文,优化输入格式。

建议先落地精简版的 llms.txt,待内容体系稳定后,再评估是否需要生成 llms-full.txt 等变体。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注公众号
Archiver|手机版|小黑屋|社区规范|绵羊优创

相关侵权、举报、投诉及建议等,请发 E-mail:2363400792@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|京ICP备19037745号-2公安备案京公网安备11011502037529号

在本版发帖
关注公众号
QQ客服返回顶部
来点音乐
优聚封面
歌曲名称
歌手名称
0:00 0:00
顺序播放
歌词加载中...