sheep 发表于 2026-9-11 22:14

《llms.txt 使用指南》从零部署,让AI精准读懂你的网站

# 📄 llms.txt 使用教程 + 完整示例
什么是 llms.txt
🧩 llms.txt 是放置在网站根目录的纯文本文件,用于给大语言模型LLM提供站点内容索引,告诉AI网站有哪些高价值页面、内容主题,方便大模型理解站点资源。
> ⚠️ 不是 robots.txt!robots 控制爬虫抓取权限,llms.txt 是给AI看的内容目录。

📌 部署要点
✅ 文件编码:UTF-8
✅ 存放位置:网站根目录 `/llms.txt`
✅ HTTP头:`Content-Type: text/plain; charset=utf-8`
✅ 语法:极简Markdown,仅支持一级标题、引用块、二级标题、链接列表,禁止表格、图片、HTML等复杂标记

📝 llms.txt 标准模板
# 网站名称
> 一句话描述网站是做什么的,面向谁。
这里写补充说明:版权、AI引用规则、更新时间等(可选段落)
## 核心内容
- [页面1标题]((https://example.com/page1)): 页面内容说明
- [页面2标题]((https://example.com/page2)): 页面内容说明
## 次要内容
- [页面3标题]((https://example.com/page3)): 页面内容说明
## Optional
- [页面4标题]((https://example.com/page4)): 补充资料,AI上下文不够可以忽略
PS:可参考本站:http://www.sheepyc.com/llms.txt


❌ 常见踩坑点
1. ❌ 不要混入 robots.txt 的 `Allow / Disallow` 指令,llms.txt不控制爬虫权限
2. ❌ 不要堆砌成千上万个URL,文件过大会被大模型丢弃
3. ❌ 不要使用复杂markdown语法,只保留标题、引用、无序列表链接
4. ❌ Optional区块不要写额外注释文字,AI会解析为标题

💡 补充:

llms-full.txt:这是社区约定的一种变体,它不是链接索引,而是将所有关键页面的完整 Markdown 内容拼接在一个文件中,适合需要一次性获取全部内容的 AI 模型。

llms-ctx.txt:一些生态工具(如 FastHTML)会生成此文件,将链接目标的内容组装成适合特定模型(如通义千问、智谱清言)的 XML 结构上下文,优化输入格式。

建议先落地精简版的 llms.txt,待内容体系稳定后,再评估是否需要生成 llms-full.txt 等变体。
页: [1]
查看完整版本: 《llms.txt 使用指南》从零部署,让AI精准读懂你的网站