// TABLE OF CONTENTS
  1. llms.txt是什么?为什么对GEO重要?
  2. llms.txt的标准格式是什么?
  3. 如何创建和部署llms.txt?
  4. llms.txt和llms-full.txt有什么区别?
  5. llms.txt有哪些最佳实践?
  6. 如何验证llms.txt是否被AI引擎读取?
CHAPTER 01

llms.txt是什么?为什么对GEO重要?

llms.txt是专为AI大语言模型设计的内容指引文件,类似于robots.txt对搜索引擎爬虫的作用:

定义——llms.txt是一个放在网站根目录的纯文本文件(https://域名/llms.txt),向AI模型提供网站内容的结构化指引,帮助AI模型高效理解网站的主要内容、结构和重要页面。

与robots.txt的区别——robots.txt控制爬虫的访问权限(允许/禁止),不提供内容信息。llms.txt主动提供内容指引(这是什么网站、有哪些重要内容、如何组织)。两者互补使用。

GEO价值——llms.txt帮助AI模型在抓取网站时快速建立对网站内容的整体认知。当AI模型在知识库中检索到你的网站时,llms.txt提供了内容的'地图',提升被正确理解和引用的概率。

采用趋势——llms.txt由AI社区在2024年提出,正在被越来越多的AI搜索引擎和工具支持。早期采用者可以获得GEO先发优势。

CHAPTER 02

llms.txt的标准格式是什么?

llms.txt使用Markdown格式,结构简洁清晰。标准格式包含以下部分:

格式要点

第一行是网站名称(#标题),第二段是网站简介(>引用),随后用二级标题(##)分类列出重要页面链接。

链接格式——使用Markdown链接语法 [标题](URL),标题应描述性语言,URL使用完整https路径。

内容选择——只列出最重要的页面,不要列出全站URL。llms.txt是内容指引而非sitemap,精选核心页面即可。

example.py python
# GEO技能行业网

> 专业的GEO(生成式引擎优化)技术文档与知识分享平台,提供从入门到高级的GEO优化指南、工具推荐和最佳实践。

## 核心内容

- [GEO入门指南](https://example.com/docs/geo-basics): GEO概念、原理和入门教程
- [GEO技术优化](https://example.com/docs/geo-tech): Schema标记、爬虫配置、性能优化
- [GEO内容策略](https://example.com/docs/geo-content): AI友好内容创作和优化方法
- [GEO工具推荐](https://example.com/docs/geo-tools): GEO检测、监测和分析工具

## 常见问题

- [GEO基础问答](https://example.com/docs/qa-geo-basics): GEO入门常见问题解答
- [GEO技术问答](https://example.com/docs/qa-geo-tech): GEO技术实现常见问题解答

## 重要页面

- [关于我们](https://example.com/about): 平台介绍和团队信息
- [GEO学习路径](https://example.com/learning-path): 从入门到精通的学习路线图
- [GEO vs SEO](https://example.com/geo-vs-seo): GEO与SEO的对比分析

## 联系方式

- 官方邮箱: contact@example.com
- 更新频率: 每周更新
CHAPTER 03

如何创建和部署llms.txt?

llms.txt的创建和部署步骤:

第一步:内容梳理——列出网站最重要的10-30个页面,按主题分类。选择标准:最能代表网站专业性的页面、最常被用户搜索的页面、最希望被AI引擎引用的页面。

第二步:编写文件——按照标准格式编写llms.txt,使用Markdown语法。每个分类下列出3-8个重要页面链接,附带简短描述。

第三步:部署文件——将llms.txt上传到网站根目录,确保可以通过 https://域名/llms.txt 直接访问。部署在Web服务器的根目录下。

第四步:验证访问——使用浏览器或curl访问 https://域名/llms.txt,确认文件可正常访问且内容格式正确。

第五步:持续更新——当网站新增重要页面或调整内容结构时,同步更新llms.txt。建议每季度审查一次内容是否需要更新。

CHAPTER 04

llms.txt和llms-full.txt有什么区别?

llms.txt规范定义了两个层级的文件,满足不同场景需求:

llms.txt(精简版)——放在根目录,提供网站内容的概要指引。包含网站简介、核心内容分类和重要页面链接。AI模型优先读取此文件获取网站概览。

llms-full.txt(完整版)——放在根目录,提供更详细的内容指引。可以包含更完整的页面清单、详细的内容描述、API文档链接、技术规范等。AI模型需要深入了解时读取此文件。

使用策略——小型网站只需llms.txt即可。大型网站(100+页面)建议同时提供llms.txt和llms-full.txt。精简版引导AI模型了解全貌,完整版提供深入信息。

内容差异——llms.txt侧重'最重要的页面',控制在50行以内。llms-full.txt可以包含100+页面链接和更详细的分类结构。

维护策略——llms.txt更新频率低(每季度),llms-full.txt可以更频繁更新(每月),确保新增重要内容及时被收录。

CHAPTER 05

llms.txt有哪些最佳实践?

llms.txt的最佳实践和注意事项:

简洁优先——llms.txt不是sitemap.xml,不需要列出所有URL。只列出最能代表网站价值的页面。过多的链接反而会稀释AI模型对核心内容的注意力。

描述精确——每个链接的描述应准确概括目标页面的内容。'GEO Schema标记完整写法指南'优于'Schema页面'。精确的描述帮助AI模型判断是否需要深入读取该页面。

分类合理——按主题或用户意图分类,而非按网站结构分类。'入门教程'、'技术指南'、'常见问题'等按用户需求分类比'栏目A'、'栏目B'更有意义。

更新标注——在文件末尾标注最后更新日期,让AI模型了解内容的新鲜度。如'最后更新: 2026-03-20'。

与sitemap配合——llms.txt提供内容指引,sitemap.xml提供完整URL清单。两者配合使用,llms.txt引导AI模型关注重点,sitemap确保全面覆盖。

CHAPTER 06

如何验证llms.txt是否被AI引擎读取?

验证llms.txt效果的可行方法:

访问日志分析——检查服务器访问日志中是否有AI爬虫(GPTBot、PerplexityBot等)请求/llms.txt路径的记录。读取频率反映AI引擎对该文件的关注程度。

AI搜索测试——在AI搜索平台搜索网站品牌名或核心主题,观察AI回答是否引用了llms.txt中列出的页面。如果引用了llms.txt中的页面而非未列出的页面,说明文件起到了指引作用。

对比实验——在创建llms.txt前后,记录核心关键词在AI搜索中的引用率变化。如果引用率在创建后明显提升,可以归因于llms.txt的效果。

持续监控——由于AI引擎对llms.txt的支持还在发展中,效果可能不是立竿见影的。建议创建后持续监控3-6个月,观察AI引用趋势的变化。

社区反馈——关注llms.txt社区和AI搜索引擎的官方文档,了解各平台对llms.txt的支持进展。及时根据新信息调整文件内容和格式。