// TABLE OF CONTENTS
  1. GEO对网站架构有什么要求?
  2. 哪些结构化数据对GEO最重要?
  3. 如何配置robots.txt以支持AI爬虫?
  4. 页面性能对GEO有影响吗?
  5. llms.txt文件是什么?如何创建?
CHAPTER 01

GEO对网站架构有什么要求?

GEO友好的网站架构需要满足以下要求:

扁平化结构——页面层级不超过3层,确保AI爬虫能快速到达任何页面。

清晰的URL结构——使用语义化URL(如/example/geo-guide而非/example?id=123),帮助AI理解页面主题。

内部链接网络——页面之间通过相关的内部链接互相关联,帮助AI理解内容之间的关系。

XML Sitemap——提供完整的sitemap.xml,列出所有可索引页面及其更新频率。

面包屑导航——使用面包屑导航和BreadcrumbList结构化数据,帮助AI理解页面在网站中的位置。

CHAPTER 02

哪些结构化数据对GEO最重要?

对GEO影响最大的结构化数据类型包括:

Article——标记文章类型、标题、作者、发布日期等基本信息。

FAQPage——标记FAQ问答对,这是AI引擎最喜爱的内容格式之一。

HowTo——标记操作步骤类内容,AI引擎在回答'如何做'类问题时会优先引用。

BreadcrumbList——标记面包屑导航,帮助AI理解页面层级。

Organization——标记组织信息,增强品牌在AI回答中的识别度。

Product——标记产品信息,在产品推荐类查询中被引用。

CHAPTER 03

如何配置robots.txt以支持AI爬虫?

robots.txt配置对GEO至关重要,需要明确允许主要AI爬虫访问:

允许GPTBot(ChatGPT Search)——User-agent: GPTBot / Allow: /

允许PerplexityBot——User-agent: PerplexityBot / Allow: /

允许Baiduspider(百度文心一言)——User-agent: Baiduspider / Allow: /

允许Google-Extended(Google AI Overviews)——User-agent: Google-Extended / Allow: /

允许ClaudeBot——User-agent: ClaudeBot / Allow: /

允许CCBot——User-agent: CCBot / Allow: /

同时保留通用规则:User-agent: * / Allow: /

CHAPTER 04

页面性能对GEO有影响吗?

页面性能直接影响AI爬虫的抓取效率和内容索引质量:

加载速度——页面加载时间超过3秒,AI爬虫可能放弃抓取。目标是将首屏加载时间控制在2秒以内。

Core Web Vitals——LCP(最大内容渲染)<2.5秒,FID(首次输入延迟)<100ms,CLS(累计布局偏移)<0.1。

JavaScript渲染——如果页面内容依赖JavaScript渲染,AI爬虫可能无法获取完整内容。确保关键内容在HTML源码中直接可见。

移动端适配——AI搜索引擎越来越多地使用移动端UA抓取,确保页面在移动端正常显示。

CHAPTER 05

llms.txt文件是什么?如何创建?

llms.txt是类似robots.txt的文本文件,专门为AI大语言模型提供网站内容指引:

作用——告诉AI模型网站的主要内容结构、重要页面和更新频率,帮助AI更高效地理解和引用网站内容。

放置位置——放在网站根目录,如 https://example.com/llms.txt

基本格式——包含网站简介、主要内容分类、重要页面链接和更新频率信息。

与robots.txt的区别——robots.txt控制爬虫访问权限,llms.txt提供内容指引。两者互补使用效果最佳。

创建工具——可以使用llms-txt-generator等在线工具自动生成。