// TABLE OF CONTENTS
  1. 多模态AI搜索的崛起
  2. 图片GEO优化
  3. 视频GEO优化
CHAPTER 01

多模态AI搜索的崛起

GPT-4V、Gemini等模型支持图片理解

用户可以用图片进行搜索

AI开始在回答中引用图片和视频内容

视频搜索功能开始出现在AI平台中

多模态拐点

2025年预计是多模态GEO的拐点年——当AI能理解和引用图片/视频时,只优化文本将远远不够

CHAPTER 02

图片GEO优化

图片alt文本优化:详细描述图片内容

图片Schema标记:使用ImageObject标注

图片周围文本优化:AI通过上下文理解图片

图片质量和唯一性:原创图片比通用图片更容易被引用

图片文件名优化:使用描述性文件名

image-schema.json json
{
  "@context": "https://schema.org",
  "@type": "ImageObject",
  "name": "GEO优化流程图",
  "description": "展示GEO优化从内容审计到效果验证的完整流程",
  "contentUrl": "https://example.com/images/geo-flow.png",
  "encodingFormat": "image/png"
}
CHAPTER 03

视频GEO优化

视频字幕和转录:提供完整的文字转录

VideoObject Schema标记:标注视频元信息

视频描述优化:详细的视频描述和章节标记

缩略图优化:缩略图是AI理解视频的第一入口

视频内容的文本化:将视频核心内容提炼为文字

内容类型 AI理解能力 GEO优化重点 优先级
文本 成熟 结构化+语义 最高
图片 发展中 alt+Schema+上下文
视频 早期 转录+Schema+描述 中高
音频 早期 转录+播客Schema