§ 6.1 — 体检
抓取与索引:第一步永远是「机器能不能读到你」
- robots.txt 体检确认没有误封关键目录,同时按策略放行 AI 爬虫(GPTBot、ClaudeBot、PerplexityBot 等)——这直接影响 GEO 可见性。
- sitemap.xml 提交保持 sitemap 只含可索引的规范 URL,提交到 Google Search Console 与 Bing Webmaster Tools,并监控「已发现/已编入索引」的缺口。
- canonical 与重复内容每个页面用 rel=canonical 声明规范地址,避免分页、参数、http/https 造成的重复收录稀释权重。
- 别把正文藏在 JS 里客户端渲染的正文若不在初始 HTML 中,部分爬虫与 AI 抓取器可能读不到。关键内容服务端直出最稳妥。
- 内链结构重要页面距首页不超过三次点击;用描述性锚文本互链(本站各章节页的「继续阅读」就是范例)。
§ 6.2 — 数据
结构化数据:给机器递「内容说明书」
schema.org 标注是 AEO 与富媒体结果的基础设施,优先级排序:
- Article / BlogPosting:所有文章页基础款,标注作者、日期、图片。
- FAQPage:问题型内容必备(示例见 AEO 章节源码)。
- HowTo:教程与流程类内容。
- Organization / Person:全站级身份声明,支撑 E-E-A-T。
- BreadcrumbList:面包屑,改善结果展示与站点结构理解。
写完务必用 Google 富媒体测试与 Schema 校验器验证,且标注内容必须与页面可见正文一致——虚假标记会被处罚。
§ 6.3 — 性能
Core Web Vitals:三大指标怎么过
| 指标 | 含义 | 达标线 | 最常见病因 |
|---|---|---|---|
| LCP | 最大内容绘制(主内容多快出现) | ≤ 2.5s | 未压缩的首屏大图、慢字体、阻塞渲染的脚本 |
| INP | 交互到下一次绘制(点了多久有反应) | ≤ 200ms | 主线程长任务、过重的第三方脚本 |
| CLS | 累积布局偏移(页面跳不跳) | ≤ 0.1 | 无宽高的图片/广告位、晚加载的字体 |
快速见效的三件事:给所有图片标注宽高并转 WebP/AVIF;字体用 font-display: swap 并预加载首屏字重;第三方脚本统一延迟加载。优化后以 Search Console 的 CWV 报告(真实用户数据)为准,实验室分数只做参考。