第1项:域名和 HTTPS — AI 判断"这是一个正规网站"的第一印象

检查方法:浏览器地址栏看有没有小锁图标;访问 http 版本会不会自动跳转 https。

达标标准:

  • 使用 .com 或 .cn 域名(AI 对这类顶级域名的信任度最高)
  • 全站 HTTPS,HTTP 自动 301 跳转到 HTTPS
  • SSL 证书有效且未过期
  • 域名历史干净,没有被搜索引擎处罚过

为什么重要:如果一个网站连 HTTPS 都没有,AI 会降低它的安全评级,甚至在引用时加上"该网站可能不安全"的提示。对于做生意的企业来说,这直接等于丢掉了被 AI 推荐的机会。

第2项:首页 H1 标签 — 这是 AI 判断"你是谁"的第一眼

检查方法:打开官网首页,右键查看源代码,搜索 <h1>,看看内容是什么。

达标标准:

  • H1 必须包含 品牌名 + 核心业务词。比如"余小铁GEO — 北京GEO服务商",而不是"欢迎来到我们的网站"
  • 一个页面只能有一个 H1
  • H1 内容要和页面 title 标签保持语义一致

常见翻车:很多网站 H1 是空的、或者写的是"Home"、"欢迎光临"——AI 拿到这样的 H1,根本不知道这个网站是干什么的,引用优先级直接垫底。

第3项:结构化数据(JSON-LD) — 给 AI 一份"官方信息摘要"

检查方法:用 Google 结构化数据测试工具或百度站长平台的"数据标注"工具检查。

达标标准:以下三种 Schema 标记是官网必须有:

  • Organization:标注公司名称、Logo、描述、联系方式、地址。这是 AI 建立品牌认知的基础数据。
  • BreadcrumbList:标注面包屑导航路径,让 AI 理解网站页面层级关系。
  • Article(博客/文章页):标注标题、作者、发布日期、摘要。采用 Schema 的页面 AI 引用概率高出 3.2 倍。

实际例子:在 HTML 的 <head> 里插一段 JSON-LD 脚本就行,不需要改页面结构:

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"你的公司名","url":"https://你的域名.com/",
 "logo":"https://你的域名.com/images/logo.png",
 "description":"你的公司一句话介绍"}
</script>

第4项:页面加载速度 — AI 爬虫的耐心只有 3 秒

检查方法:用 PageSpeed Insights 或百度站长平台的"网站体检"工具测。

达标标准:

  • 首页加载时间 < 3 秒(移动端 < 5 秒)
  • 图片使用 WebP 格式 + 懒加载
  • CSS 和 JS 文件合并压缩,不阻塞渲染
  • 服务器开启 Gzip 压缩

为什么是 3 秒:AI 爬虫不是人类用户,不会等你。它给每个页面的抓取时间预算很短,超过阈值直接跳过。你花了几小时写的内容,可能因为服务器慢 1 秒就没被读到。

第5项:robots.txt — 别让 AI 爬虫吃闭门羹

检查方法:访问 你的域名.com/robots.txt,看有没有把 AI 爬虫误杀了。

达标标准:

  • 明确 Allow 以下爬虫:GPTBot(ChatGPT)、CCBot / Claude-Web(Claude)、Bytespider(豆包)、Baiduspider(百度)、DeepSeekBot
  • Disallow 仅限于 /css/、/js/、/images/ 等静态资源目录
  • 关键内容页面全部 Allow
  • Sitemap 链接写在 robots.txt 末尾

第6项:移动端适配 — 超 60% 的 AI 搜索来自手机

检查方法:用浏览器 F12 开发者工具切换到手机视图,看页面是否正常显示。

达标标准:

  • viewport meta 标签正确设置
  • 按钮和链接间距足够手指点击(至少 44x44px)
  • 文字无需缩放即可阅读
  • 表格和图片在窄屏下不溢出

百度 AI 搜索有"移动优先索引"机制,移动端体验差的网站不仅排名低,AI 也会降低对它的整体评价。

第7项:每个核心服务独立建页 — 而不是全堆在首页一页上

检查方法:你的核心服务是不是都塞在一个"服务介绍"页里?还是一个服务一个页面?

达标标准:

  • 每个核心业务 / 产品单独一个页面
  • 页面 URL 含关键词,如 /doubao-geo-optimization/ 而不是 /service?id=3
  • 每个服务页有自己的独立 H1、meta description 和结构化数据

为什么:AI 是按"段落单元"来匹配和引用内容的。如果你的所有服务挤在一页,AI 匹配到某个服务时可能要翻好久才找到对应的段落。独立建页 = 降低 AI 的检索成本 = 提高被引用率。

第8项:品牌信息全网一致性 — AI 的交叉验证不会放过任何矛盾

检查方法:对比以下平台的品牌信息,看有没有不一致的地方。

  • ✅ 官网 vs 百度百科
  • ✅ 官网 vs 天眼查/企查查
  • ✅ 官网 vs 百度/高德地图
  • ✅ 官网 vs 知乎/小红书/抖音企业号

需要一致的字段:公司全名(含空格和大小写)、成立时间、主营业务描述、地址、联系电话。任何一个不一致,AI 都会扣分。

第9项:页面内容用问答式结构 — 不要写成"关于我们"抒情散文

检查方法:随机点开官网几个页面,看内容是不是在回答用户会问的问题。

达标标准:

  • 每个页面的 H2/H3 标题尽量用问句(如"XX 公司做哪些行业?""GEO 优化怎么收费?")
  • 每个问题的答案在标题下方第一段直接给出,不铺垫
  • 服务介绍页的"我能做什么"改成"你需要的 XX 服务包含哪些内容"

第10项:内容时效性 — 别让 AI 看到 2024 年的"最新消息"

检查方法:检查官网有没有日期标注为 2024 年甚至更早的"最新动态""行业新闻"。

达标标准:

  • 每篇文章标注发布日期和最后更新日期
  • 过时的内容要么更新、要么加个"已归档"标签、要么删除
  • 首页如果有"新闻动态"区块,确保里面有近 3 个月内的内容

AI 对时效性极其敏感。如果你网站最新的一条"新闻"是 2024 年 3 月的,AI 会判定这个网站已经"不活跃了",降低整体的引用优先级。

快速自检清单(可打印贴在墙上)

#检查项已达标需修复
1域名 .com/.cn + 全站 HTTPS
2首页 H1 含品牌名 + 核心业务词
3Organization / BreadcrumbList / Article Schema
4首页加载 < 3 秒
5robots.txt Allow 五大 AI 爬虫
6移动端适配良好
7核心服务独立建页
8品牌信息全网一致
9页面内容问答式结构
10内容时效性维护

总结:基础项不是一次性的,是持续性的

这 10 项里,1-8 项是"做一次就管用"的基础配置;9-10 项是"需要持续维护"的内容运营。建议安排如下:

  • 第 1 周:完成第 1-6 项(技术类配置,大部分半天就能搞定)
  • 第 2 周:完成第 7-8 项(服务页拆分 + 品牌信息核查)
  • 持续:第 9-10 项纳入日常内容发布流程

10 项全部达标的官网,在 AI 平台上就具备了最基本的"被看见"的资格。虽然不能保证一定被引用,但至少不会因为基础问题被 AI 过滤掉。

—— 余小铁

📝 本文更新于 2026年7月9日。官网技术标准变化较快,建议定期复查本清单。