第1项:域名和 HTTPS — AI 判断"这是一个正规网站"的第一印象
检查方法:浏览器地址栏看有没有小锁图标;访问 http 版本会不会自动跳转 https。
达标标准:
- 使用 .com 或 .cn 域名(AI 对这类顶级域名的信任度最高)
- 全站 HTTPS,HTTP 自动 301 跳转到 HTTPS
- SSL 证书有效且未过期
- 域名历史干净,没有被搜索引擎处罚过
为什么重要:如果一个网站连 HTTPS 都没有,AI 会降低它的安全评级,甚至在引用时加上"该网站可能不安全"的提示。对于做生意的企业来说,这直接等于丢掉了被 AI 推荐的机会。
第2项:首页 H1 标签 — 这是 AI 判断"你是谁"的第一眼
检查方法:打开官网首页,右键查看源代码,搜索 <h1>,看看内容是什么。
达标标准:
- H1 必须包含 品牌名 + 核心业务词。比如"余小铁GEO — 北京GEO服务商",而不是"欢迎来到我们的网站"
- 一个页面只能有一个 H1
- H1 内容要和页面 title 标签保持语义一致
常见翻车:很多网站 H1 是空的、或者写的是"Home"、"欢迎光临"——AI 拿到这样的 H1,根本不知道这个网站是干什么的,引用优先级直接垫底。
第3项:结构化数据(JSON-LD) — 给 AI 一份"官方信息摘要"
检查方法:用 Google 结构化数据测试工具或百度站长平台的"数据标注"工具检查。
达标标准:以下三种 Schema 标记是官网必须有:
- Organization:标注公司名称、Logo、描述、联系方式、地址。这是 AI 建立品牌认知的基础数据。
- BreadcrumbList:标注面包屑导航路径,让 AI 理解网站页面层级关系。
- Article(博客/文章页):标注标题、作者、发布日期、摘要。采用 Schema 的页面 AI 引用概率高出 3.2 倍。
实际例子:在 HTML 的 <head> 里插一段 JSON-LD 脚本就行,不需要改页面结构:
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"你的公司名","url":"https://你的域名.com/",
"logo":"https://你的域名.com/images/logo.png",
"description":"你的公司一句话介绍"}
</script>
第4项:页面加载速度 — AI 爬虫的耐心只有 3 秒
检查方法:用 PageSpeed Insights 或百度站长平台的"网站体检"工具测。
达标标准:
- 首页加载时间 < 3 秒(移动端 < 5 秒)
- 图片使用 WebP 格式 + 懒加载
- CSS 和 JS 文件合并压缩,不阻塞渲染
- 服务器开启 Gzip 压缩
为什么是 3 秒:AI 爬虫不是人类用户,不会等你。它给每个页面的抓取时间预算很短,超过阈值直接跳过。你花了几小时写的内容,可能因为服务器慢 1 秒就没被读到。
第5项:robots.txt — 别让 AI 爬虫吃闭门羹
检查方法:访问 你的域名.com/robots.txt,看有没有把 AI 爬虫误杀了。
达标标准:
- 明确 Allow 以下爬虫:GPTBot(ChatGPT)、CCBot / Claude-Web(Claude)、Bytespider(豆包)、Baiduspider(百度)、DeepSeekBot
- Disallow 仅限于 /css/、/js/、/images/ 等静态资源目录
- 关键内容页面全部 Allow
- Sitemap 链接写在 robots.txt 末尾
第6项:移动端适配 — 超 60% 的 AI 搜索来自手机
检查方法:用浏览器 F12 开发者工具切换到手机视图,看页面是否正常显示。
达标标准:
- viewport meta 标签正确设置
- 按钮和链接间距足够手指点击(至少 44x44px)
- 文字无需缩放即可阅读
- 表格和图片在窄屏下不溢出
百度 AI 搜索有"移动优先索引"机制,移动端体验差的网站不仅排名低,AI 也会降低对它的整体评价。
第7项:每个核心服务独立建页 — 而不是全堆在首页一页上
检查方法:你的核心服务是不是都塞在一个"服务介绍"页里?还是一个服务一个页面?
达标标准:
- 每个核心业务 / 产品单独一个页面
- 页面 URL 含关键词,如
/doubao-geo-optimization/而不是/service?id=3 - 每个服务页有自己的独立 H1、meta description 和结构化数据
为什么:AI 是按"段落单元"来匹配和引用内容的。如果你的所有服务挤在一页,AI 匹配到某个服务时可能要翻好久才找到对应的段落。独立建页 = 降低 AI 的检索成本 = 提高被引用率。
第8项:品牌信息全网一致性 — AI 的交叉验证不会放过任何矛盾
检查方法:对比以下平台的品牌信息,看有没有不一致的地方。
- ✅ 官网 vs 百度百科
- ✅ 官网 vs 天眼查/企查查
- ✅ 官网 vs 百度/高德地图
- ✅ 官网 vs 知乎/小红书/抖音企业号
需要一致的字段:公司全名(含空格和大小写)、成立时间、主营业务描述、地址、联系电话。任何一个不一致,AI 都会扣分。
第9项:页面内容用问答式结构 — 不要写成"关于我们"抒情散文
检查方法:随机点开官网几个页面,看内容是不是在回答用户会问的问题。
达标标准:
- 每个页面的 H2/H3 标题尽量用问句(如"XX 公司做哪些行业?""GEO 优化怎么收费?")
- 每个问题的答案在标题下方第一段直接给出,不铺垫
- 服务介绍页的"我能做什么"改成"你需要的 XX 服务包含哪些内容"
第10项:内容时效性 — 别让 AI 看到 2024 年的"最新消息"
检查方法:检查官网有没有日期标注为 2024 年甚至更早的"最新动态""行业新闻"。
达标标准:
- 每篇文章标注发布日期和最后更新日期
- 过时的内容要么更新、要么加个"已归档"标签、要么删除
- 首页如果有"新闻动态"区块,确保里面有近 3 个月内的内容
AI 对时效性极其敏感。如果你网站最新的一条"新闻"是 2024 年 3 月的,AI 会判定这个网站已经"不活跃了",降低整体的引用优先级。
快速自检清单(可打印贴在墙上)
| # | 检查项 | 已达标 | 需修复 |
|---|---|---|---|
| 1 | 域名 .com/.cn + 全站 HTTPS | ☐ | ☐ |
| 2 | 首页 H1 含品牌名 + 核心业务词 | ☐ | ☐ |
| 3 | Organization / BreadcrumbList / Article Schema | ☐ | ☐ |
| 4 | 首页加载 < 3 秒 | ☐ | ☐ |
| 5 | robots.txt Allow 五大 AI 爬虫 | ☐ | ☐ |
| 6 | 移动端适配良好 | ☐ | ☐ |
| 7 | 核心服务独立建页 | ☐ | ☐ |
| 8 | 品牌信息全网一致 | ☐ | ☐ |
| 9 | 页面内容问答式结构 | ☐ | ☐ |
| 10 | 内容时效性维护 | ☐ | ☐ |
总结:基础项不是一次性的,是持续性的
这 10 项里,1-8 项是"做一次就管用"的基础配置;9-10 项是"需要持续维护"的内容运营。建议安排如下:
- 第 1 周:完成第 1-6 项(技术类配置,大部分半天就能搞定)
- 第 2 周:完成第 7-8 项(服务页拆分 + 品牌信息核查)
- 持续:第 9-10 项纳入日常内容发布流程
10 项全部达标的官网,在 AI 平台上就具备了最基本的"被看见"的资格。虽然不能保证一定被引用,但至少不会因为基础问题被 AI 过滤掉。
—— 余小铁📝 本文更新于 2026年7月9日。官网技术标准变化较快,建议定期复查本清单。