跳转到内容
GoingGEO.com
返回

外贸GEO可见性审计:AI 搜索怎么看你的网站

作者:GoingGEO 团队

外贸GEO可见性(AI Visibility)是指 AI 搜索引擎能够读取、解析并理解你网站内容的程度。它是 GEO 的地基——内容写得再好,如果 AI 爬虫在技术上读不到或读不懂,这些内容对 AI 引擎就等于不存在。可见性和“排名”是两回事:排名问的是“你排第几”,可见性问的是“AI 到底能不能看见你”。

可见性是外贸GEO 的第零步。 很多外贸企业投入大量精力写内容、做优化,却忽略了一个前提:AI 爬虫根本没抓到他们的核心内容。最典型的场景——产品参数全做成图片、公司介绍只在 PDF 目录册里、关键信息要点击 tab 才显示。这些对人类访客没问题,对 AI 爬虫却是盲区。AI 引擎无法引用它读不到的内容——这是 GEO 的铁律,抓不到的内容永远不会被引用。

本文讲三件事:AI 爬虫怎么看你的网站、外贸网站最常见的 6 个盲区、一份可见性自检与修复方案。

本文是外贸GEO 技术基础系列的一部分。可见性解决“AI 看不看得见”的问题,产品页怎么写 解决“AI 引不引用”的问题,结构化数据入门 解决“AI 理解不理解”的问题。完整框架看 外贸GEO完全指南


AI 可见性是什么

定义

AI 可见性是指一个网页的内容能被 AI 搜索引擎(ChatGPT、Perplexity、Google AI Overviews、Claude 等)的爬虫成功抓取、正确解析、并纳入其引用索引的程度。

它包含三个层次:

  1. 可抓取(Crawlable):AI 爬虫能访问到这个页面,没有被 robots.txt 或技术障碍挡住
  2. 可解析(Parsable):页面内容能被转化成 AI 能理解的纯文本,而不是困在图片、PDF、JS 组件里
  3. 可引用(Citable):解析出的文本结构清晰,AI 能从中提取出可用的答案片段。标注了 Schema.org 结构化数据(如 Product Schema、FAQPage Schema)的内容,AI 确定性地提取关键信息的效率远高于非结构化文本。

三层缺一不可。很多外贸网站卡在第二层——页面人类能看,AI 看不到。

可见性 ≠ 排名

传统 SEO 关心“排名”:同一个页面,排第 1 还是第 10。GEO 关心“可见性”:AI 到底有没有把你纳入候选池。

一个排名靠前的页面,可能因为内容困在图片里,对 AI 完全不可见。反过来,一个排名一般的页面,如果内容是干净的纯文本,反而更容易被 AI 引用。这就是为什么有些外贸企业 Google 排名不错,却在 ChatGPT、Perplexity 里搜不到自己——排名好不等于 AI 可见性好。


AI 爬虫和传统搜索爬虫的 4 个关键差异

要理解为什么“AI 看不到”,先要明白 AI 爬虫和 Googlebot 这类传统搜索爬虫的工作方式不同。

差异 1:纯文本优先 vs 渲染优先

Googlebot 会用 headless 浏览器渲染页面,执行 JavaScript,读取最终用户看到的完整 DOM。所以 Google 能索引大量 JS 渲染的内容。

AI 爬虫(尤其是 ChatGPT、Claude 这类大模型抓取器)更倾向于直接抓取 HTML 源码里的纯文本,对完整渲染的依赖更低。原因是成本——为每个页面跑 headless 渲染太贵,AI 平台普遍选择“先抓纯文本,够用就行”。

对外贸网站的含义:如果你的核心内容是靠 JavaScript 在页面加载后才注入 DOM 的,Google 可能看得到,AI 可能看不到。

差异 2:JavaScript 渲染支持有限

Google 有成熟的 Web Rendering Service,能处理大多数 JS 框架(React、Vue、Angular)。AI 爬虫对 JS 的支持参差不齐,不同平台差异较大:

对外贸网站的含义:用 SPA 框架(纯前端渲染)做的独立站,AI 可见性天然偏低。服务端渲染(SSR)或静态生成(SSG)对 AI 更友好。

差异 3:PDF 和图片文字支持有限

外贸网站大量使用两种格式:

Google 有 OCR 和 PDF 解析能力,能提取部分图片和 PDF 里的文字。AI 爬虫对这两类格式的支持明显更弱——PDF 解析成本高,图片 OCR 准确率不稳定,大多数 AI 平台选择“读不到就跳过”。

对外贸网站的含义:你的核心卖点和参数,必须有一份纯文本版本,不能只存在于 PDF 或图片里。

差异 4:抓取频率和深度更低

Googlebot 会持续、深度地抓取一个网站,发现新页面的速度很快。AI 爬虫的抓取频率和深度都更低:

对外贸网站的含义:新发布的页面,AI 引擎可能几周才发现。深层的产品详情页可能根本不被抓取。


外贸网站最常见的 6 个“AI 看不到”问题

下面 6 个问题在外贸独立站里出现频率极高,每一个都会让一部分内容对 AI 变成盲区。

问题 1:核心内容只有图片版本

典型场景:产品参数表是一张设计精美的图片,规格、材质、认证全在图里,页面上没有对应的文字。

为什么 AI 看不到:AI 爬虫读到的是 <img src="specs.jpg" alt="产品参数">,alt 文字往往只有“产品参数”四个字,真正的参数值 AI 一个都读不到。

修复:把图片里的参数同步写成纯文本表格或列表,图片作为视觉补充保留。这是修复优先级最高的问题。

问题 2:核心内容只在 PDF 里

典型场景:公司介绍、产品目录、认证证书只有 PDF 下载链接,页面正文里没有这些信息的文字版。

为什么 AI 看不到:AI 爬虫对 PDF 的解析不稳定,很多平台直接跳过 PDF 链接。即使解析了,PDF 里的排版(分栏、表格)也常被解析错。

修复:把 PDF 里的关键信息摘录成网页正文。PDF 可以保留作为下载物,但不能是唯一载体。

问题 3:JavaScript 渲染依赖

典型场景:用 React/Vue 做的纯前端渲染独立站,页面 HTML 源码几乎是空的 <div id="root"></div>,所有内容由 JS 在浏览器里生成。

为什么 AI 看不到:AI 爬虫抓到的 HTML 源码里没有内容,只有空的容器 div。即使部分 AI 平台支持 JS 渲染,也不保证能渲染完整。

修复:改用服务端渲染(SSR)或静态生成(SSG)。如果改架构成本太高,至少把核心内容(产品名、参数、公司介绍)做成服务端输出的纯 HTML。

问题 4:robots.txt 屏蔽了 AI 爬虫

典型场景:网站 robots.txt 里写了 Disallow: /,或者屏蔽了 GPTBot、ClaudeBot、PerplexityBot 等 AI 爬虫的 User-agent。

为什么 AI 看不到:这是最直接的自毁——你主动告诉 AI 爬虫不要抓你。

修复:检查 robots.txt,确保允许主流 AI 爬虫。GoingGEO 的做法是明确允许 GPTBot、ClaudeBot、PerplexityBot,并配合 llms.txt 提供 AI 友好的站点说明。这是一个常被忽略却最容易修复的问题。

问题 5:内容藏在交互组件里

典型场景:产品详情用 tab 切换显示,默认 tab 只有一段简介,完整参数、认证、应用场景要点击其他 tab 才显示。或者用 accordion(手风琴)折叠长内容。

为什么 AI 看不到:AI 爬虫通常不模拟点击。tab 和 accordion 里“默认隐藏”的内容,AI 可能当作不存在。虽然现代爬虫对这类组件的支持在改善,但远不如直接展示的内容可靠。

修复:核心信息(参数、认证、应用场景)默认展开,直接在页面正文里。tab 和 accordion 只用于次要的、补充性的内容。

问题 6:页面加载慢导致抓取超时

典型场景:首页堆满未压缩的大图、未配置缓存、用了重型动画库,首屏加载 5 秒以上。

为什么 AI 看不到:AI 爬虫有抓取超时限制(通常几秒)。页面没在超时前返回完整内容,爬虫会放弃,这个页面就不会被索引。

修复:压缩图片、配置浏览器缓存、移除非必要的重型脚本。这同时有利于 Core Web Vitals 和 AI 可见性。


10 项可见性自检清单

对着这份清单逐项检查你的网站,能快速定位“AI 看不到”的盲区。

#检查项怎么查通过标准
1robots.txt 是否允许 AI 爬虫打开 你的域名/robots.txtGPTBot、ClaudeBot、PerplexityBot 允许或未屏蔽
2核心产品参数是否有纯文本版本在产品页“查看网页源代码”能在 HTML 源码里搜到参数值,不只是图片
3公司介绍是否在网页正文看 About 页面正文有完整公司介绍文字,不只是 PDF 下载
4页面是否依赖 JS 渲染查看网页源代码源码里能看到正文内容,不是空 div
5认证信息是否有文字版找认证页面证书图片旁有文字说明认证名称和含义
6关键内容是否默认展开关闭 JS 后看页面参数、认证、应用场景不靠点击才显示
7首页加载速度用 PageSpeed InsightsLCP < 2.5 秒,DOMContentLoaded < 3 秒
8站点地图是否提交查 Google Search Consolesitemap 状态正常,新页面能被发现
9是否有 llms.txt打开 你的域名/llms.txt存在且内容是 AI 友好的站点说明
10用 AI 实测可见性在 Perplexity 搜你的品牌名和核心产品能在引用里看到自己的网站

前 9 项是技术自检,第 10 项是端到端验证——前面 9 项都通过,第 10 项才算真正过关。这份清单可以作为 外贸GEO检查清单 的技术补充,专门针对可见性这一层。


修复优先级

发现问题后,按这个优先级修复,把精力投在回报最高的地方。

P0(立即修复,1 周内)

P0 是“不做就一定看不见”的项,必须最先处理。

P1(2-4 周内)

P1 是“做了能显著提升”的项,建议按页面重要程度逐个推进。

P2(持续维护)

P2 是长期维护项,确保可见性不随时间退化。


怎么验证修复效果

修完不等于有效,要用下面三个方法验证。

方法 1:Perplexity 实测

这是最直接的端到端验证。在 Perplexity 搜索你的品牌名、核心产品词、典型采购问题,看你的网站是否出现在引用来源里。

建议每次修复后等 1-2 周(给 AI 爬虫重新抓取的时间),再用 Perplexity GEO 测试工具 里的方法系统检测。

方法 2:查看网页源代码

修复前后,分别“查看网页源代码”(Ctrl+U),在源码里搜索你的核心内容关键词。修复前搜不到、修复后能搜到,说明可见性确实提升了。

这是验证“内容是否真正进入 HTML 源码”的最快方法,不需要等 AI 重新抓取。

方法 3:Google Search Console 索引状态

虽然 GSC 反映的是 Google 的索引(不等于 AI 索引),但 Google 能正常索引是 AI 可见性的基础。如果 GSC 显示某个页面“已编入索引”,说明这个页面的内容至少对传统爬虫是可读的——这是 AI 可见性的必要条件。

如果 GSC 显示“已发现,尚未编入索引”或“已抓取,尚未编入索引”,往往意味着页面有可见性问题(内容薄、JS 依赖、加载慢),这些问题同样会影响 AI 爬虫。


FAQ

Q:我的网站 Google 排名很好,为什么在 ChatGPT 里搜不到?

A:排名好不等于 AI 可见性好。Google 用 headless 浏览器渲染页面,能读到 JS 生成的内容、能解析部分图片和 PDF。AI 爬虫更依赖纯文本,对这些格式支持弱。最常见的原因是:你的核心内容靠 JS 渲染或藏在图片/PDF 里,Google 看得到,AI 看不到。按本文第 3 节的 6 个问题逐项排查,通常能找到原因。关于外贸GEO 和 SEO 在技术层面的差异,看 外贸GEO和SEO有什么区别

Q:robots.txt 怎么写才能对 AI 友好?

A:最基本的做法是不要屏蔽 AI 爬虫。如果你想明确欢迎,可以在 robots.txt 里写:

User-agent: GPTBot
Allow: /

User-agent: ClaudeBot
Allow: /

User-agent: PerplexityBot
Allow: /

同时确保没有 Disallow: / 这类全站屏蔽。配置完用 Google Search Console 的 robots.txt 测试器验证没有误伤。llms.txt 这个 AI 专属的说明文件,可以配合使用,给 AI 爬虫一份站点结构说明。

Q:产品参数表必须放弃图片设计吗?

A:不用放弃,但要补一份纯文本版本。正确做法是:保留设计精美的参数图片给人类看,同时在图片下方或旁边用纯文本表格再写一遍同样的参数。这样人类体验不变,AI 也能读到。很多外贸网站只做图片版是因为觉得文字版“丑”,其实用简洁的 HTML 表格完全不影响美观。产品页的整体写法看 外贸GEO产品页怎么写

Q:我的独立站是 Shopify/WordPress 建的,会有 JS 渲染问题吗?

A:通常不会。Shopify 和 WordPress 默认是服务端输出的,HTML 源码里就有内容,AI 爬虫能直接读到。需要警惕的是用纯前端框架(React SPA、Vue SPA)定制的主题或页面——这类页面 HTML 源码几乎是空的,内容全靠 JS 生成。判断方法:查看网页源代码,如果源码里看不到正文,就是 JS 渲染依赖。

Q:AI 爬虫多久会重新抓取我修复后的页面?

A:取决于平台。Perplexity 抓取较频繁,通常 1-2 周内会重新抓取更新过的页面。ChatGPT 依赖 Bing 索引,更新周期 2-4 周。Google AI Overviews 跟随 Google 的索引更新,热门页面几天,冷门页面几周。建议修复后等 4 周,再用 Perplexity 实测。如果 4 周后仍无变化,可能是修复没生效或还有其他可见性问题。关于各平台的抓取特性,看 6 大 AI 搜索平台外贸指南

Q:llms.txt 是什么,必须配置吗?

A:llms.txt 是 2024 年出现的一个新文件格式,专门给 AI 爬虫看的站点说明文件,放在网站根目录。它告诉 AI 爬虫“这个站点有哪些重要内容、怎么组织”。目前不是强制配置——没有 llms.txt AI 也能抓你,但配置了能帮 AI 更高效地理解你的站点结构。对外贸新站,建议作为 P2 优先级,先把 P0、P1 的可见性问题修好再考虑。

Q:网站加载慢真的会影响 AI 可见性吗?

A:会。AI 爬虫有抓取超时限制,通常几秒。如果你的页面因为大图、重型脚本导致首屏加载超过 3-5 秒,AI 爬虫可能在内容返回前就超时放弃,这个页面就不会被索引。这也是为什么 Core Web Vitals 优化同时有利于 SEO 和 GEO——快的页面既讨好 Google 也讨好 AI。

Q:用 Perplexity 搜不到自己的网站,一定是可见性问题吗?

A:不一定。可能是可见性问题(AI 读不到你的内容),也可能是内容质量问题(AI 读到了但不觉得值得引用),还可能是新站尚未被索引(AI 还没发现你)。排查顺序:先用本文第 4 节的清单做技术自检,排除可见性问题;再用 外贸GEO检查清单 排查内容质量;如果都没问题,可能是时间不够——新站通常需要 4-8 周被 AI 引擎发现和索引。GEO 的基础概念看 外贸GEO是什么

Q:多语言网站的可见性要分别优化吗?

A:要。AI 爬虫按语言和 URL 分别抓取,英文版和中文版的可见性是独立的。常见坑是:英文版内容做了纯文本优化,中文版还是图片参数表;或者英文版 robots.txt 允许 AI 爬虫,中文版(子目录或子域名)继承了限制却没检查。建议两种语言版本分别跑一遍可见性自检清单。


分享本文:

上一篇
中小工厂外贸GEO从哪开始:没有内容团队的最小可行方案
下一篇
外贸GEO标题优化指南:标题写法直接决定 AI 是否引用你