仅8.9%的网站屏蔽AI爬虫,但94.8%的网站从未被AI答案提及
AI可见性指数将“对AI可见”拆分为两个独立问题:答案存在度与机器可读性。2026年7月23日至8月2日,193个网站被用于5,978次AI助手查询,其中94.8%的网站从未被ChatGPT、Claude、Gemini或Perplexity点名;所有回答中只有1.9%提到了被询问的企业。与此同时,436个网站中仅8.9%在robots.txt中屏蔽了至少一个AI爬虫,且屏蔽主要针对GPTBot等训练爬虫,而非用于实时回答的检索代理。
Website Auditor发布了第二期AI可见性指数,尝试回答一个越来越紧迫的问题:当用户向AI助手询问某类服务商时,你的网站会不会被推荐?报告认为,“对AI可见”其实是两个不同的问题:一是答案存在度(answer presence),即AI助手是否真的念出你的名字;二是机器可读性(machine readability),即你的网站是否让AI爬虫能够读懂、抓取和引用。前者取决于外部模型的行为,后者则完全在网站所有者的控制范围内,因此报告将两者并排公布,而不合成单一分数。
核心发现并不乐观。在2026年7月23日至8月2日期间,193个网站共产生了5,978条面向购买意图问题的助手回答,结果94.8%的受审计网站从未在任何一条回答中被点名;只有10个网站被至少一位助手提及过一次。按助手分,Gemini的覆盖面最广,在2.9%的回答中提到了受审计企业,ChatGPT为1.7%,Claude和Perplexity均为1.6%。由于四款助手在同一天被询问相同的问题,这些差异体现的是助手之间的差距而非问题难度。
爬虫拦截方面,436个网站中只有39个(8.9%)在robots.txt中屏蔽了至少一个AI用户代理。值得注意的是,屏蔽主要指向训练型爬虫:GPTBot被38个网站屏蔽,ClaudeBot被36个网站屏蔽;而真正在用户提问时抓取页面以生成回答的检索型代理——OAI-SearchBot和Perplexity-User——分别只被4个和3个网站屏蔽。报告提醒,屏蔽训练爬虫对今日回答没有任何损失,但屏蔽检索代理会让网站失去被引用的机会,代价大得多。
机器可读性指标也暴露出普遍的缺口。436个网站中,79.4%发布了robots.txt,73.9%发布了sitemap.xml,77.1%有meta描述,69.5%使用了Open Graph标签,但只有54.6%的网站首页包含任意schema.org结构化数据,采用LocalBusiness模式(明示名称、地址、类别的机器可读标记)的仅占19.3%。对不少本地企业来说,这意味着AI助手在页面上只能读到散文,而没有任何可靠的实体信息。
方法上,报告强调每个域名只取一次投票权,所有百分比由整数计数在渲染时推导,失败的查询被排除而非计为缺席。数据也存在明显局限:样本是自愿运行免费审计的网站,偏向中小型本地企业,不能代表整个互联网;跨助手比较自2026-07-23才开始,因为此前的审计只有Perplexity的回答;名称匹配采用模糊匹配,基于域名被识别的情况约占五分之一,意味着存在度更可能被低估。
该指数是永久页面,后续每版更新都会增加带日期的记录。第二版(2026-08-02)将面板从175个网站扩至193个,爬虫信号语料从418个扩至436个,所有头部份额变动均小于1个百分点,Gemini继续保持最广覆盖。网站所有者也可用同一免费工具检查自身AI可见性,查询四种助手是否知道自己的业务。