Peec AI 发布的一项新研究,梳理了 ChatGPT 内部一系列 Search Index。
但最有意思的是,这项研究还发现了一些迹象,表明 OpenAI 正在进行相关实验,以比较自己的 Index 与外部搜索结果之间的表现。
OpenAI 拥有自己的 Search Index 这一点,其实并不算完全新鲜。
OpenAI 曾确认,ChatGPT 可以从其“已被索引和缓存的 Web 内容(indexed and cached web content)”中检索信息(此前也有调查发现了一个名为 Labrador 的内部系统。)
但 Peec 的最新发现真正值得关注的是:这套基础设施的规模似乎比想象中更完整,而且有证据表明,OpenAI 正在积极测试自己的 Index 到底应该在多大程度上参与 ChatGPT 的搜索结果生成。
Peec 发现了一些实验名称,其中包括 prefer-index-over-serp-v3。从名称来看,这项实验似乎是在将 OpenAI 自己的 Index 与第三方 SERP(Search Engine Results Page) 结果进行对比测试。
研究人员还发现,OpenAI 似乎针对不同类型的内容建立了独立的 Index,包括 News、Shopping、PDFs、YouTube、Academic Papers 以及其他专业化信息源。
这项分析表明,ChatGPT 的 Search Infrastructure 正变得越来越先进:
OpenAI 可以将自己 Crawled 和 Indexed 的数据,与从外部搜索服务商获得的结果结合起来,并根据具体 Query 以及正在进行的 Experiment,在两者之间进行选择。
Peec 还表示,他们观察到了一项大规模 Crawling Experiment,涉及的网页数量最多可能达到 10 亿个页面。
不过,目前 OpenAI 尚未公开确认这项 Experiment,也没有确认 Peec 对这些内部系统的解读是否准确。
而对于搜索营销从业者来说,这可能才是更值得关注的发展。
如果 OpenAI 正在构建自己的 Index,那么它距离运营一个传统 Search Engine 所需要的基础设施就更近了一步。
而测试自己的 Index 与外部 SERP 结果之间的表现,则进一步表明:OpenAI 可能正在探索,未来 ChatGPT Search 到底有多大程度可以依靠自己的基础设施来驱动。
对于 Publishers 和 SEOs 来说,这意味着 OpenAI 自己的 Crawling 和 Indexing 行为,未来的重要性可能会远高于现在。
如果 OpenAI 开始更多地依赖自己的 Index,那么网站是否能够被 OpenAI Crawl、如何被 Index,以及哪些内容最终进入 OpenAI 的 Search Index,都可能成为 SEO 领域需要重点关注的新变量。
与此同时,ChatGPT 的入口正变得越来越拥挤
ChatGPT.com 目前已经成为美国第九大网站,月访问量同比增长 48%,达到 10.9 亿次。
相比之下,Bing 在同期下降了 50%,DuckDuckGo 则下降了 16%。
但这些平台获得的流量,并不等于你的网站获得的流量。 目前仍有 95% 的 ChatGPT 用户在使用 Google,只是他们的点击行为正在减少。

当用户被强制引导进入 AI Mode 后,外部网站的 Click-through Rate(CTR)会下降 18.8 个百分点。其中,News 链接的点击率下降 12.5 个百分点,Reddit 的点击率则下降 21.2 个百分点。
真正麻烦的是 Measurement(流量衡量)问题。GA4 会将大部分来自 AI 的 Referral Traffic 归类到 Direct Traffic(直接流量) 中。甚至有一家 Publisher 的 Direct Traffic 已经占其总流量的 78%。

