返回首页

2026年7月13日

Cloudflare × OpenAI 研究试点:AI 搜索获得网络信号后,内容站该看什么?

Cloudflare 与 OpenAI 启动 AI 搜索研究试点。本文区分发现、使用、训练三类访问,解释已确认事实、未来计划和内容站现在能做的检查。

核心要点

  • Cloudflare 与 OpenAI 的 7 月 8 日公告是研究试点,不是排名提升或流量保证。
  • 内容被发现、被答案系统使用、被用于训练,是三种不同的访问目的。
  • 站长现在应检查 canonical、更新时间、来源链接和机器人分类,而不是追逐未经证实的 AI 流量承诺。
  • 平台政策
  • 搜索与 GEO
  • 模型
AI 搜索发现、使用和训练三类信号边界图
Original Wesbase AI search signals diagram

先说结论

Cloudflare 与 OpenAI 在 2026 年 7 月 8 日宣布启动 AI 搜索研究试点,重点是研究网络层面的新鲜度、流量质量和页面变化信号,能否帮助 AI 搜索更准确、更及时地发现和索引公开网页。

这件事重要,但不要把它读成“接入 Cloudflare 就会获得 ChatGPT 流量”。目前公开信息支持的结论是:AI 搜索正在尝试使用更丰富的网页变化信号;不支持的结论是:某个站点已经因此获得排名、引用或点击提升。

发生了什么?

Cloudflare 说,这项试点会把它从全球网络观察到的内容新鲜度、流量质量和实际页面变化,与 OpenAI 的搜索能力和真实用户查询结合起来,研究如何更高效地发现相关内容,并改善答案的准确性和时效性。

这不是一次普通的模型发布,也不是给站长的新排名规则。它更像是在测试:如果系统知道一张网页最近有没有真正变化,是否就不必反复抓取数百万张没有变化的页面,同时更快找到值得重新检查的内容。

三类访问必须分开看

类型主要问题站长能确认什么不能直接推出什么
发现 / 搜索系统能否找到新鲜、相关的页面?页面是否可抓取、结构清楚、来源稳定可发现不等于会被引用
使用 / Agent答案或智能体能否使用信息完成任务?是否有清楚的事实、步骤、限制和权限边界被访问不等于带来点击
训练内容是否被用于模型改进?站点政策和机器人控制是否明确开放搜索不等于必须开放训练

Cloudflare 7 月 1 日的另一份公告,明确把 search、agent use 和 training 作为不同意图讨论,并提出未来的分类、分析和商业化方向。这与 7 月 8 日的研究试点有关联,但不是同一件事:前者包含未来产品和政策计划,后者是研究试验。

已确认事实、推断与未知信息

已确认

  • 7 月 8 日的公告称,Cloudflare 与 OpenAI 正在启动研究试点。
  • 试点关注网络层面的新鲜度、流量质量和页面变化信号。
  • Cloudflare 说,双方会结合网络信号、搜索系统和真实用户查询,研究内容发现和索引效率。
  • Cloudflare 7 月 1 日公告提出了区分搜索、Agent 和训练的方向,并把 2026 年 9 月 15 日写成相关测试和默认设置的未来节点。
  • Cloudflare 的 AI 更新日志还记录了 AI Search 对象键过滤、Browser Run 无障碍树等产品变化,但这些功能本身不等于 AI 引用增加。

推断

如果这种信号最终能稳定工作,内容更新频率、页面变化是否真实、来源是否清楚,可能比单纯反复请求抓取更重要。对内容作者来说,这意味着“写完就不管”的页面,未来可能比有明确更新时间、版本记录和来源链接的页面更难被系统判断。

但这仍然是推断。公开材料没有给出参与试点的网站名单、具体排名算法、引用提升数据,也没有证明单个站点能通过某个设置获得更多流量。

仍不确定

  • 试点是否会影响 ChatGPT 或其他答案系统对某个站点的排序。
  • Cloudflare 的网络信号是否会成为公开标准,还是只服务于合作方测试。
  • 分析面板能否准确区分展示、引用、点击和训练使用。
  • 9 月 15 日相关默认设置会如何按套餐、地区和站点状态落地。

内容站现在应该检查什么?

1. 先让页面可被正确理解

每篇重要内容都应有稳定 URL、明确标题、更新时间、作者或机构身份、来源链接和清楚的结论段。对于教程,还要写清适用版本、失败边界和最后验证时间。

这不是为了“讨好 AI”,而是为了让任何读者、搜索引擎和答案系统都能判断这篇内容讲什么、何时成立、哪些部分需要谨慎。

2. 不要把三类机器人当成一个开关

检查当前站点的 robots.txt、Cloudflare AI Crawl Control 或其他 CDN 访问规则,确认搜索发现、Agent 使用和训练访问是否被混在一起。不同站点的授权选择可能不同:允许搜索发现,不代表必须允许训练;允许引用,也不等于允许整站批量提取。

如果你还不知道当前规则是什么,先记录现状和影响范围,再做调整。不要因为一则试点新闻,把所有访问一次性放开。

3. 把“被发现”和“产生价值”分开记录

未来如果看到 AI 机器人访问增加,仍要继续问三个问题:页面是否被答案引用?引用是否带来回流?回流是否进入了真实阅读或业务流程?单纯的抓取量不能回答这三个问题。

同样,Cloudflare 提到的分析和付费使用方向仍属于产品与生态建设的一部分。它可能帮助内容方获得更多可见性,但不能替代真实的引用、点击和用户反馈。

现在行动、观察,还是等待?

选择适合谁下一步
现在行动有公开资料、文档或教程的站点补齐更新时间、来源、canonical、版本和事实边界
先观察依赖广告、订阅或授权收入的内容方分开记录搜索、Agent、训练访问,不把试点当流量承诺
暂缓调整没有确认当前机器人规则和站点政策的团队先盘点现状,避免在证据不足时全站放开或全站封锁

FAQ

Cloudflare 与 OpenAI 的研究试点已经影响排名了吗?

公开公告只说明双方在研究网络层面的新鲜度、流量质量和页面变化信号如何帮助 AI 搜索发现和索引内容,没有公布对单个网站排名、引用或流量的保证。

AI 搜索、Agent 和训练爬虫有什么区别?

搜索通常为了发现和回答当前问题,Agent 访问可能服务于任务执行,训练则是模型改进用途。三者的权限、价值和站长应有的控制不应混为一谈。

独立站现在要不要为了 AI 搜索开放所有爬虫?

不应因为一个试点就全部开放。先确认当前 robots、Cloudflare AI Crawl Control 和站点政策,再分别判断搜索可发现性、Agent 使用和训练访问。

Cloudflare 的新分析功能能保证获得 AI 引用吗?

不能。分析能力可以帮助观察机器人访问和可能的回流,但是否被引用、排名、产生点击仍取决于答案系统和内容相关性。

图片和信源说明

封面图为 Wesbase 原创 SVG,使用“发现 / 使用 / 训练”三条内容访问路径表达边界,没有使用 Cloudflare 或 OpenAI 标志、官方截图或第三方图片。产品事实来自 Cloudflare 7 月 8 日研究试点公告、7 月 1 日 Agentic Internet 公告和 Cloudflare AI 更新日志;关于“可发现性不等于流量”“信号可能改变内容维护重点”的内容已按推断或不确定性处理。

来源与延伸阅读

  1. https://www.cloudflare.net/news/news-details/2026/Cloudflare-Announces-Research-Pilot-with-OpenAI/default.aspx
  2. https://www.cloudflare.com/en-ca/press/press-releases/2026/cloudflare-allows-the-agentic-internet-to-flourish-with-a-simple-philosophy-your-content-your-rules/
  3. https://developers.cloudflare.com/changelog/product-group/ai/