AI 快讯 编译自 the_decoder #行业分析#AI 代理#网络安全

Cloudflare CEO:机器人流量已超人类,未来网站将“付费爬取”

Cloudflare CEO Matthew Prince 指出,AI 代理驱动的机器人流量已超过人类流量,比预期提前两年。他预言网站将转向“付费爬取”模式,这对内容创作者和 AI 公司意味着什么?本文解读事件细节及对中文圈的影响。

编译发布 2026/06/04 原文发布 2026/06/04

一句话看懂

Cloudflare CEO 表示,AI 代理导致机器人流量超过人类,未来网站可能要求 AI 公司付费才能爬取数据。

详细发生了什么

Cloudflare 首席执行官 Matthew Prince 表示,互联网上的机器人流量已超过人类流量,这比他此前预测的 2027 年底提前了两年。Prince 将这一激增归咎于 AI 代理(AI agents)的广泛使用,这些代理自动抓取网站数据用于训练模型或执行任务。

他在一次采访中直言:“很明显,未来将是‘付费爬取’(pay to crawl)。”这意味着网站可能会向 AI 公司收取费用,以允许其爬虫访问内容。Prince 认为,这种模式将帮助网站所有者从 AI 带来的流量中获利,同时遏制无节制的数据抓取。Cloudflare 作为全球最大的 CDN 和网络安全服务商之一,其数据反映了互联网流量的真实变化。

中文圈视角

“付费爬取”模式对中文互联网生态影响深远。目前,国内主流 AI 公司如百度、阿里、字节跳动等都在大量爬取中文网站数据训练大模型。如果这一模式成为主流,中文内容网站(如知乎、微信公众号、百科类站点)可能效仿,向 AI 公司收取数据使用费。

对中文用户而言,好消息是这可能会激励更多优质原创内容的生产——网站有了收入来源,可以更好地维护内容质量。坏消息是,小型 AI 创业公司可能因无力支付爬取费用而面临数据短缺,进一步拉大与巨头的差距。此外,国内已有类似“数据堂”等数据交易平台,但缺乏统一标准,Cloudflare 的提议或加速行业规范化。

值得注意的是,中文互联网的“围墙花园”现象本就严重,付费爬取可能加剧信息孤岛,使跨平台数据获取更加困难。

几条值得记住的细节

  • Cloudflare CEO 原预测 2027 年底机器人流量超过人类,但实际在 2025 年中就已实现。
  • AI 代理(如 OpenAI 的 GPTBot、Google 的 Google-Extended)是流量激增的主要推手。
  • “付费爬取”模式类似于 API 收费,但针对的是网站原始内容的批量抓取。
  • Cloudflare 已推出 AI Audit 工具,帮助网站识别和分类 AI 爬虫流量。
  • 目前尚无统一收费标准,预计将根据爬取频率、数据量等因素定价。

一句话总结

网站向 AI 公司收费爬取数据可能成为新常态,内容创作者有望从中获益,但中小 AI 公司面临成本压力。