Cloudflare 近期公布办事默许划定规矩宽峻更新,给全止业 AI 企业定下 9 月 15 日整改期限。所有 AI 厂商必须拆分搜刮爬虫取模子锻炼、AI 代庖署理公用爬虫,已完成区分的混合爬虫访谒带告白页面会被系统主动拦截。

新规笼盖规模十分普遍,新入驻平台客户、老用户新建站点以及全数免费用户网站均统一生效。网站办理员若念放止混合爬虫,只好手动建正后台设置配备安排,该调解间接改动 AI 企业获取网页锻炼素材的渠道。

年夜量站长情愿开放内容给传统搜刮引擎收录,却不愿知识产权被 AI 无偿年夜规模收罗锻炼。Cloudflare 婉止谷歌爬虫兼具搜刮取 AI 数据收罗功用,网站很难做到仅开放搜刮、隔绝距离 AI 锻炼抓取。谷歌对此做出回应,推出专属机械人工具供站点屏障 AI 锻炼取用,不影响搜刮收录。

但其中心爬虫仍会同步为搜刮内置 AI 功用收罗数据,难以完整割裂搜刮取 AI 数据需求。平台 CEO 暗示机械人流量早已近超人类访谒,止业生态急需尺度约束各类抓取止为。

Cloudflare 连绝加码内容方保护工具,从 2024 年防 AI 爬虫工具迭代至全新按价值计费形式。以往平台回收按抓取次数收费,如今晋级为 Pay Per Use,根据内容正在 AI 中产生的理想收益结算。数据隐现超对合 AI 爬虫几回抓取无更新页面,付费机制能削减无效流量,为创做者删收。

今朝该付费计划已分离两家 AI 企业试点,内容被 AI 产物调用后站长可间接获取收益。正在版权监管趋宽的情况下,新规倒逼 AI 企业汲引抓取透明度,也让网页创做者掌握更多内容控制权。