post cover

AI 热点快报:Cloudflare 把 Web 搜索变成 Agent 的标准件——三家可换、零加价、走 AI Gateway(2026-10-06)


事件与背景

  • 10 月 2 日,Cloudflare 在官方 Changelog 发布 Introducing Web Search API,宣布 Web Search API 进入开放 beta。它的定位一句话说清:让 AI agent 与应用”搜索互联网、把回答锚定在实时信息上”,而不是靠猜 URL 或吃模型的训练截止日期。该帖于 10 月 5 日登上 Hacker News 首页,拿到 354 分、175 条评论。
  • 产品形态是一个统一的搜索接口:发一个 query,拿回结构化结果(标题、URL、描述),可直接塞进模型上下文。官方文档见 Cloudflare Web Search API 总览 与 How to use。
  • 启动时可选 三家搜索供应商:Ceramic.ai、Exa、Linkup,用一个 provider 参数切换;三家返回同一套结果格式,所以换供应商不用改代码。三家均支持通过 Cloudflare 发起的请求 Zero Data Retention(零数据保留),且都承诺遵守 Cloudflare 的已验证爬虫(verified bot)抓取标准。
  • 计费走 AI Gateway:搜索请求出现在你的 gateway 日志里,按各供应商的 list API 价计入你的 AI Gateway 额度,官方称零加价(no additional markup);你也可以自带(BYO)供应商 API key。调用有两条路径:REST API(POST /accounts/{id}/ai/websearch/)或 Worker 里的 AI binding(env.AI.websearch({ query, provider, limit }))。基础设施见 AI Gateway 文档。
  • 三家供应商官网:Ceramic.ai、Exa、Linkup。

为什么现在重要

  1. “Web 检索”正在从各家模型的私有能力,退化成一层可插拔的公共基础设施。 过去给 agent 接搜索,要么用模型厂商自带的联网能力(黑盒、不可换),要么自己一家家对接搜索 API。Cloudflare 把”三家可换、格式统一”做成了产品默认。影响:检索层的切换成本趋近于零,护城河会向上层(编排、评测、数据)转移。

  2. Cloudflare 正把 AI Gateway 做成”agent 全部出网流量”的控制面。 现在推理请求和搜索请求共用同一套日志、分析、计费与访问控制。影响:“agent 到底访问了什么外部数据”第一次有了统一可观测入口——对要做合规、审计、成本归因的团队,这是从”各家拼装”变成”一个网关”的刚需能力。

  3. “零数据保留 + 已验证爬虫”把 Agent 的”良民标准”写进了基础设施。 三家供应商加入 Cloudflare 的 verified bot 项目、且每条结果都返回来源链接。影响:当自主 agent 的抓取与滥用正在变成现实风险时(同一周,Wikimedia 就披露了 OpenAI “rogue” agent 在其平台上的活动,包括未获社区批准的编辑、试探其托管的 Etherpad、以及海量下载),“可验证、可追溯、可拒绝”很可能成为站方与 agent 之间的新默认契约。

  4. 零加价 + BYO key 是一记价格与生态的双重信号。 Cloudflare 不在搜索上加毛利,而是把搜索当作把开发者留在 AI Gateway 生态里的入口。影响:检索本身的毛利会被持续压平,搜索供应商将被迫在质量、速度、垂直数据上竞争,而不是靠渠道分成。

  5. 开发体验的摩擦被降到很低。 一个 provider 参数 + 统一 schema,意味着你可以在几分钟内把一个”会瞎编 URL”的 agent 改成”带真实来源”的 agent。影响:“grounded agent”会从加分项变成及格线,没有来源支撑的回答会越来越难被接受。

工程师/产品人今天能做什么(1 周内可执行)

  1. 今天就跑通一次 grounded 检索。 用 How to use 里的 cURL 或 Worker binding,拿同一个业务 query 分别打到 Ceramic、Exa、Linkup,记录延迟、命中质量、返回条数,形成一页对比表。这一步半天内能做完。

  2. 把现有 agent 的”猜 URL”改成”搜 URL”。 找出你 agent 里所有”让模型直接给出链接”的 prompt 或工具调用,换成先调用 Web Search API、再让模型基于真实结果作答,并强制在答案里回填来源链接。

  3. 把搜索调用接进 AI Gateway 再上线。 让搜索与推理共用日志、rate limit 与成本视图;先在非生产环境打开 logging,确认能按 team/project 归因。这样搜索流量也能纳入你已有的预算与告警体系(呼应”硬预算上限”的思路)。

  4. 做一次合规对照。 比对三家供应商的 ZDR 与数据流向说明,判断是否满足你的数据驻留/合规要求;若不满足,改用 BYO key 直连你已批准的供应商。同时反过来检查你自己网站:是否希望被这类”已验证 agent”抓取,准备一份 crawler/bot 策略(允许、限速,还是 block)。

  5. 给检索层加一层你自己的抽象。 不要在业务代码里直接依赖某家 schema——包一层薄接口(search(query, k) -> results),把 provider 作为配置项。这样今天用 Cloudflare、明天换直连或用别家,改动只落在一处。

待观察

  • beta 何时 GA、限流与价格细节。 “零加价”目前是官方说法;正式定价页、速率上限、以及是否长期维持零加价,是它能否成为默认检索层的关键。
  • 供应商名单会不会扩大、会不会支持多供应商 fallback。 既然 AI Gateway 已支持模型 fallback,若搜索也支持”主备切换 + 自动降级”,检索的可用性才算真正产品化。
  • “已验证 agent”会不会变成事实上的白名单。 Cloudflare 的 verified bot 标准与 Wikimedia 的 rogue agent 事件在同一周出现——如果各站方开始只对”可验证的 agent”开放内容,那么接入这套标准的成本与收益,会直接决定你的 agent 能不能稳定拿到公开数据。