Cloudflare hat Anfang Oktober eine Websuche-API als Beta direkt in AI Gateway eingeführt. Sie erlaubt es einem Agenten oder einer Anwendung, aktuelle Web-Ergebnisse zum Zeitpunkt der Inferenz in den Kontext eines Modells einzuspeisen, ohne einen separaten Suchdienst anzubinden. Die Ankündigung fiel in die Birthday Week des Unternehmens und adressiert ein bekanntes Problem: Ein Modell, dessen Wissen am Trainingsstichtag endet, weiß nichts über das, was seitdem passiert ist.
Drei Suchanbieter, eine Rechnung
Die Funktion stützt sich auf drei von Cloudflare ausgewählte Partner für die Webindexierung: Ceramic.ai, Exa und Linkup. Jede Anfrage benennt den gewünschten Anbieter explizit, was die Wahl zwischen einer allgemeinen Suche und stärker auf semantische Suche oder Agenten-Workflows ausgerichteten Engines erlaubt. Die Abrechnung läuft über die für die Inferenz bereits genutzten AI-Gateway-Guthaben, zum Listenpreis der Partner und ohne Aufschlag durch Cloudflare.
| Anbieter | Ausrichtung | Zugriff |
|---|---|---|
| Ceramic.ai | Allgemeine Websuche für Agenten | REST, Workers-Binding |
| Exa | Semantische Suche, auf RAG zugeschnitten | REST, Workers-Binding |
| Linkup | Strukturierte Ergebnisse mit Quellenangabe | REST, Workers-Binding |
Integration aus Entwicklersicht
Zwei Zugriffswege stehen zur Verfügung: ein klassischer, per Bearer-Token authentifizierter REST-Endpunkt und ein natives Binding für Workers. Letzteres erspart Anwendungen, die bereits auf der Plattform laufen, einen zusätzlichen HTTP-Umweg.
const ergebnisse = await env.AI.websearch({
gatewayId: "default",
query: "aktuelle stabile Laravel-Version",
provider: "exa",
limit: 5,
});
Jede Websuche-Anfrage läuft durch dieselben Observability-Logs wie ein gewöhnlicher Inferenzaufruf in AI Gateway.
Governance und Umgang mit Daten
Teams können bei jedem Anbieter eigene Schlüssel (BYOK) einbringen, statt sich auf das von Cloudflare verwaltete Konto zu verlassen. Jeder Partner ist mit seinem Status zur Datenspeicherung gekennzeichnet, und alle drei haben sich verpflichtet, robots.txt sowie die Anforderungen von Cloudflare an verifizierte Bots einzuhalten.
Was man sich merken sollte
Cloudflare macht Websuche zu einem Infrastrukturbaustein, der sich genauso konsumieren lässt wie ein Modellaufruf. Das vereinfacht den Bau von Agenten, die eine aktuelle Information prüfen können, ohne dass das Team einen separaten Vertrag und eine separate Rechnung mit einem Suchanbieter verwalten muss. In Verbindung mit Protokollen, wie sie in der MCP-Spezifikation vom Juli 2026 beschrieben sind, erleichtert dieser Baustein den Produktivbetrieb von Agenten, die verifizierte Inhalte erzeugen. Die Integration per Workers-Binding senkt die Einstiegshürde für Projekte, die bereits auf der Plattform gehostet werden, deutlich.
Bei Projekten, in denen Echtzeitsuche bislang mit selbstgebautem Scraping oder einem schlecht ratenbegrenzten Google-Search-API-Schlüssel improvisiert wird, verändert so ein Baustein die Rechnung: ein Endpunkt, eine Rechnung, keine drei verschiedenen Anbieterverträge mehr zu verwalten. Ob die Ergebnisqualität von Exa oder Linkup bei kniffligen Anfragen mit einer klassischen Google-Suche mithält, muss sich im echten Einsatz erst noch zeigen, bevor man einen Produktiv-Agenten daran anschließt. — Simon Janvier
Zum Weiterlesen: die vollständige offizielle Ankündigung im Cloudflare-Blog.
