Cloudflare hat mit Clef ein KI-Modell veröffentlicht, das keine Sätze schreibt, sondern Entscheidungen trifft. Auf eine Frage wie „Ist diese Domain bösartig?“ liefert Clef für jede erlaubte Antwort eine Wahrscheinlichkeit. Die Gewichte stehen unter Apache-2.0-Lizenz frei zum Download. Über die Rolle des Menschen bestimmt damit ein Schwellenwert, den der Betreiber selbst festlegt.
drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügenCloudflare Clef läuft seit dem 1. Oktober auf der hauseigenen KI-Plattform Workers AI, in zwei Größen mit 27 und 9 Milliarden Parametern.[1] Branchenmedien lasen die Ankündigung als Abschied vom Menschen in der Kontrollschleife. Der Blogbeitrag von Cloudflare formuliert vorsichtiger: Agenten sollen Entscheidungen treffen und Aufgaben erledigen „oder bei Bedarf an einen Menschen abgeben“.
Das Wichtigste in Kürze
- Cloudflare Clef beantwortet fest definierte Fragen mit Wahrscheinlichkeiten statt mit Text und braucht dafür im Median 209 Millisekunden.
- Die Gewichte liegen unter Apache-2.0-Lizenz bei Hugging Face, auf Workers AI kostet Clef rund 0,21 € je Million Eingabe-Token.
- Zwischen dem 29. September und dem 1. Oktober haben OpenAI, Amazon und Cloudflare vergleichbare Entscheidungsmodelle vorgestellt.
- Ab welcher Sicherheit ein KI-Agent allein handelt, legt der Betreiber über einen Schwellenwert fest. DSGVO und AI Act knüpfen daran Pflichten.
Wie entscheidet Cloudflare Clef?

Ein klassisches Sprachmodell erzeugt seine Antwort Token für Token, selbst bei einer simplen Ja-Nein-Frage. Clef liest die Eingabe einmal ein und bewertet anschließend alle zulässigen Antworten gleichzeitig. Heraus kommt für jede Option eine Wahrscheinlichkeit, Fließtext erzeugt das Modell nicht.[1] Entwickler stellen bis zu 64 Fragen pro Anfrage, als Ja-Nein-Frage, als Auswahl aus festen Optionen oder als Bewertung auf einer Skala. Neben Text und JSON verarbeitet Clef bis zu vier Bilder.[2]
Den Tempovorsprung beziffert Cloudflare mit eigenen Messungen. Im Median antwortet Clef nach 209 Millisekunden, die kleine Variante Clef-flash nach 39 Millisekunden. Das Konkurrenzmodell Jev des Start-ups TypeSafe AI brauchte im selben Test 524 Millisekunden.[1] Beide Clef-Modelle bauen auf Alibabas Qwen auf, die große Version auf dem quelloffenen Qwen3.8-27B. Unabhängig geprüft sind die Benchmarks bislang nicht, die Trainingsdaten hält Cloudflare unter Verschluss.
Warum stellen drei US-Konzerne fast gleichzeitig Entscheidungsmodelle vor?
Den Takt gab TypeSafe AI vor, das Jev Mitte September veröffentlichte. Auf der Entwicklerkonferenz DevDay zog OpenAI am 29. September mit der Decisions API nach, die vorerst nur ausgewählte Kunden testen. Amazon stellte am 1. Oktober das Modell Strands Decider mit 2 Milliarden Parametern vor, ebenfalls mit offenen Gewichten. Binnen drei Tagen sind die großen US-Plattformen damit in eine Modellklasse eingestiegen, die ein Start-up eröffnet hatte.
Der Antrieb dahinter ist das Kostenproblem der KI-Agenten. Ein Agent trifft bei jeder Aufgabe Dutzende kleiner Entscheidungen: welches Werkzeug er aufruft, an welches Team ein Ticket geht, ob eine Eingabe Spam ist und ob ein Mensch zustimmen muss. Für jede dieser Weichen ein großes Sprachmodell anzufragen, kostet Zeit und Geld. Für Clef verlangt Cloudflare 0,24 US-Dollar je Million Eingabe-Token, umgerechnet rund 0,21 € (Kurs 0,87 vom 2. Oktober 2026).[2] Als Einsatzfelder nennt der Konzern die Einstufung von Domains in der Bedrohungsanalyse, das Verteilen von Support-Tickets, die Prüfung von Einreichungen im Bereich Trust and Safety und das Aussortieren bösartiger Bots.[1]
Denselben Kostendruck kennt Cloudflare aus der Infrastruktur. Im August erklärte der Konzern einen eigenen Linux-Container pro KI-Agent für unbezahlbar und setzte auf leichtere Arbeitsumgebungen.
Drei Entscheidungsmodelle in drei Tagen
| Anbieter | Modell | Vorgestellt | Gewichte |
|---|---|---|---|
| OpenAI | Decisions API auf Basis von GPT-6 Luna | 29.09.2026 | geschlossen, Vorschau für ausgewählte Kunden |
| Amazon | Strands Decider mit 2 Mrd. Parametern | 01.10.2026 | offen, Apache 2.0 |
| Cloudflare | Clef mit 27 Mrd. und Clef-flash mit 9 Mrd. Parametern | 01.10.2026 | offen, Apache 2.0 |
Bleibt der Mensch in der Kontrollschleife?
Die Wahrscheinlichkeiten verändern die Freigabe durch Mitarbeiter. Ein Entwickler legt fest, ab welcher Sicherheit der Agent allein handelt, etwa ab 90 %, und leitet alles darunter an einen Menschen weiter. Cloudflare hat Clef dafür auf kalibrierte Werte trainiert: Eine Angabe von 0,9 soll in neun von zehn Fällen zutreffen.[1] Prüfer sehen dann nur noch die strittigen Fälle, statt jede Aktion abzunicken.
Pauschale Freigaben schützen ohnehin weniger als gedacht. In einem Browserspiel mit 40.000 Durchläufen winkten die Teilnehmer jede dritte gefährliche Anweisung eines Coding-Agenten durch. Beim Programmieren mit Sprachmodellen ermüdet die Daueraufsicht die Entwickler zusätzlich. Das eigentliche Risiko verlagert sich deshalb ins Modell. Meldet Clef bei einer Fehlentscheidung 95 % Sicherheit, bekommt kein Mensch den Fall zu sehen. Wie ernst Behörden solche Pannen nehmen, zeigt die US-Handelsaufsicht FTC, die wegen außer Kontrolle geratener KI-Agenten gegen OpenAI und Anthropic ermittelt.
Clef schafft den Menschen nicht ab, sondern versteckt ihn hinter einer Zahl. Diesen Schwellenwert sollte die Geschäftsführung festlegen und begründen, kein Entwickler nebenbei in einer Konfigurationsdatei.
Michael Dobler, Herausgeber Dr. Web
Was bedeutet Clef für Unternehmen in der EU?
Für Betreiber in Deutschland zählt zuerst die Rechtslage. Artikel 22 der DSGVO untersagt grundsätzlich Entscheidungen, die ausschließlich automatisiert fallen und Betroffene rechtlich oder ähnlich erheblich treffen, etwa bei Krediten oder Bewerbungen. Der AI Act verlangt in Artikel 14 für Hochrisiko-Systeme eine wirksame menschliche Aufsicht. Ein dokumentierter Schwellenwert, unterhalb dessen ein Mensch entscheidet, kann einen Teil dieser Aufsicht abbilden. Fällt ein Einsatzfall unter Artikel 22, reicht die Schwelle allein nicht, weil die sicheren Fälle dann weiterhin ohne Menschen entschieden würden.
Die offenen Gewichte erlauben zudem den Betrieb im eigenen Rechenzentrum, ohne dass Kundendaten bei Cloudflare landen.[3] Branchenmedien zufolge braucht die große Version dafür rund 85 GB Grafikspeicher, Clef-flash rund 41 GB. Wie ein Konzern seine Agenten an feste Regeln bindet, zeigt EnBW: Dort hängt jeder KI-Agent am bestehenden Berechtigungskonzept.
Vor dem Einsatz eines Entscheidungsmodells empfehlen sich vier Schritte:
- Legen Sie gerne für jeden Entscheidungstyp einen eigenen Schwellenwert fest. Eine Spam-Einstufung verträgt mehr Automatik als die Ablehnung eines Kunden.
- Protokollieren Sie zu jeder Entscheidung Wahrscheinlichkeit und tatsächliches Ergebnis. Aus diesem Protokoll lesen Sie ab, ob das Modell auch mit Ihren Daten richtig kalibriert ist.
- Testen Sie Clef mit eigenen Fällen, bevor Sie sich auf die Benchmarks verlassen. Die veröffentlichten Werte stammen bislang allein vom Hersteller.
- Prüfen Sie für jeden Einsatzfall, ob Artikel 22 DSGVO oder die Hochrisiko-Liste des AI Act greift. In diesen Fällen bleibt die menschliche Entscheidung Pflicht.
Weitere Modelle und Werkzeuge für KI-Agenten ordnet Dr. Web laufend in der Rubrik Künstliche Intelligenz ein.
FAQ: Cloudflare Clef
Was ist Cloudflare Clef?
Cloudflare Clef ist ein Entscheidungsmodell für KI-Agenten, das am 1. Oktober 2026 erschienen ist. Statt Text zu schreiben, beantwortet Clef fest definierte Fragen mit einer Wahrscheinlichkeit für jede erlaubte Antwort. Clef erscheint in zwei Größen: mit 27 Milliarden Parametern und als Clef-flash mit 9 Milliarden.
Was kostet Cloudflare Clef?
Auf Workers AI berechnet Cloudflare für Clef 0,24 US-Dollar je Million Eingabe-Token, umgerechnet rund 0,21 € (Kurs 0,87 vom 2. Oktober 2026). Die Gewichte stehen zusätzlich unter Apache-2.0-Lizenz kostenlos bei Hugging Face und lassen sich auf eigener Hardware betreiben.
Ersetzt Clef die menschliche Kontrolle von KI-Agenten?
Nein. Clef liefert Wahrscheinlichkeiten. Der Betreiber legt fest, ab welcher Sicherheit ein Agent allein handelt. Fälle unterhalb dieses Schwellenwerts gehen an einen Menschen. Bei Entscheidungen nach Artikel 22 DSGVO oder Hochrisiko-Systemen im Sinne des AI Act bleibt menschliche Aufsicht Pflicht.
Welche Modelle konkurrieren mit Clef?
Seit Mitte September 2026 erschienen mehrere Entscheidungsmodelle: Jev des Start-ups TypeSafe AI, die Decisions API von OpenAI in einer Vorschau für ausgewählte Kunden und Strands Decider von Amazon mit 2 Milliarden Parametern und offenen Gewichten.
Quellen
[1] Cloudflare, Michelle Chen: „Introducing Clef: our open-source decision models, and new RL fine-tuning platform“, Cloudflare-Blog vom 1. Oktober 2026
[2] Cloudflare: „clef“, Modellseite in der Workers-AI-Dokumentation
[3] Cloudflare: „Cloudflare/clef“, Modellkarte bei Hugging Face (Lizenz Apache 2.0)
Mehr Newshunger?
- Festplattenvollzugriff in macOS: Apple verschärft die Freigabe für KI-Agenten
- Open Agent Safety Platform: Nvidia bewacht KI-Agenten mit einem eigenen Chip
- KI-Agenten brauchen einen Notausgang für den Ernstfall
- Rewe holt KI-Agenten in die Warenwirtschaft, aber nur unter Kontrolle
- Kitesurf: Cloudflares Browser für KI-Agenten spart Speicher statt Zeit
- Cloudflare OS wird Open Source: 4.000 Eigenbau-Apps in 30 Tagen
