Blog-Artikel
Cloudflare Clef vs. Jev: Was Entscheidungsmodelle für Ihre digitale Transformation mit KI bedeuten
Cloudflare hat mit Clef ein offenes Entscheidungsmodell gegen Jev gestartet. Benchmarks, Preis und der Platz von Entscheidungsmodellen in der KI-Transformation.
Zwei Wochen nachdem Jev Entscheidungsmodelle bekannt gemacht hat, bringt Cloudflare ein eigenes Modell heraus. Das verändert, wie Sie eine digitale Transformation mit KI planen können.
Am 1. Oktober hat Cloudflare Clef und Clef-flash veröffentlicht, zwei Entscheidungsmodelle auf Workers AI. Die Gewichte stehen unter Apache 2.0 auf Hugging Face. Laut Cloudflare führt Clef die meisten öffentlichen Benchmarks für Entscheidungsmodelle an und ist schneller als Jev. Dieser Beitrag zeigt, was die Zahlen aussagen, wo Jev weiter vorne liegt, was die Modelle kosten und wo ein Entscheidungsmodell hingehört, wenn Sie ein Unternehmen mit KI modernisieren.
Falls Sie Entscheidungsmodelle noch nicht kennen, lesen Sie zuerst unseren Vergleich von Jev, Laya und Kev. Dieser Beitrag knüpft daran an.
Was ist Cloudflare Clef?
Clef ist ein Entscheidungsmodell. Es schreibt keinen Text. Sie geben ihm einen Zustand (eine Support-Anfrage, eine Domain, eine Rechnung) und eine Reihe typisierter Fragen. Es liefert für jede zulässige Antwort eine Wahrscheinlichkeit zurück. So kann Ihr Code ein Ticket weiterleiten, eine Anfrage blockieren oder an einen Menschen übergeben.
Das Changelog von Cloudflare beschreibt Clef als Modell derselben Familie wie Jev von Typesafe. Es gibt zwei Größen:
- Clef hat 27 Milliarden Parameter, basiert auf Qwen3.8-27B und hat ein Kontextfenster von 64.000 Token.
- Clef-flash hat 9 Milliarden Parameter, basiert auf Qwen3.5-9B und zielt auf Pfade, in denen es auf Latenz ankommt.
Beide Modelle haben einen Vision-Encoder und können bis zu vier Bilder zusammen mit dem Zustand verarbeiten. Laut Cloudflare klassifiziert Jev heute nur Text. Die API ist Jev-kompatibel, sodass Teams nach Angaben von Cloudflare die Modelle ohne Umbau der Integration tauschen können.
Clef vs. Jev: Was sagen die Benchmarks?
Das sind Cloudflares eigene Zahlen. The Register weist darauf hin, dass Cloudflare die Werte selbst gemeldet hat und sie noch nicht für das Ranking im offiziellen Jev Decision Index reproduziert wurden. Verstehen Sie sie als starke Behauptung, nicht als Urteil.
Über 10 Entscheidungs-Benchmarks hinweg erzielt laut Cloudflare ein Clef-Modell bei 7 den Höchstwert. Einige Ergebnisse aus der veröffentlichten Tabelle:
| Benchmark | Clef | Clef-flash | Jev |
|---|---|---|---|
| BFCL (case exact) | 98,47 | 98,76 | 95,75 |
| BANKING77 (macro-F1) | 94,20 | 90,93 | 79,74 |
| CLINC150+OOS (macro-F1) | 97,43 | 66,77 | 89,27 |
| When2Call (Accuracy) | 72,37 | 65,58 | 80,97 |
| BRIGHT (nDCG@10) | 45,91 | 39,26 | 47,52 |
Bei When2Call und BRIGHT liegt Jev weiter vorn. Bei den Workflow-Tests von Typesafe schlug Clef Jev in drei von vier Bereichen: Rechnungsverarbeitung, Kundenservice und Sicherheitsvorfälle. Bei der Beobachtbarkeit von Agent-Traces verlor Clef mit 68,5 zu 71,6.
Auch Clef-flash hat eine Schwäche. Bei CLINC150+OOS erreicht es nur 66,77 und liegt damit weit unter Clef und Jev. Das kleine Modell ist nicht bei jeder Aufgabe ein kostenloses Upgrade.
Wie schnell ist Clef?
Die von Cloudflare veröffentlichte Latenz über seine 43 Benchmark-Läufe:
| Latenz | Clef | Clef-flash | Jev |
|---|---|---|---|
| Median | 209,3 ms | 38,8 ms | 524,1 ms |
| p95 | 238,6 ms | 122,4 ms | 536,0 ms |
Cloudflare nennt auch einen realen Anwendungsfall. Das Threat-Intelligence-Team nutzt Clef zusammen mit einem Browser-Werkzeug, um Websites zu klassifizieren. Clef brauchte 2,2 Sekunden, um eine Seite abzurufen, darzustellen und zu klassifizieren, und lieferte mehrere Kategorien mit Wahrscheinlichkeiten. Das schnellste allgemeine Sprachmodell, gpt-oss-120b, brauchte 4,7 Sekunden und lieferte zwei.
Die Geschwindigkeit kommt aus der Funktionsweise. Clef liest die Eingabe in einem Durchgang und bewertet alle zulässigen Antworten parallel. Es erzeugt also nie Text Token für Token.
Preis und Hardware von Clef
Laut The Register kostet Clef 0,24 US-Dollar pro Million Token, Jev dagegen 0,042 US-Dollar, also fast das Sechsfache. Crypto Briefing nennt 0,09 US-Dollar pro Million Eingabe-Token für Clef-flash. Diese Preise konnten wir auf Cloudflares eigener Preisseite nicht bestätigen. Prüfen Sie sie dort, bevor Sie kalkulieren.
Sie können die Gewichte auch selbst betreiben und den Hosting-Preis umgehen. Cloudflares Michelle Chen sagte The Register, Clef-flash brauche eine GPU mit mindestens 41 GB VRAM und Clef eine mit 85 GB, jeweils bei einer Anfrage zur Zeit und einem Kontextfenster von 64.000 Token.
Ein Hinweis zum Begriff “Open Source”: Die Gewichte stehen unter Apache 2.0, aber Chen bestätigte gegenüber The Register, dass die Trainingsdaten nicht öffentlich sind.
Cloudflare startet außerdem einen Fine-Tuning-Dienst mit Reinforcement Learning für Clef, zunächst mit direkter Unterstützung durch eigene Ingenieure für Design-Partner, später als Self-Service-Plattform.
Wo Entscheidungsmodelle in der digitalen Transformation mit KI hingehören
Bei den meisten Projekten zur digitalen Transformation mit KI geht es nicht um ein einzelnes cleveres Modell. Es geht darum, einen Prozess, den Menschen heute von Hand erledigen, etwa Anfragen sortieren, Rechnungen prüfen oder Leads zuteilen, so umzubauen, dass Software die Routineentscheidungen übernimmt und Menschen die schwierigen behalten.
Genau dafür sind Entscheidungsmodelle gemacht. Ein großes Sprachmodell liest und schreibt. Ein Entscheidungsmodell trifft die begrenzte Entscheidung dazwischen: dringend oder nicht, welches Team, welche Kategorie, eskalieren oder nicht. Cloudflares eigenes Beispiel hat dieselbe Form: Eine Support-Nachricht geht hinein, heraus kommen typisierte Antworten mit Wahrscheinlichkeiten, mit denen Ihr Code das Ticket weiterleitet, eskaliert oder an einen Menschen übergibt.
Das ist unsere Einschätzung, nicht die von Cloudflare: Was eine Transformation tragfähig macht, ist nicht die Modellwahl. Es ist die Arbeit drumherum. Dazu gehören den richtigen Prozess zu wählen, ihn an Ihre bestehenden Systeme anzubinden, Konfidenzschwellen festzulegen und jede Entscheidung zu protokollieren. Modelle werden sich weiter ändern. Der Workflow darum bleibt.
Was Unternehmen vor einem Wechsel testen sollten
Alles Folgende ist unser Rat, nicht der von Cloudflare.
- Nutzen Sie Ihre eigenen Daten. Nehmen Sie 500 bis 1.000 echte Tickets, Rechnungen oder Anfragen, bei denen die richtige Antwort bekannt ist. Öffentliche Benchmarks sagen nichts darüber, wie ein Modell mit Ihren Kategorien umgeht.
- Testen Sie die Verteilung, nicht den Durchschnitt. Clef-flash ist bei manchen Benchmarks sehr gut und bei anderen schwach. Prüfen Sie die Fälle, die Sie bei Fehlern Geld kosten.
- Legen Sie eine Konfidenzschwelle fest. Der Wert eines Entscheidungsmodells liegt in der Wahrscheinlichkeit, die es liefert. Leiten Sie unsichere Fälle an einen Menschen weiter und messen Sie, wie oft das passiert.
- Rechnen Sie pro Entscheidung, nicht pro Token. Vergleichen Sie die gehosteten Kosten mit den GPU-Kosten für den Eigenbetrieb bei Ihrem echten Volumen.
- Halten Sie den Wechsel günstig. Clef und Jev nutzen laut Cloudflare dieselbe API-Form. Legen Sie Ihre Aufrufe hinter eine dünne Schicht, dann können Sie das Modell wechseln, wenn die nächste Version erscheint.
- Protokollieren Sie jede Entscheidung. Ein Modell, das ohne Aufzeichnung entscheidet, ist in einem Audit schwer zu verteidigen. Das gilt besonders unter dem EU AI Act, den wir in EU AI Act Compliance technisch umsetzen behandeln.
Wie sich ein Entscheidungsmodell zu den Agenten verhält, die es steuert, zeigt OpenAI Dots vs. Meta Muse. Meta hat einen zweiten Agenten gebaut, der nur die geplanten Aktionen von Muse überwacht. Das ist dieselbe Idee: Der Entscheidungsschritt bleibt getrennt vom Agenten, der handelt.
Häufig gestellte Fragen
Was ist Cloudflare Clef?
Clef ist ein Entscheidungsmodell mit offenen Gewichten, das Cloudflare am 1. Oktober 2026 veröffentlicht hat. Es beantwortet typisierte Fragen zu einer Eingabe und liefert für jede zulässige Antwort eine Wahrscheinlichkeit, statt Text zu erzeugen. Es gibt zwei Größen, Clef und Clef-flash, und es läuft auf Cloudflare Workers AI oder auf Ihrer eigenen GPU.
Ist Clef besser als Jev?
In Cloudflares eigenen Benchmarks erzielt Clef bei 7 von 10 Tests den Höchstwert und ist schneller. Jev liegt weiter vorn bei When2Call, bei BRIGHT und bei Typesafes Test zur Beobachtbarkeit von Agent-Traces. Cloudflares Werte wurden noch nicht unabhängig reproduziert. Testen Sie daher beide mit Ihren eigenen Daten.
Was kostet Clef?
The Register nennt 0,24 US-Dollar pro Million Token für Clef gegenüber 0,042 US-Dollar für Jev. Crypto Briefing nennt 0,09 US-Dollar pro Million Eingabe-Token für Clef-flash. Aktuelle Preise finden Sie auf Cloudflares Preisseite.
Kann ich Clef lokal betreiben?
Ja. Die Gewichte liegen unter Apache 2.0 auf Hugging Face. Laut Cloudflare braucht Clef-flash eine GPU mit mindestens 41 GB VRAM und Clef eine mit 85 GB, für eine einzelne Anfrage bei einem Kontextfenster von 64.000 Token.
Ist Clef ein direkter Ersatz für Jev?
Cloudflare sagt, die API sei vollständig Jev-kompatibel, sodass sich Modelle leicht tauschen lassen. Führen Sie trotzdem zuerst eigene Tests durch, denn die Genauigkeit unterscheidet sich je nach Aufgabe.
Fazit
Clef zeigt, dass Entscheidungsmodelle nicht das Produkt eines einzelnen Unternehmens sind. Jeder kann jetzt einen schnellen, begrenzten Entscheidungsschritt in einen Agenten einbauen. Die Wahl hängt von der Genauigkeit auf Ihren Daten, der Latenz und den Kosten pro Entscheidung ab. Lesen Sie die Tabellen der Anbieter als Ausgangspunkt und führen Sie einen eigenen Test durch. Der bleibende Wert liegt im Workflow, den Sie um das Modell herum aufbauen.
So unterstützt Incresco Sie
Incresco setzt die digitale Transformation mit KI um. Unsere Arbeit im Bereich KI-Transformation deckt die oben beschriebenen Bausteine ab:
- KI-Strategie und Beratung: Roadmaps, Reifegradanalysen und der Business Case, damit Sie zuerst den richtigen Prozess wählen.
- Individuelle KI-Entwicklung: KI-Agenten, Copiloten und intelligente Automatisierung, zugeschnitten auf Ihre Workflows.
- KI-Integration: Anbindung von KI an Ihre bestehenden Systeme durch Workflow-Automatisierung, API-Integration und Modernisierung von Altsystemen.
Wenn Sie ein Entscheidungsmodell an einem Ihrer eigenen Workflows testen oder planen möchten, wo Agenten in Ihren Betrieb passen, sprechen Sie mit unserem Team.