Cloudflare veröffentlicht Clef für schnelle KI-Entscheidungen
Auch Cloudflare steigt in das Feld der kleinen Entscheidungsmodelle ein. Clef und Clef-flash liefern kurze, strukturierte Ergebnisse, die sich direkt in Arbeitsabläufe einbauen lassen.
Beide Modelle stehen unter der Apache-2.0-Lizenz, verarbeiten bis zu 64.000 Tokens und verstehen auch Bilder. Clef-flash basiert auf Qwen 3.5 mit 9 Milliarden Parametern. In Cloudflares eigenen Messungen antwortet Clef im Mittel in rund 209 Millisekunden, Clef-flash bleibt in 95 Prozent der Fälle unter 123 Millisekunden.
Die Modelle laufen auf Cloudflare Workers AI direkt in den Rechenzentren am Netzrand. Ein begleitender Dienst erlaubt es Kunden, eigene Daten zu sammeln, das Modell nachzutrainieren und erneut bereitzustellen.
Schnelle, kleine Modelle sind ideal, wenn eine Anwendung viele kurze Entscheidungen trifft. Wie Antwortzeit und Nutzererlebnis zusammenhängen, erklärt Latenz in KI-Anwendungen; feste Ausgabeformate beschreibt Structured Outputs.
Quellen
Eigene Zusammenfassung auf Grundlage der genannten Quellen, erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Illustration: Tokenlabor, per Programm gezeichnet, kein KI-Bild.


