Cloudflare kondigde op 1 oktober 2026 Clef en Clef-Flash aan: open-weight AI-modellen die invoer omzetten in een getypeerde beslissing of score binnen een vooraf bepaald schema. De gewichten kwamen uit onder de Apache 2.0-licentie; gehoste inferentie is beschikbaar via Workers AI.

Wat doet een beslismodel?

Een beslismodel beantwoordt een afgebakende vraag met een vooraf gekozen soort antwoord. Dat kan bijvoorbeeld ja of nee zijn, een keuze uit opgegeven opties of een score. De invoer kan tekst, JSON, afbeeldingen of video bevatten.

Die aanpak past bij een taak waarin software een classificatie of keuze nodig heeft, zoals het doorsturen van een verzoek naar een volgende stap. Een open tekstmodel schrijft doorgaans een antwoord in vrije tekst; Clef en Clef-Flash geven juist een antwoord dat binnen het opgegeven schema past.

De gehoste API kan vragen van de typen noul (ja/nee), choice (keuze) en score verwerken. Eén verzoek kan 1 tot 64 vragen bevatten.

Clef en Clef-Flash vergeleken

VariantParametersBackboneInvoerLicentie
Clef27 miljardQwen3.8-27BTekst, JSON, afbeeldingen en videoApache 2.0
Clef-Flash9 miljardQwen3.5-9BTekst, JSON, afbeeldingen en videoApache 2.0

Voor Clef vermeldt Cloudflare een contextvenster van 65.536 tokens. De variantnamen zeggen dus niet alleen iets over de omvang: de twee modellen hebben ook verschillende backbones.

Wat laten Cloudflares evaluaties zien?

Cloudflare rapporteerde uiteenlopende resultaten per taak. Op BANKING77 haalde Clef een macro-F1-score van 94,20, tegenover 79,74 voor Jev; op CLINC150+OOS waren de scores respectievelijk 97,43 en 89,27. Bij When2Call scoorde Jev hoger dan Clef: 80,97 tegenover 72,37. Ook op BRIGHT lag Jev voor, met een nDCG@10-score van 47,52 tegenover 45,91. Het gaat om evaluaties die Cloudflare zelf rapporteerde, niet om onafhankelijk gerepliceerde benchmarks.

Cloudflare beschreef ook een eigen workflow voor het ophalen, weergeven en classificeren van een website. Daarin deed Clef dat in 2,2 seconden; gpt-oss-120b had 4,7 seconden nodig en gaf twee classificaties terug. Voor Clef rapporteerde Cloudflare in dat voorbeeld een kans van 95% voor mode, 85% voor e-commerce en minder dan 1% voor phishing.

Welke fine-tuning bood Cloudflare aan?

Cloudflare bood hands-on fine-tuning aan via zijn team van forward-deployed engineers (FDE's). Het selfserviceplatform voor fine-tuning en het opnieuw uitrollen van aangepaste modellen beschreef het bedrijf als een latere stap.