Nach der Veröffentlichung von DeepSeek V4.1 Flash im September 2026 lag der Abstand führender chinesischer KI-Modelle zu ihren US-Konkurrenten laut einer Bloomberg-Intelligence-Schätzung bei 3 Prozent. In derselben Schätzreihe war der Abstand von 15 Prozent zu Jahresbeginn auf etwa 9 Prozent im Mai gesunken.

Der Abstand nach DeepSeek V4.1 Flash

Die Schätzung vergleicht Benchmark-Ergebnisse führender Modelle aus China und den USA. Ein Benchmark fasst zusammen, wie Modelle bei festgelegten Aufgaben abschneiden. Die 3 Prozent beziehen sich auf diesen Leistungsvergleich, nicht auf eine einzelne Anwendung.

Die drei Werte derselben Schätzreihe

ZeitpunktGeschätzter Abstand bei Benchmark-Ergebnissen
Früher im Jahr 202615 %
Mai 2026etwa 9 %
Nach der Veröffentlichung von DeepSeek V4.1 Flash im September 20263 %

Stanford HAI: ein eigener Vergleich vom März 2026

Im AI Index 2026 bezifferte Stanford HAI den Vorsprung des Spitzenmodells von Anthropic in seinem Vergleich chinesischer und US-amerikanischer Modelle für März 2026 auf 2,7 Prozent. Stanford HAI zufolge wechselten sich Modelle aus beiden Ländern seit Anfang 2025 mehrfach an der Spitze ab.

Was Benchmark-Ergebnisse über den Einsatz aussagen

Ein Benchmark-Score zeigt, wie ein Modell bei den Aufgaben des jeweiligen Tests abschneidet. Für den Einsatz im Alltag zählt, ob diese Aufgaben zur eigenen Arbeitslast passen. Die gemeldeten Werte beziehen sich auf führende Modelle; sie beschreiben nicht automatisch die Leistung jedes Modells bei jeder Aufgabe.

NeoTeo hat Mozillas Einschätzung chinesischer Open-Weight-Modelle bereits in einem eigenen Beitrag eingeordnet. Dort ging es um Aufgabenhorizonte; hier steht der Abstand bei Benchmark-Ergebnissen im Mittelpunkt.