Bloomberg Intelligence estimó que, tras el lanzamiento en septiembre de 2026 de DeepSeek V4.1 Flash, los modelos chinos líderes quedaban un 3% por detrás de sus rivales estadounidenses en puntuaciones de pruebas de referencia. La estimación forma parte de una secuencia en la que la diferencia se había reducido desde principios de año.
La estimación tras DeepSeek V4.1 Flash
La cifra del 3% se refiere a la brecha entre las puntuaciones de modelos líderes de China y Estados Unidos. Bloomberg Intelligence la asoció al periodo posterior al lanzamiento de DeepSeek V4.1 Flash, sin atribuir a ese modelo el resultado de cada sistema chino.
Así cambió la brecha estimada
Las tres cifras de Bloomberg Intelligence describen la evolución de una misma comparación: la diferencia pasó del 15% a principios de año a cerca del 9% en mayo y al 3% después del lanzamiento de septiembre.
| Momento de la estimación | Brecha en las puntuaciones de referencia |
| A principios de 2026 | 15% |
| Mayo de 2026 | Cerca del 9% |
| Después del lanzamiento de septiembre de 2026 | 3% |
La comparación de Stanford HAI corresponde a marzo
En marzo de 2026, Stanford HAI situó en el 2,7% la ventaja del modelo puntero de Anthropic en su comparación entre modelos de Estados Unidos y China. Es una observación distinta de la estimación posterior de Bloomberg Intelligence: corresponde a otro periodo y a su propia comparación.
Stanford HAI también señaló que los modelos de ambos países se habían alternado en el liderazgo varias veces desde principios de 2025. En febrero de ese año, DeepSeek-R1 igualó brevemente al modelo estadounidense que entonces lideraba.
La conversación sobre los modelos chinos de pesos abiertos tiene otro contexto en la cobertura anterior de NeoTeo sobre el análisis de Mozilla. La estimación del 3% se refiere a puntuaciones de referencia de modelos líderes; el rendimiento en una tarea concreta se valora según esa tarea.