Le 8 octobre 2026, une affirmation attribuée à Microsoft a circulé sur la possibilité d’exécuter localement un modèle DeepSeek Flash sur NVIDIA RTX Spark, avec une quantification à 1,6 bit et environ 60 Go de mémoire. Le modèle associé aux 284 milliards de paramètres varie selon les récits : DeepSeek-V4-Flash dans l’un, DeepSeek-V4.1-Flash dans l’autre.

L’affirmation sur l’exécution locale

La quantification réduit la précision numérique utilisée pour représenter les paramètres d’un modèle. Dans cette affirmation, le réglage mentionné est de 1,6 bit et la mémoire évoquée est d’environ 60 Go.

Deux versions de DeepSeek Flash

Les récits associent les 284 milliards de paramètres tantôt à DeepSeek-V4-Flash, tantôt à DeepSeek-V4.1-Flash. Or, dans son annonce du 10 septembre 2026, DeepSeek indique que V4.1-Flash compte 552 milliards de paramètres au total, avec 8 milliards de paramètres actifs pour l’entrée et 16 milliards pour la sortie. Les nombres de paramètres actifs varient selon le sens du traitement ; les 552 milliards désignent le total du modèle.