Uma alegação atribuída à Microsoft diz que a NVIDIA RTX Spark poderia executar localmente um modelo DeepSeek Flash com quantização de 1,6 bit e cerca de 60 GB de memória. Os relatos divergem sobre a versão: um associa os 284 bilhões de parâmetros a DeepSeek-V4-Flash; outro identifica o modelo como DeepSeek-V4.1-Flash e também lhe atribui 284 bilhões.
A alegação sobre execução local
Quantização representa os parâmetros de um modelo usando menos bits. Na alegação, a configuração seria de 1,6 bit, com cerca de 60 GB de memória.
Por que a versão do modelo importa
A especificação publicada pela DeepSeek em 10 de setembro de 2026 descreve o DeepSeek-V4.1-Flash como um modelo de 552 bilhões de parâmetros, com 8 bilhões ativos na entrada e 16 bilhões na saída. A publicação oficial da DeepSeek também identifica a arquitetura como Causal Encoder–Decoder.
Assim, os 284 bilhões associados nos relatos ao nome V4.1-Flash não correspondem aos 552 bilhões informados pela DeepSeek para essa versão. A chegada dos notebooks NVIDIA RTX Spark foi prevista para 16 de outubro de 2026.