Uma alegação atribuída à Microsoft diz que a NVIDIA RTX Spark poderia executar localmente um modelo DeepSeek Flash com quantização de 1,6 bit e cerca de 60 GB de memória. Os relatos divergem sobre a versão: um associa os 284 bilhões de parâmetros a DeepSeek-V4-Flash; outro identifica o modelo como DeepSeek-V4.1-Flash e também lhe atribui 284 bilhões.

A alegação sobre execução local

Quantização representa os parâmetros de um modelo usando menos bits. Na alegação, a configuração seria de 1,6 bit, com cerca de 60 GB de memória.

Por que a versão do modelo importa

A especificação publicada pela DeepSeek em 10 de setembro de 2026 descreve o DeepSeek-V4.1-Flash como um modelo de 552 bilhões de parâmetros, com 8 bilhões ativos na entrada e 16 bilhões na saída. A publicação oficial da DeepSeek também identifica a arquitetura como Causal Encoder–Decoder.

Assim, os 284 bilhões associados nos relatos ao nome V4.1-Flash não correspondem aos 552 bilhões informados pela DeepSeek para essa versão. A chegada dos notebooks NVIDIA RTX Spark foi prevista para 16 de outubro de 2026.