O DeepSeek está testando, para alguns usuários do aplicativo, um recurso que reproduz suas respostas em voz alta e oferece quatro perfis de voz selecionáveis. O acesso continua limitado, e a novidade não foi anunciada como um modo público completo de conversa bidirecional por voz.
O que alguns usuários conseguem fazer
O teste inclui um pequeno botão de alto-falante no canto superior direito do aplicativo. Ao acioná-lo, o usuário pode ouvir a resposta gerada pelo DeepSeek em vez de apenas lê-la na tela. As configurações também apresentam quatro perfis de voz, com características descritas como viva e versátil, clara e firme, brincalhona e doce, além de profunda e ressonante.
O ponto importante está na diferença entre reprodução de voz e conversa por voz. O primeiro recurso transforma a resposta escrita em áudio. Já uma conversa bidirecional exigiria também entrada de voz, processamento contínuo da fala e respostas em sequência. O teste divulgado mostra a reprodução das respostas, mas não basta para caracterizar esse funcionamento completo.
Por isso, a resposta curta para “o DeepSeek já faz chat por voz?” é: alguns usuários podem ouvir respostas faladas em um teste limitado, mas isso não equivale a um modo de voz público e totalmente mãos-livres.
O teste limitado foi relatado pela primeira vez em 12 de setembro de 2026.
Integrações externas funcionam de outra forma
Também é possível construir interfaces de voz ao redor da API de texto do DeepSeek. Nesse tipo de implementação, um serviço de STT — reconhecimento de fala, na sigla em inglês — transforma a voz em texto. O DeepSeek processa esse texto e, depois, um serviço de TTS, ou síntese de fala, converte a resposta em áudio.
Essa arquitetura pode criar uma experiência de conversa por voz para desenvolvedores, mas não deve ser confundida com uma função nativa liberada no aplicativo. São camadas externas, com ferramentas de voz separadas do teste relatado no DeepSeek.
Na prática, o que muda agora é mais modesto — e ainda assim útil: parte dos usuários pode deixar de apenas ler as respostas e passar a escutá-las, enquanto o alcance do recurso continua restrito ao teste.