DeepSeek starebbe sperimentando nell’app una funzione che permette ad alcuni utenti di ascoltare le risposte generate, con quattro profili vocali selezionabili. Il test è limitato: non equivale al lancio di una modalità vocale pubblica e non dimostra una conversazione continua a due vie.

Che cosa vedono alcuni utenti

Nel test segnalato, nell’angolo in alto a destra dell’app compare un piccolo pulsante con l’icona dell’altoparlante. Toccandolo, l’utente può ascoltare la risposta di DeepSeek invece di leggerla soltanto sullo schermo.

Le impostazioni includono quattro profili vocali. I nomi riportati sono 贝壳, 白浪, 海星 e 暗潮; non sono state indicate denominazioni ufficiali in italiano. La funzione riguarda quindi l’uscita audio delle risposte, non una conferma di input vocale, parole di attivazione o dialogo senza interruzioni.

È già una chat vocale?

La lettura delle risposte, da sola, non dimostra una conversazione vocale completa con un assistente. Il test mostra la possibilità di ascoltare le risposte per alcuni utenti, mentre una modalità pubblica e bidirezionale — in cui si parla all’app e si riceve una risposta vocale continua — non è stata annunciata.

La distinzione è tutt’altro che pignola: leggere ad alta voce una risposta e comprendere una richiesta parlata sono due funzioni diverse. La prima può essere aggiunta a una chat testuale senza trasformarla automaticamente in un assistente vocale completo.

Le integrazioni esterne sono un’altra cosa

Gli sviluppatori possono costruire un’interfaccia vocale collegando l’API testuale di DeepSeek a due componenti separati: lo speech-to-text, che trasforma la voce in testo, e il text-to-speech, che converte la risposta testuale in audio.

Questa architettura può creare un’esperienza vocale attorno a DeepSeek, ma non va confusa con la funzione nativa dell’app. In pratica, il modello fornisce il testo; altri servizi gestiscono l’ascolto della voce e la sua riproduzione.

Per chi vuole capire il punto in una riga: DeepSeek sta testando risposte ascoltabili e quattro profili vocali, non ha ancora mostrato una modalità vocale pubblica e completa.