DeepSeek ma prowadzić ograniczony test funkcji głosowej w aplikacji. Część użytkowników może zobaczyć przycisk głośnika i odsłuchiwać odpowiedzi, a ustawienia obejmują cztery profile głosowe. To krok w stronę wygodniejszej obsługi, ale nie zapowiedź powszechnie dostępnego trybu rozmowy głosowej.

Co widzą niektórzy użytkownicy

Przycisk głośnika ma znajdować się w prawym górnym rogu aplikacji. Po jego użyciu odpowiedź DeepSeek może zostać odczytana na głos. W ustawieniach testu zgłoszono cztery profile głosowe: 贝壳, 白浪, 海星 i 暗潮. Są to nazwy przedstawione w chińskim interfejsie; ich oficjalne polskie odpowiedniki nie zostały podane.

Najważniejsze rozróżnienie jest proste: odczytywanie wygenerowanej odpowiedzi to wyjście głosowe. Nie potwierdza ono samo w sobie, że użytkownik może mówić do aplikacji, uruchamiać ją słowem wybudzającym albo prowadzić nieprzerwaną rozmowę w dwóch kierunkach. Pełna publiczna premiera trybu głosowego nie została ogłoszona.

Test został opisany 12 września 2026 roku.

Zewnętrzne integracje działają osobno

Deweloperzy mogą połączyć tekstowe API DeepSeek z usługami zamiany mowy na tekst (STT) oraz tekstu na mowę (TTS). Taki układ przechwytuje wypowiedź, zamienia ją na tekst, przekazuje do modelu, a następnie odczytuje wygenerowaną odpowiedź. Powstaje w ten sposób zewnętrzny interfejs głosowy.

To jednak osobna konstrukcja, a nie dowód, że natywna aplikacja DeepSeek ma już taki sam zestaw funkcji. W praktyce warto więc rozdzielać dwie rzeczy: ograniczony test odczytywania odpowiedzi w aplikacji oraz rozwiązania tworzone przez deweloperów wokół tekstowego API.