A Audio Intelligence do Apple Watch é um conjunto opcional de recursos que analisa sons, identifica músicas, recupera fala recente em texto e cria resumos de conversas. A Apple afirma que o áudio bruto não é gravado nem armazenado: ele passa por um buffer protegido no Secure Exclave do chip S11 e é apagado imediatamente após o processamento. Ainda assim, algumas funções geram dados derivados que podem sair do relógio — uma assinatura acústica para o Shazam ou texto condensado para o Private Cloud Compute.
A resposta curta: não há gravação bruta, mas há processamento
O Apple Watch Series 12 e o Apple Watch Ultra 4 são compatíveis com quatro recursos de Audio Intelligence: Reconhecimento de Som, Reconhecimento de Música com Shazam, Live Rewind e Siri Recap. Todos são opcionais e precisam ser ativados pelo usuário.
A frase mais importante para entender a privacidade é esta: a Apple diz que não cria nem armazena uma gravação de áudio acessível ao sistema, aos aplicativos, ao usuário ou à própria Apple. Isso não significa que todas as etapas aconteçam exclusivamente no relógio. O caminho depende da função escolhida e do resultado que ela precisa entregar.
Quatro recursos, quatro tarefas diferentes
- Reconhecimento de Som: identifica sirenes, alarmes e campainhas, inclusive quando o iPhone não está por perto.
- Reconhecimento de Música: identifica músicas em segundo plano e mostra título e artista no Smart Stack. O Shazam recebe uma assinatura acústica, não o áudio bruto.
- Live Rewind: recupera até 15 segundos de fala recente como um trecho de texto depois de um toque duplo deliberado na Digital Crown.
- Siri Recap: cria um resumo geral de uma conversa. O recurso não produz uma transcrição completa.
O Live Rewind também emite um sinal sonoro, mostra uma animação em tela cheia e exibe um indicador de microfone quando é ativado — inclusive quando o relógio está no silencioso ou conectado a fones de ouvido.
Por onde passa cada recurso
A expressão “processamento no dispositivo” fica mais clara quando você separa as funções. O relógio usa processamento protegido para lidar com o áudio bruto, mas alguns resultados derivados seguem para serviços específicos.
| Recurso | O que faz | Onde ocorre o processamento | O que sai do caminho do relógio | Retenção descrita pela Apple |
| Reconhecimento de Som | Detecta sirenes, alarmes e campainhas | Apple Watch e iPhone | A Apple não descreve o envio de áudio bruto; o processamento ocorre entre o relógio e o iPhone | Os dados processados são apagados imediatamente; nenhuma gravação é criada |
| Reconhecimento de Música com Shazam | Identifica músicas e mostra título e artista | Secure Exclave e serviço Shazam | Uma assinatura acústica é enviada ao Shazam; a Apple afirma que ela não pode ser revertida ao áudio original | O áudio bruto não é enviado nem armazenado |
| Live Rewind | Recupera até 15 segundos de fala como texto | Apple Watch e iPhone; algumas ações da Siri podem usar o Private Cloud Compute | Texto pode ser enviado para a ação escolhida pelo usuário ou quando o trecho é salvo | O trecho não salvo desaparece cerca de 30 segundos depois que a tela escurece |
| Siri Recap | Cria um resumo geral de uma conversa | Secure Exclave do Apple Watch, Secure Exclave do iPhone emparelhado e Private Cloud Compute | Texto condensado e criptografado é enviado ao Private Cloud Compute | Resumos não salvos são apagados automaticamente depois de sete dias |
No caso do Siri Recap, a Apple descreve um texto condensado com menos da metade do tamanho da transcrição original. O serviço na nuvem recebe esse texto e informações de contexto para gerar o resumo, não uma gravação de áudio convencional.
O que você realmente vê no uso diário
O Live Rewind não fica transcrevendo continuamente em segundo plano. Você precisa tocar duas vezes na Digital Crown para recuperar a fala recente, e o resultado aparece como texto. Se o trecho não for salvo, ele desaparece aproximadamente 30 segundos depois que a tela escurece.
O Siri Recap trabalha de outra forma: entrega um resumo de alto nível, útil para recuperar os pontos principais de uma conversa, mas sem atribuir cada frase a uma pessoa específica. A Audio Intelligence não identifica nem associa a fala a participantes individuais.
Resumos e trechos salvos podem ser sincronizados pelo iCloud com criptografia de ponta a ponta quando o iCloud, a autenticação de dois fatores e um código de acesso estão ativados.
Compatibilidade e lançamento planejado
A Audio Intelligence é compatível com o Apple Watch Series 12 e o Apple Watch Ultra 4.
Para Reconhecimento de Som e Reconhecimento de Música, a Apple exige um iPhone 11 ou posterior ou um iPhone SE de segunda geração ou posterior, com iOS 27.
Live Rewind e Siri Recap exigem um iPhone compatível da lista mais recente da Apple: iPhone 16, iPhone 16 Plus, iPhone 16 Pro, iPhone 16 Pro Max, iPhone 17, iPhone 17e, iPhone 17 Pro, iPhone 17 Pro Max, iPhone Air, iPhone 18 Pro, iPhone 18 Pro Max ou iPhone Duo.
A Apple planeja oferecer Live Rewind e Siri Recap em versão beta no fim de 2026, começando em inglês. A empresa também afirma que outros idiomas serão adicionados posteriormente.
A decisão prática de privacidade
Se a sua preocupação é uma gravação de áudio recuperável, a posição da Apple é direta: o áudio bruto não é gravado nem armazenado. Se a preocupação inclui qualquer dado derivado, a resposta é mais ampla: o Shazam recebe uma assinatura acústica, o Live Rewind pode produzir texto e o Siri Recap envia texto condensado e criptografado ao Private Cloud Compute.
Essa é a diferença entre “não guardar a gravação” e “não processar som algum”. A Audio Intelligence foi projetada para apagar o áudio bruto, mas ainda precisa transformar o que o microfone capta em assinaturas, texto ou resumos para executar cada função.