Em 10 de outubro de 2026, Satya Nadella propôs que uma pessoa autorizada pudesse pausar ou desligar um modelo de IA no meio de uma tarefa. O CEO da Microsoft defende que os controles de acesso e das ações do modelo fiquem fora dele, em uma arquitetura que mantenha a autoridade humana separada da capacidade da IA. Nadella apresentou a proposta em seu post original.

A ideia dá uma dimensão operacional à discussão sobre supervisão humana e desenvolvimento deliberado da IA abordada nesta análise anterior da NeoTeo.

Como funcionaria o freio proposto por Nadella

A proposta prevê que uma pessoa autorizada possa interromper o modelo durante a execução de uma tarefa. Para isso, Nadella recomenda separar o modelo do harness de orquestração — a camada de software que organiza seu trabalho e conecta ferramentas — e manter fora do modelo os controles que definem a quais recursos ele pode acessar e quais ações pode executar.

A distinção é importante: o modelo pode fornecer a capacidade de raciocínio, mas não deve decidir sozinho sobre as próprias permissões. O post também defende que nenhuma IA seja a única responsável por um resultado importante ou pela verificação do próprio trabalho.

Por que a transparência não basta

https://x.com/satyanadella/article/2108931348857827686

Nadella considera inegociável a transparência da cadeia de pensamento (chain of thought, ou CoT), mas diz que ela não é suficiente nem confiável por si só: as respostas dos modelos ainda não são consistentemente fiéis ou transparentes. Na arquitetura que propõe, observar o comportamento da IA precisa vir acompanhado de controles independentes e de contenção.

A justificativa não depende de atribuir intenção maliciosa a um modelo. Nadella argumenta que um sistema capaz, com acesso a recursos importantes, pode cometer erros ou ser comprometido. Limitar seus acessos e preservar uma forma de interrupção humana são medidas para lidar com esses riscos.

Contenção, auditoria e divulgação de incidentes

O post organiza a governança em sete princípios: diversidade de modelos, observabilidade, verificabilidade, controles independentes, auditabilidade independente, contenção e divulgação de incidentes. Nadella também defende testes contínuos do sistema inteiro, incluindo falhas, ataques, casos extremos e mudanças, e registros legíveis por pessoas e resistentes a adulterações para reconstruir ações sem depender do relato do próprio modelo.

Para incidentes, ele propõe avisar prontamente as partes afetadas e compartilhar com o setor o que falhou, quais controles não funcionaram e como evitar que o problema se repita.

Nadella pede ainda tecnologias de contenção mais avançadas para modelos mais avançados e a padronização dessas tecnologias. É uma recomendação de governança; o post não define um projeto técnico para o mecanismo de pausa ou desligamento.