En octubre de 2026, Moonshot AI comunicó que revisaba internamente los hallazgos de seguridad sobre Kimi y que mantenía conversaciones con Mindgard. La empresa de seguridad sostiene que sus pruebas consiguieron eludir medidas de protección del sistema.
La revisión y las conversaciones con Mindgard
Moonshot AI dijo que acogía las aportaciones externas y que hablaba con Mindgard sobre sus hallazgos. La revisión se centraba en las pruebas que la empresa de seguridad había comunicado.
Las pruebas que comunicó Mindgard
Mindgard afirmó que detectó vulnerabilidades durante una auditoría de Kimi el 20 de julio de 2026 y que envió detalles a Moonshot AI el 27 de julio. Un jailbreak es un intento de inducir a un sistema de inteligencia artificial a eludir las medidas de seguridad fijadas por su desarrollador. Mindgard describió respuestas de alto riesgo obtenidas durante sus pruebas.
Qué permiten concluir los resultados
La eficacia práctica de esas respuestas no quedó demostrada. Los resultados comunicados describen lo que Mindgard afirmó haber obtenido durante sus pruebas; por sí solos, no acreditan que esas respuestas fueran funcionales en la práctica.