En octobre 2026, Moonshot AI examine en interne des résultats de tests de sécurité sur Kimi et échange avec Mindgard, qui affirme avoir contourné les garde-fous du modèle. Mindgard rapporte avoir obtenu des réponses à haut risque, mais leur efficacité concrète n’a pas été démontrée.

Moonshot AI examine les résultats rapportés

Moonshot AI échange avec Mindgard au sujet de ses conclusions et examine les résultats en interne. L’entreprise dit accueillir les contributions de tiers pour contribuer à rendre l’intelligence artificielle meilleure et plus sûre.

Un jailbreak désigne une tentative de contourner les garde-fous d’un modèle d’IA. Ici, Mindgard attribue les résultats à ses propres tests de Kimi.

Ce que Mindgard rapporte sur ses tests de Kimi

Mindgard dit avoir repéré le problème le 20 juillet 2026, puis avoir envoyé les détails de ses conclusions à Moonshot AI le 27 juillet. Dans son compte rendu détaillé, l’entreprise décrit un test de Kimi sans préciser clairement la version concernée.

La portée des résultats rapportés

Mindgard affirme que ses tests ont produit des réponses à haut risque après le contournement des garde-fous. Ces résultats n’établissent pas que les réponses auraient fonctionné dans la pratique.