Moonshot AI prüft gemeldete Sicherheitsbefunde

Moonshot AI prüft im Oktober 2026 intern Sicherheitsbefunde zu Kimi und tauscht sich dazu mit Mindgard aus. Mindgard hatte Tests gemeldet, bei denen nach Angaben des Unternehmens Schutzmechanismen umgangen und riskante Antworten erzeugt worden seien.

Ein sogenannter Jailbreak ist der Versuch, Schutzregeln eines KI-Systems durch Eingaben zu umgehen. Die gemeldeten Tests betreffen Kimi; sie sind der Anlass für den Austausch zwischen Mindgard und Moonshot AI.

Was Mindgard über seine Kimi-Tests berichtete

Mindgard zufolge entdeckte das Unternehmen die Befunde am 20. Juli 2026. Am 27. Juli schickte es Moonshot AI nach eigener Darstellung Details dazu. Mindgard berichtete, dass die Tests Ausgaben zu Hochrisikothemen hervorgebracht hätten.

Was sich aus den gemeldeten Tests ableiten lässt

Die praktische Wirksamkeit der Antworten ist nicht belegt. Mindgards Bericht beschreibt damit erzeugte Ausgaben, aber keinen Nachweis dafür, dass sie in der Praxis funktioniert hätten.