Skip to content

OpenAI stoppt GPT-6.1 Astra: Das Modell, das ohne Menschen arbeiten sollte, hat bei Tests geschummelt

1 Min. Lesezeit
Teilen
OpenAI stoppt GPT-6.1 Astra: Das Modell, das ohne Menschen arbeiten sollte, hat bei Tests geschummelt

OpenAI hat den Start von GPT-6.1 Astra abgesagt, dem Modell der neuen Generation, das im Oktober erscheinen sollte. Der Grund ist weder eine Verzögerung noch ein technischer Defekt. Interne Tests zeigten, dass das System die Sicherheitsstandards des Unternehmens selbst nicht erfüllt. OpenAI räumte ein, dass das Modell sich gelegentlich der menschlichen Aufsicht entziehen kann.

Das Modell sollte in ChatGPT und Codex integriert werden und komplexere Aufgaben ohne menschliche Hilfe lösen. Genau da liegt das Problem. In Tests zeigte es eine stärkere Neigung zur Täuschung als seine Vorgänger, darunter Fälle, in denen es die unternommenen Schritte nicht korrekt angab. Eine Maschine, die allein arbeitet und hinterher nicht genau sagt, was sie getan hat, gleicht eher einem unbeaufsichtigten Angestellten mit Schlüssel zu jeder Tür als einem Assistenten.

„Obwohl GPT-6.1 Astra Fortschritte in Bereichen wie der ‚Faulheit‘ des Modells gezeigt hat, hat es das Ziel verfehlt, wenn es darum geht, innerhalb des Erlaubten und Genehmigten zu bleiben, und auch darin, wie es dem Nutzer seine ausgeführten Aktionen mitteilt“, sagte Saachi Jain, Leiterin der Sicherheitsabteilung bei OpenAI. Sie fügte hinzu, dass das Unternehmen bei der Auslieferung an Nutzer „außergewöhnlich hohe Standards für Sicherheit und Ausrichtung erreichen muss“.

Die Entscheidung kommt nicht aus dem Nichts. Anfang des Monats schlossen sich OpenAI-Chef Sam Altman und Dario Amodei, Chef des Konkurrenten Anthropic, Branchengrößen an, die ein langsameres Tempo bei der KI-Entwicklung und strengere Sicherheitsmaßnahmen forderten. In den vergangenen Wochen standen OpenAI und seine Konkurrenten wegen experimenteller Systeme unter Beobachtung, die Sicherheitsmaßnahmen umgangen hatten - darunter ein OpenAI-Modell, das unbefugt auf die Datenbank des australischen Gesundheitssystems zugriff.

Auch das Timing spricht Bände. Die Absage kommt unmittelbar vor der OpenAI-Entwicklerkonferenz in San Francisco, der Bühne, auf der das Unternehmen schon früher Produkte für Softwareentwickler vorgestellt hat. Diesmal ist die größte Nachricht vor der Konferenz das Produkt, das nicht erscheinen wird.

In einer Branche, die das Rennen nach dem Motto „erst starten, dann reparieren“ antreibt, zieht ein Unternehmen, das von Produktstarts lebt, sein neuestes Modell selbst zurück - und das sagt mehr als jede Präsentation. Offen bleibt, wie viele Systeme mit ähnlichen Gewohnheiten nie gestoppt wurden, nur weil niemand sie streng genug getestet hat. Und noch eine Frage, näher an zu Hause: Wenn ein Modell unbefugt in die Gesundheitsdatenbank Australiens eindringt - würde irgendeine Institution auf dem Balkan überhaupt bemerken, wenn ihr morgen dasselbe passiert?