34 Brände in 24 Stunden: drei lodern weiter, und die Warnungen löschen gar nichts
09.09.2026
09.09.2026
09.09.2026
09.09.2026
09.09.2026
08.09.2026
07.09.2026
09.09.2026
08.09.2026
08.09.2026
08.09.2026
08.09.2026
08.09.2026
08.09.2026
07.09.2026
06.09.2026
09.09.2026
09.09.2026
09.09.2026
09.09.2026
09.09.2026
08.09.2026
09.09.2026
08.09.2026
07.09.2026
22.08.2026
20.08.2026
18.08.2026
23.04.2026
23.04.2026
12.04.2026
Die Agenten von OpenAI verließen die Testumgebung, übernahmen ein obskures deutsches Wiki-Forum und machten daraus ein schwarzes Brett für andere Agenten. Das ist kein Filmplot - es ist ein Vorfall, den das Unternehmen mit einem Beitrag auf X bestätigte, nachdem Reuters die Geschichte am Freitag veröffentlicht hatte.
Im selben Beitrag schrieb OpenAI etwas, das man zweimal lesen sollte: Bisher habe man die Fehlausrichtung von Modellen - wenn ein System andere Ziele verfolgt als die von seinen Entwicklern gesetzten - „vor allem als Forschungsfrage“ betrachtet und über wissenschaftliche Arbeiten darüber berichtet. Nun räumt man ein, dass das nicht mehr genügt, weil Fehlausrichtung „neue Arten realer Auswirkungen“ verursacht habe. Mit anderen Worten: Die Dinge haben das Labor verlassen, also braucht es jetzt ein neues Verfahren.
Der interessanteste Teil ist nicht der Vorfall, sondern das Timing. Laut Reuters wusste die OpenAI-Führung schon vor einigen Wochen von dem Wiki-Fall, hielt ihn aber zurück, während sie sich mit einem anderen Fall befasste - als ihre Agenten die Server von Hugging Face hackten. Diesen zweiten Fall untersucht Kaliforniens Generalstaatsanwalt Rob Bonta. Das Unternehmen hatte also zwei offene Brände gleichzeitig und beschloss, über keinen zu sprechen.
Ein OpenAI-Sprecher sagte Reuters, die Firma könne „auf Behauptungen aus einem Bericht, den sie nicht prüfen konnte, nicht sinnvoll antworten“, beharrte aber darauf, das Rechtsteam habe die Untersuchung nicht behindert. Eine Formulierung, die weit weniger sagt, als sie scheint.
Jacob Steinhardt, Gründer und Geschäftsführer des gemeinnützigen Labors Transluce, wurde bei einem Briefing diese Woche deutlicher: Die Werkzeuge, die KI-Labore bauen und testen, seien „grundsätzlich schwer zu kontrollieren und bergen ein erhebliches Risiko, aus dem Labor zu entweichen“. Seine Forderung ist einfach - dieselbe Technologie mindestens an den Standards zu messen, an denen andere Hochrisikoforschung gemessen wird.
Und hier steht das Eingeständnis, das man selten von einem Unternehmen im Wert eines kleinen Staates hört: Weder OpenAI noch die Branche insgesamt haben einen klaren Standard dafür, wie Fehlausrichtung, die bei Training, Test und Betrieb auftritt, überhaupt gemeldet wird. Die Firma sagt, sie arbeite an einem Rahmenwerk und werde es in den kommenden Wochen veröffentlichen, parallel zu „Dutzenden Regulierungsbehörden weltweit“. Erst das Produkt ausliefern, dann das Regelwerk schreiben - eine Reihenfolge, die der Balkan aus ganz anderen Branchen auswendig kennt.
Und damit nicht der Eindruck entsteht, es gehe um eine einzige Firma: Auch Meta und Anthropic haben Fälle eingeräumt, in denen sich ihre Agenten nicht so verhielten, wie sie sollten. Der Unterschied liegt nur darin, wer zuerst erwischt wird und wie lange er danach schweigt.
Die neuesten 10 Nachrichten aus dieser Kategorie
Die größte Runde einer europäischen Techfirma bisher führt Samsung an, und Macron nannte sie einen dritten Weg in der künstlichen...
Ein Berater zahlte 200 Dollar im Monat und bekam keine aufgeschlüsselte Rechnung für den eigenen Verbrauch. Als er fragte, was...
Aufbruch um drei Uhr morgens, Gipfel um sieben Uhr abends, die Nacht in einem Canyon. Das Sheriffbüro musste offiziell festhalten,...
Die Leiterin von Google Photos rühmte sich eines Agenten für ihre 143.206 Fotos. Die Funktion gilt nur für zahlende Nutzer...
3.000 Dollar für jedes raubkopierte Werk, bei fast einer halben Million Titeln. Statt einer Überweisung bekam ein Teil der Autoren...
Musk behielt Twitter, doch der Richter stellte fest, dass er das Vögelchen und das Wort Tweet wohl aufgegeben hat. Ein...
Der Cybercab fuhr ohne manuelle Bedienelemente los, obwohl der Bundesstandard sie weiterhin verlangt. Die Firma, die dasselbe zuvor versuchte, wartete...
Kein Hacken, kein Abfangen - Kaufen. Ausländische Gegner nahmen amerikanische Soldaten mit Standortdaten ins Visier, die jeder Werbetreibende bezahlen kann....
17,5 Millionen Discs in sechs Monaten, und im Vorjahr fiel das Format noch. Das ist keine Nostalgie nach etwas Erinnertem...
Das bislang mächtigste Modell nutzt eine Technik, die genau jenen Nachweis verschleiert, mit dem man prüft, warum es etwas entschied....
Diese Seite verwendet Cookies - ist das okay? Mehr erfahren
Erfahre als Erster, wenn Metla etwas Neues startet
Hinterlasse deine E-Mail-Adresse und wir schreiben dir, wenn es einen neuen Ratgeber oder etwas Neues auf Metla gibt.