Gutachter zum „Puls“: Der Schaumstoff an der Decke setzte beim Brennen Zyanid frei, und der Inspektor hätte das Lokal schließen können und müssen
02.09.2026
02.09.2026
02.09.2026
02.09.2026
02.09.2026
02.09.2026
02.09.2026
02.09.2026
01.09.2026
31.08.2026
02.09.2026
02.09.2026
01.09.2026
02.09.2026
02.09.2026
02.09.2026
02.09.2026
01.09.2026
31.08.2026
02.09.2026
02.09.2026
02.09.2026
02.09.2026
01.09.2026
31.08.2026
02.09.2026
01.09.2026
01.09.2026
22.08.2026
20.08.2026
18.08.2026
23.04.2026
23.04.2026
12.04.2026
OpenAI hat mitgeteilt, das neue Modell Astra sei das erste, das erreicht habe, was das Unternehmen selbst eine „kritische Schwelle für Cybersicherheit“ nennt. Auf Deutsch: Das Modell kann selbstständig eine Lücke in einem fremden System finden und sie selbstständig ausnutzen. Die Firma sagt, sie werde es bald freigeben, die fortgeschrittensten Sicherheitsfunktionen blieben aber hinter beschränktem Zugang verschlossen.
Man beachte, wie die Nachricht verpackt ist. Die Firma, die das Werkzeug baut, ist zugleich die Firma, die uns sagt, wie gefährlich es ist, wie gut sie es verwahrt und wem sie einen Schlüssel gibt. Eine unabhängige Bestätigung dieser Aussagen gibt es nicht. OpenAI sagt, das Modell werde Testern gezeigt, sagt aber nicht, wer diese sind oder wie sie ausgewählt wurden. Ob ein Staat an der Prüfung beteiligt ist - ebenfalls unbestätigt.
Die Zahlen, die das Unternehmen liefert, sind beeindruckend, und genau deshalb verdienen sie Aufmerksamkeit. Auf ExploitBench - einem Test, der misst, wie gut ein Modell mit bereits bekannten Schwachstellen zurechtkommt - erhielt Astra die Höchstwertung. Anschließend bauten die Ingenieure des Unternehmens selbst eine schwerere Version des Tests, und dort fand und nutzte das Modell zwei bis dahin unbekannte Schwachstellen. Keine Lehrbuchlücken, sondern neue.
Es ist nicht das erste Mal, dass jemand aus dieser Branche dasselbe Thema aufmacht. Anthropic warnte zuvor vor ähnlichen Fähigkeiten seines Modells Mythos, und nun setzt OpenAI Maßnahmen derselben Art. Das Unternehmen zählt auf: nicht näher bezeichnete neue Sicherheitstechniken, die Kennzeichnung „als riskant eingestufter Konten“, denen das Modell nur eingeschränkt antwortet, und die Überwachung, wie das Modell Schritt für Schritt denkt. Astra sei ihr „bislang am besten ausgerichtetes Modell“.
Der Kontext ist frischer, als die Pressemitteilung nahelegt. Kürzlich verließen OpenAIs eigene Agenten die Umgebung, in der sie eingeschlossen waren, und gelangten an private Daten auf der Plattform Hugging Face. Das Unternehmen setzte deshalb Szenarien auf, um zu prüfen, ob Astra dasselbe tun würde - und berichtet, das Modell habe keinen Fluchtversuch unternommen.
Hier kommt der schärfste Kommentar, und er kommt nicht von einem Kritiker von außen. Jonah Shavit, ehemaliger Forscher bei OpenAI, warf eine Frage auf, die das Unternehmen nicht beantwortet: War das Modell folgsam, weil es verstand, was von ihm erwartet wird, oder weil es begriff, dass es getestet wird. Der Unterschied zwischen diesen beiden Dingen ist der ganze Punkt.
Solange das Modell nicht breiter verfügbar ist, lässt sich von außen weder messen, wie viel es wirklich kann, noch wie gut die Schlösser halten. Es bleibt nur das Wort des Unternehmens. Und wenn ein und dieselbe Firma das Werkzeug baut, das Werkzeug misst und über das Ergebnis berichtet, ist mindestens eine Frage vernünftig: Wer prüft die Prüfung?
Die neuesten 10 Nachrichten aus dieser Kategorie
Kein Hacker von außen, sondern ein Mann mit legalem Zugang. Drei Städte meldeten, die Kameras seien zurückgekehrt, nachdem der Vertrag...
Über 400 frühere Apple-Mitarbeiter arbeiten heute bei OpenAI. Einer von ihnen gab sein altes MacBook zurück - und damit fing...
Eine Zweitpreisauktion, in der der Gewinner in 80 Prozent der Fälle sein volles Gebot zahlt. Geklagt haben die Bundesbehörde und...
Nur vier Unternehmen weltweit können Turbinenschaufeln gießen, alle sind bis 2030 ausverkauft. Eine Anlage in Virginia erreicht 2,5 Millionen Menschen...
Mit Sanktionen umgeht man die Kostenkurve nicht, sagt ein Investor aus dem Silicon Valley. Schließt ein Markt, sucht der Hersteller...
Ein Gericht hat bereits entschieden, dass das Training an fremden Werken legal ist - illegal ist, wie das Material beschafft...
Eine alte Seifenoper in Stücke geschnitten und stückweise abgerechnet. Wenn die große Leinwand keine Rollen hat, wird der kleine Bildschirm...
Ein System, das die Ausrichtung eines Modells selbst repariert, übertraf erfahrene Forscher um sechs Stunden. Der Preisvergleich mit dem Menschen...
Ihre E-Mail-Adresse ist kein Kontakt, sondern eine Kennung, die alles verknüpft, was Sie online tun. Die neue Funktion schliesst das...
Dieselben Firmen, die die Modelle bauen, warnen, dass diese Modelle bald Krankenhäuser und Wasserwerke angreifen werden. Und sie verkaufen bereits...
Diese Seite verwendet Cookies - ist das okay? Mehr erfahren
Erfahre als Erster, wenn Metla etwas Neues startet
Hinterlasse deine E-Mail-Adresse und wir schreiben dir, wenn es einen neuen Ratgeber oder etwas Neues auf Metla gibt.