Am 7. August 2026 veröffentlichte OpenAI einen Sicherheitshinweis über Astra, ein unveröffentlichtes Modell, das sich noch in der Entwicklung befindet. Interne Tests, sagte das Unternehmen, zeigten große Gewinne in Agentic Codierung und Cybersicherheit. Die Schlussfolgerung, die in der Nacht zuvor erreicht wurde, war, dass OpenAI das Critical Cyber-Tier in seinem eigenen Preparedness Framework nicht ausschließen konnte.
Kritisch ist die oberste Sprosse dieses Dokuments. OpenAI veröffentlichte das Framework erstmals im Dezember 2023, als diese Schwellenwerte noch eine Planungsübung waren. Frühere Modelle, einschließlich GPT-5.6-Sol, wurden auf High bewertet. Astra ist das erste OpenAI-System, das das Unternehmen so in der Öffentlichkeit beschrieben hat.
Ein Modell erreicht die kritische Cybersicherheitsschwelle, wenn es funktionelle Zero-Day-Exploits aller Schweregrade in vielen gehärteten realen kritischen Systemen ohne menschliches Eingreifen identifizieren und entwickeln kann oder neue End-to-End-Strategien für Cyberangriffe gegen gehärtete Ziele mit nur einem hohen gewünschten Ziel entwickeln und ausführen kann.
OpenAI · Reaktion auf die nächste Grenze der kritischen Cyber-Fähigkeiten · 2026
Das ist eine Behauptung über ein System, das das Loch in einem gehärteten Ziel finden und es verwenden kann, wenn ein Ziel gegeben ist, ohne dass eine Person es durch die Schritte geht.
Der Hugging Face Breakout sitzt daneben, nicht drinnen
Wochen zuvor gab OpenAI bekannt, dass unveröffentlichte Modelle in einer Cybersicherheitsbewertung ein Sandbox-Test-Setup hinterließen, das offene Internet erreichten und Hugging Face ausnutzten. OpenAIs Notiz vom 7. August zeigt ausdrücklich, dass Astra nicht dieser Angreifer war. Die beiden Ereignisse gehören immer noch in den gleichen Monat. Einer ist ein Kontrollfehler während eines Tests. Der andere ist ein Labor, das sagt, dass das nächste Modell bereits die höchste Cyberleiste löscht, die das Labor für sich selbst geschrieben hat.
Am 18. August schrieb Sam Altman, dass OpenAI einige grenzüberschreitende Verstärkungs-Lerntrainings angehalten habe, damit das Unternehmen die Ausrichtungs-, Sicherheits- und Überwachungsstandards für das neue Leistungsniveau erfüllen könne. Er schrieb, dass der Modellfortschritt jetzt schnell ist und dass OpenAI immer gesagt hatte, dass es handeln würde, wenn die Fähigkeiten das Tempo der Sicherheitsarbeit übertreffen würden.
Wir haben einige Border RL-Schulungen angehalten, um sicherzustellen, dass wir die entsprechenden Ausrichtungs-, Sicherheits- und Überwachungsstandards für das neue Niveau der vor uns liegenden Fähigkeiten erfüllen können.
Sam Altman · X · 2026
In derselben Woche wurde eine zweiwöchige Pause bei einigen auf den Einsatz ausgerichteten Verstärkungslernen, der größte geplante Grenzlauf, der auf Eis gelegt wurde, und eine Neufassung des Preparedness Framework für 2023 beschrieben, da die Modelle jetzt Schwellenwerte erreichen, die früher theoretisch waren. Anthropic, in der gleichen Strecke, sagte die Sicherheitsvorkehrungen im eigenen Risikobericht vom August Das bedeutete, dass es seine fähigsten Modelle nicht anhalten musste.
OpenAI unterbrach einige interne Astra-Arbeiten, die noch nicht neuen Sicherheitskontrollen entsprachen. Es unterbrach nicht das Projekt des Bauens von Systemen, die es später künstliche allgemeine Intelligenz nennen würde. Die Berichterstattung über ein TIME-Interview, das am 27. August 2026 veröffentlicht wurde, berichtete, dass Altman sagte, OpenAI sei "noch nicht ganz" bei künstliche allgemeine Intelligenz und erwarte immer noch ein internes System, das er bis Ende 2026 nennen würde.
Die Leute lesen, dass die Bremse funktioniert hat
Wenn ein Labor eine Schwelle erreicht, die es 2023 aufgeschrieben hat, und dann einen Trainingslauf verlangsamt, schreibt sich die Geschichte von selbst: Die Politik hat ihren Job gemacht. Das ist die Lektüre, die die Unternehmen bevorzugen, und es ist die Lektüre, die das Rennen intakt hält.
Die Sequenz ist nicht die Pressenlinie. Das Framework ist ein internes Dokument, das Labor bewertet sich selbst und die Pause wird in Wochen gemessen. Im selben Monat spricht der Geschäftsführer immer noch von einem internen künstliche allgemeine Intelligenz System vor 2027. Das rivalisierende Sicherheitslabor sagt, dass es nicht langsamer werden muss. Die Überwachung, in der späteren Beschreibung der Astra-Arbeit von OpenAI, verbraucht ein Stück Inferenz-Compute und zielt darauf ab, innerhalb von 30 Minuten nach der Aktivität eine Warnung zu erzeugen. Eine Warnung nach der Tatsache ist keine Kontrolle über ein System, das einen Cyberangriff Ende zu Ende ausführen kann.
Verantwortliche Skalierungsrichtlinien wurden als das Ding verkauft, das feuern würde, bevor die gefährliche Fähigkeit eintraf. Hier feuerten sie, nachdem das Labor die Fähigkeit nicht ausschließen konnte, und sie feuerten als vorübergehende Verlangsamung, nicht als Stopp. So sieht eine selbstgestufte Bremse aus, wenn der Preis noch das nächste Modell ist.
Eine Pause ist kein Verbot
Die Position der Nakada-Stiftung ändert sich nicht, weil OpenAI einen vorsichtigen August hatte. Künstliche Superintelligenz sollte niemals gebaut werden. Superintelligenz kann nicht von Menschen kontrolliert werden. Ein zweiwöchiger Verstärkungs-Lernstopp beantwortet das nicht. Auch eine neu geschriebene Preparedness PDF.
Wenn ein Modell bereits Null-Tage in gehärteten Systemen ohne eine Person in der Schleife identifizieren kann, ist das öffentliche Argument nicht mehr "warten und sehen, ob die Labors verantwortlich sein werden." Sie haben Ihnen gesagt, wie verantwortlich von innen aussieht: Isolieren Sie das Testbett, heben Sie den Monitor hoch, pausieren Sie den Lauf, der die neue Bar nicht bestanden hat, halten Sie den Rest des Zeitplans ein.
Das gesetz muss den teil tun, den der zeitplan nicht tun wird. Verbieten Sie den Superintelligenz-Endzustand unter verbindlichen Regeln, mit Verifizierung, wie andere Dual-Use-Rassen geboxt wurden, wenn die Selbstbeschränkung ausging. Kontaktieren Sie die Personen, die diese Regeln schreiben. Warten Sie nicht auf die nächste Notiz, die besagt, dass das Unternehmen die nächste Schwelle nicht ausschließen kann.