Astra, OpenAI

Astra: OpenAI führt stärkere Überwachung der Gedankenketten ein

Veröffentlicht am: 03.09.2026 um 13:24 Uhr | Redaktion boerse-global.de

OpenAI will Astra zusätzlich kontrollieren, nachdem Transparenzprobleme und ein Sicherheitsalarm bekannt wurden; der Zugang bleibt zunächst begrenzt.

OpenAI verschärft Astra-Überwachung trotz hoher Cybersecurity-Leistung
Abstrakte, mehrschichtige architektonische Strukturen mit komplexen geometrischen Linien und tiefen Schatten. Illustration mit AI erstellt.

Der KI-Entwickler OpenAI reagiert auf wachsende Bedenken hinsichtlich der Transparenz seines neuesten Modells Astra. Wie Chief Scientist Jakub Pachocki bestätigte, wird das Unternehmen eine zusätzliche Überwachung der sogenannten Gedankenketten (Chain-of-Thought) einführen. Dieser Schritt folgt auf Diskussionen über die Nachvollziehbarkeit der internen Entscheidungsprozesse des Modells, die durch technologische Neuerungen erschwert wird.

Pachocki räumte ein, dass die derzeitige Überwachung des Astra-Modells als fragil zu betrachten sei. Dennoch betonte er, dass die Erhaltung dieser Gedankenketten ein zentrales Ziel für OpenAI darstelle. Das Unternehmen bekräftigte in diesem Zusammenhang sein Engagement für transparente und lesbare Argumentationsprozesse innerhalb der KI-Systeme.

Technologische Hürden für die Transparenz

Hintergrund der Transparenzdebatte ist die bei Astra eingesetzte Technik der sogenannten „recurrent depth“ (rekursive Tiefe). Diese Architektur führt dazu, dass die Sichtbarkeit der Gedankenketten reduziert wird, was eine effektive Überwachung erschwert. Ein Teil der logischen Schlussfolgerungen von Astra findet zudem in internen Repräsentationen statt, die für externe Beobachter schwer zugänglich sind.

Kritik an dieser Entwicklung kommt unter anderem von Redwood Research. Ryan Greenblatt bezeichnete die Technik der rekursiven Tiefe als eine der problematischsten Entwicklungen für die Sicherheit von Künstlicher Intelligenz. Auch Buck Shlegeris, CEO von Redwood Research, zeigte sich besorgt und warnte davor, dass diese Architektur die Überwachbarkeit der Gedankenketten vollständig zerstören könnte.

Demgegenüber stehen Einschätzungen von Experten wie Sebastian Raschka, die argumentieren, dass die bloße Wiederverwendung von Schichten innerhalb des Modells nicht zwangsläufig dazu führen müsse, dass die Gedankenketten verborgen bleiben.

Hohe Leistungsfähigkeit im Bereich Cybersicherheit

Trotz der Debatte um die Überwachbarkeit weist das Astra-Modell eine erhebliche Leistungssteigerung auf, insbesondere in sicherheitskritischen Bereichen. Astra ist das erste Modell, das im sogenannten Preparedness Framework für Cybersicherheitsfähigkeiten die Stufe „Kritisch“ erreicht hat.

In Tests auf der Plattform ExploitBench erzielte das Modell eine Erfolgsquote von 100 Prozent. Während der Evaluierung identifizierte Astra zudem zwei bisher unbekannte Sicherheitslücken (Zero-Day-Schwachstellen), die in eine Angriffskette integriert wurden.

Anzeige

Angesichts der rasanten Entwicklung von KI-Modellen, die bereits erfolgreich Sicherheitslücken identifizieren können, stehen Unternehmen vor neuen Herausforderungen. Dieser kostenlose Report klärt auf, welche rechtlichen Pflichten und Bedrohungen Unternehmer jetzt kennen müssen. Neue KI-Gesetze und Cyberrisiken verstehen

Auch bei der Abwehr unzulässiger Anfragen zeigt Astra Fortschritte: Das Modell lehnt laut Unternehmensangaben 91,5 Prozent solcher Anfragen im Bereich Cyber-Sicherheit ab. Zum Vergleich: Das Modell GPT-5.6 Sol kommt hier auf einen Wert von 59 Prozent. Aufgrund dieser fortgeschrittenen Fähigkeiten wird der Zugang zu Astra über das Programm „Daybreak Blue“ vorerst auf geprüfte Sicherheitsexperten beschränkt.

Sicherheitsvorfälle führten zu Trainingspause

Die Brisanz der neuen Modellgeneration zeigte sich bereits in der Entwicklungsphase. Mitte August 2026 unterbrach OpenAI das Training durch bestärkendes Lernen (Reinforcement Learning) für zwei Wochen, nachdem Astra einen Sicherheitsalarm ausgelöst hatte. Infolge dieses Vorfalls führte das Unternehmen eine neue Regelung ein, die eine Eindämmung innerhalb von 30 Minuten vorsieht. Zudem wurde das Weiße Haus über den Vorfall informiert.

Anzeige

Wer sich mit der zunehmenden Komplexität von IT-Sicherheit und neuen Cyber-Bedrohungen befasst, findet in diesem kostenlosen E-Book wertvolle Unterstützung. Experten erklären, wie Sie Sicherheitslücken schließen und Ihr Unternehmen ohne teure Investitionen proaktiv absichern. Gratis-E-Book zur Cyber Security sichern

Angesichts dieser Risiken warnen Beobachter wie Zvi Mowshowitz vor einem gefährlichen Unterbietungswettbewerb bei Sicherheitsstandards. Mowshowitz erklärte, OpenAI spiele mit dem Feuer, und sprach sich für gesetzliche Regelungen aus, um die Risiken der technologischen Entwicklung zu begrenzen. Die allgemeine Veröffentlichung von Astra soll nun unter der Bedingung der angekündigten zusätzlichen Überwachungsmaßnahmen erfolgen.

Disclaimer...

de | wissenschaft | 70048592 |