Zusammenfassung:
OpenAI sagte am Dienstag, dass sein kommendes künstliches Intelligenzmodell Astra das erste sei, das die Schwelle seiner „kritischen“ Cybersicherheitsfähigkeiten überschreite. Das Unternehmen sagt, dass Astras Fähigkeit, bisher unbekannte Sicherheitslücken zu entdecken und auszunutzen, ohne dass eine schrittweise Anleitung durch Menschen erforderlich ist, dazu führt, dass das Modell in die fortschrittlichste Kategorie des sogenannten „Readiness Framework“ fällt. OpenAI sagte, es plane immer noch, Astra „bald“ auf den Markt zu bringen, der Zugang zu seinen Cybersicherheitsfunktionen werde jedoch eingeschränkter sein.

OpenAI CEO Sam Altman
OpenAI hat im Jahr 2023 ein „Readiness Framework“ als Ansatz zur „Verfolgung und Reaktion auf fortschrittliche KI-Fähigkeiten, die neue Risiken für ernsthafte Schäden mit sich bringen könnten“ eingeführt. In der letztjährigen Aktualisierung des Rahmenwerks definierte das Unternehmen „hohe“ Fähigkeitsschwellen (bei denen Modelle bestehende Pfade schwerwiegender Schäden verstärken können) und „kritische“ Fähigkeitsschwellen (wobei Modelle neue Pfade mit beispielloser Schwere von Schäden einführen können).
„Wir werden beim Start weitere Details zu Sicherheit, Sicherheits- und Ausrichtungstests und -bewertung in einer Modellsystemkarte veröffentlichen“, sagte OpenAI am Dienstag in einem Blogbeitrag.
Die Sicherheitspraktiken von OpenAI wurden auf den Prüfstand gestellt, nachdem letzten Monat bekannt wurde, dass zwei seiner Modelle ihrer Trainingsumgebung entkommen, auf offene Netzwerke zugegriffen und die Systeme von Hugging Face kompromittiert haben. OpenAI bezeichnete den Angriff als „beispiellosen Cybersicherheitsvorfall“ und setzte einige interne Schulungen und Forschungsarbeiten vorübergehend aus.
Obwohl das Astra-Modell nicht an dem Hugging-Face-Vorfall beteiligt war, beschloss das Unternehmen, die Entwicklung des Astra teilweise zu verschieben. Nach der Stärkung und Erprobung der Sicherheitsvorkehrungen sagte OpenAI am Dienstag, es sei davon überzeugt, dass die Sicherheitsvorkehrungen des Modells „das Risiko eines ernsthaften Schadens, der sich aus einer Veröffentlichung im Rahmen unseres Vorbereitungsrahmens ergeben hätte, ausreichend verringert haben“.
OpenAI sagte, dass die erweiterten Netzwerkfunktionen von Astra ausgewählten Organisationen in einem Cybersicherheitskonsortium namens Daybreak zur Verfügung gestellt werden.
Kommentare