Zusammenfassung:
OpenAI plant, es Drittorganisationen zu ermöglichen, Sicherheitsrisiken früher im Entwicklungszyklus von Modellen der künstlichen Intelligenz (KI) zu bewerten, ein Schritt, der darauf abzielt, die Bemühungen fortzusetzen, Bedenken hinsichtlich des potenziellen Schadens von KI auszuräumen. Der ChatGPT-Entwickler wird am Dienstag in einem Blogbeitrag bekannt geben, dass er plant, bei der Schulung, Evaluierung und Einführung neuer KI-Modelle technische Sicherheitsbewertungen durch externe Agenturen durchführen zu lassen.

OpenAI listet auch die Prioritäten auf, die seiner Meinung nach erforderlich sind, damit solche Bewertungen effektiv sind, darunter „starke unabhängige Mechanismen, wissenschaftliche Genauigkeit, robuste Sicherheitspraktiken und klare Verantwortlichkeit“.
Lama Ahmad, der in Zusammenarbeit mit externen Experten für den Großteil der Sicherheitsüberprüfungsarbeiten des Unternehmens verantwortlich ist, sagte, dass OpenAI solche Institutionen bisher hauptsächlich zur Durchführung von Sicherheitsbewertungen und zur Bewertung der Modellfähigkeiten vor der Modellveröffentlichung eingeführt habe.
„Da die potenziellen Risiken und Auswirkungen zunehmen, möchten wir neben dem Einsatz auch sicherstellen, dass kritische Aspekte wie Schulung und Bewertung berücksichtigt werden“, sagte Ahmad in einem Interview.
Für einige der sensibelsten Aufgaben lässt OpenAI möglicherweise externe Gutachter in die Räumlichkeiten des Unternehmens kommen, um Bewertungen durchzuführen, eine Praxis, die das Unternehmen in der Vergangenheit ausprobiert hat, sagte Ahmad.
Dario Amodei, CEO des OpenAI-Konkurrenten Anthropic PBC, forderte kürzlich die KI-Branche auf, eine Verlangsamung der Entwicklung zu unterstützen, und sagte, dass neue Sicherheitsmaßnahmen ergriffen werden, einschließlich der Einführung externer Bewertungsagenturen. Sam Altman, CEO von OpenAI, unterstützte den Ansatz später. Anthropic gab Ende letzter Woche bekannt, dass es Gutachter von Accenture hinzuziehen werde, um die Sicherheit seiner hochmodernen KI-Modelle zu testen.
OpenAI sagte in einem Blogbeitrag, dass das Unternehmen Gespräche mit Institutionen führt, die möglicherweise an solchen Bewertungen beteiligt sind. Ahmad sagte, dass die Verhandlungsziele sowohl Institutionen umfassen, die in der Vergangenheit kooperiert haben, als auch Institutionen, die zuvor nicht kooperiert haben, darunter die KI-Forschungsinstitute METR und Redwood Research. OpenAI hatte diese beiden Institutionen zuvor damit beauftragt, das Eindringen seines Modells in das Hugging Face-System zu untersuchen.
„AI Labs haben die Verantwortung, Bedingungen für eine effektive Überprüfung zu schaffen und gleichzeitig sensible Informationen zu schützen“, sagte OpenAI in einem Blogbeitrag.
Kommentare