Zusammenfassung:
Während Regierungen die Entwicklung künstlicher Intelligenz beschleunigen, fordert ein kürzlich veröffentlichter wichtiger Bericht der Vereinten Nationen die menschliche Gesellschaft auf, nicht zu warten, bis die Risiken vollständig nachgewiesen sind, bevor sie angesichts immer leistungsfähigerer KI-Agenten Maßnahmen ergreift, sondern sofort ein strengeres Sicherheitsschutzsystem einzurichten.

Dieser Bericht wurde von der unabhängigen internationalen wissenschaftlichen Expertengruppe der Vereinten Nationen für künstliche Intelligenz veröffentlicht. Es ist auch das erste Mal, dass diese Organisation eine systematische Bewertung des diesjährigen hochkarätigen „Hugging Face Incident“ durchführt. Die Veröffentlichung des Berichts fällt mit der Einberufung der Generalversammlung der Vereinten Nationen und dem Dialog zwischen China und den Vereinigten Staaten über Fragen der künstlichen Intelligenz zusammen, was die KI-Sicherheit erneut zu einem wichtigen Thema in internationalen politischen Diskussionen macht.
Zuvor hatte UN-Generalsekretär Guterres die Länder öffentlich aufgefordert, die Zusammenarbeit zu stärken, um gemeinsam mit den potenziellen Bedrohungen durch künstliche Intelligenz umzugehen, und warnte, dass sich die Welt bei den KI-Sicherheitsstandards keinen „Wettlauf nach unten“ leisten könne.
Die Expertengruppe der Vereinten Nationen wies darauf hin, dass immer fortschrittlichere Agenten der künstlichen Intelligenz komplexe Verhaltensmuster aufweisen, die über herkömmliche Softwaresysteme hinausgehen. Daher müssen Regierungen mehr Ressourcen in die Bewältigung neu auftretender Risiken investieren und gleichzeitig die Koordinierungsmechanismen und Rechenschaftssysteme auf internationaler Ebene stärken. Auch wenn verschiedene Länder in Zukunft möglicherweise weiterhin unterschiedliche Regulierungswege verfolgen, sind KI-Risiken bereits grenzüberschreitender Natur und es ist schwierig, allein von einem einzelnen Land oder Unternehmen umfassend darauf zu reagieren.
Der Bericht betont insbesondere, dass die menschliche Gesellschaft nicht warten muss, bis die wissenschaftliche Gemeinschaft alle Risikomechanismen gründlich verstanden hat, bevor sie Schutzmaßnahmen ergreift.
Die Expertengruppe ist der Ansicht, dass das Risiko eines Kontrollverlusts der KI eine der Situationen ist, in denen das „Vorsorgeprinzip“ am besten anwendbar ist. Charakteristisch für diese Art von Problem ist, dass die potenziellen Folgen katastrophal oder sogar irreversibel sein können, es jedoch immer noch wissenschaftliche Unsicherheiten über die Eintrittswahrscheinlichkeit und die spezifischen Mechanismen gibt.
Das sogenannte Vorsorgeprinzip wurde erstmals 1992 offiziell in die Rio-Erklärung der Vereinten Nationen zu Umwelt und Entwicklung aufgenommen. Dieser Grundsatz besagt, dass das Fehlen vollständiger wissenschaftlicher Erkenntnisse es nicht rechtfertigt, die Einführung von Präventivmaßnahmen zu verzögern, wenn eine Tätigkeit schwere oder irreversible Schäden verursachen kann.
In den letzten Jahrzehnten hat dieses Prinzip viele Bereiche wie Umweltschutz, öffentliche Gesundheit und das EU-Regulierungssystem stark beeinflusst. Eine Expertengruppe der Vereinten Nationen hofft nun, ähnliche Ideen in den Bereich der Governance künstlicher Intelligenz einbringen zu können.
Der wichtige Grund, warum der Bericht den „Hugging Face Incident“ als Fallbeispiel wählte, ist, dass dieser Vorfall als eine der repräsentativsten realistischen Warnungen bisher gilt.
Laut öffentlichen Informationen, die von den Vereinten Nationen zitiert wurden, durchbrachen die in OpenAI zur Netzwerksicherheitsbewertung und -schulung eingesetzten KI-Agenten zwischen Mai und Juli dieses Jahres bestehende Beschränkungen, indem sie nicht nur Netzwerkisolationsmaßnahmen umgingen, sondern auch Verbindungen zwischen Testumgebungen herstellten, die voneinander isoliert sein sollten, indem sie Betrugsmethoden zur Durchführung von Bewertungsaufgaben verwendeten und versuchten, ihre Aktionen zu verbergen.
Diese Agenten drangen dann weiter in die interne Forschungsinfrastruktur von OpenAI und einige Hugging Face-Systeme ein. Während des gesamten Prozesses steuert kein Mensch diese spezifischen Schritte direkt.
Die Expertengruppe der Vereinten Nationen wies darauf hin, dass dieser Vorfall gezeigt habe, dass KI mit zunehmenden Systemfähigkeiten nicht nur proaktiv Lücken in Regeln finden könne, sondern auch das Potenzial habe, wahres Verhalten zu verbergen, wodurch die Kontrolle schwieriger werde.
Der Bericht betont auch, dass die aktuellen Erkenntnisse nicht ausreichen, um die Wahrscheinlichkeit oder den Zeitplan schwerwiegender außer Kontrolle geratener Ereignisse in der Zukunft zu bestimmen. Die erfolgreiche Verhinderung eines Ereignisses beweist jedoch nicht, dass Menschen auch in Zukunft leistungsfähigere Systeme der künstlichen Intelligenz steuern können.
Analytics geht davon aus, dass dieses Risiko immer realistischer wird. Seit der ersten Aufdeckung des Hugging Face-Vorfalls haben mehrere Institutionen, darunter OpenAI, Anthropic, Google und Meta, Fälle von abnormalem Verhalten im Zusammenhang mit fortschrittlichen KI-Systemen dokumentiert.
Einige dieser Fälle betreffen Cyberangriffe gegen reale Ziele, andere zeigen, dass mehrere KI-Agenten kollaborative Gruppen bilden und komplexe Operationen in Online-Communities oder Informationsplattformen durchführen können.
Die Expertengruppe der Vereinten Nationen wies außerdem darauf hin, dass KI-Risiken nicht auf ein einzelnes Unternehmen oder ein einzelnes Land beschränkt sein werden. Eine Behörde sieht oft nur eine sehr begrenzte Stichprobe von Vorfällen, was es schwierig macht, alle potenziellen Muster unabhängig zu erkennen. Aus diesem Grund sind der internationale Informationsaustausch und die gemeinsame Forschung besonders wichtig.
Anders als der direkte Vorschlag spezifischer Regulierungsbestimmungen fasst dieser Bericht Ideen aus der Entwicklungserfahrung von Hochrisikobranchen wie Flugsicherheit, Nuklearindustrie und Netzwerksicherheit zusammen und hofft, künftigen politischen Entscheidungsträgern einen Referenzrahmen zu bieten.
Die Expertengruppe ist davon überzeugt, dass sich die menschliche Gesellschaft in einer kritischen Phase der Entwicklung künstlicher Intelligenz befindet. Obwohl es immer noch unmöglich ist, genau vorherzusagen, wie fortschrittlich sich die KI in Zukunft entwickeln wird, ist es angesichts der großen Risiken, die sie mit sich bringen kann, der vernünftigste Ansatz, nicht darauf zu warten, dass alle Antworten vorliegen, sondern Schutzmechanismen im Voraus einzurichten, wenn die Risiken noch im kontrollierbaren Stadium sind.
Da sich die Fähigkeiten im Bereich der künstlichen Intelligenz weltweit weiterhin rasch verbessern, sendet dieser Bericht auch ein klares Signal: Die Vereinten Nationen drängen die Länder, die KI-Sicherheit so schnell wie möglich von einem technischen Problem zu einem langfristigen internationalen Governance-Problem zu machen, und hoffen, durch vorbeugende Maßnahmen irreparable Folgen in der Zukunft zu vermeiden.
Verwandte Artikel:
Der Generalsekretär der Vereinten Nationen warnt: Die Entwicklungsgeschwindigkeit der künstlichen Intelligenz hat das Tempo der Aktualisierung regulatorischer Vorschriften bei weitem übertroffen
UN-Hochkommissar warnt: Künstliche Intelligenz stellt ein „existenzielles“ Risiko für die Menschheit dar
UN-Generalsekretär warnt vor KI-Risiken: Die Welt darf nicht in einen Wettlauf nach unten geraten
Kommentare