Dark Side of the Moon wird vorgeworfen, in großem Umfang OpenAI-geschützte Argumentationsinhalte extrahiert zu haben und an einem einzigen Tag 16.000 Anfragen gestellt zu haben

📅 2026-10-01

Zusammenfassung:

Kimi K3, eine Tochtergesellschaft des chinesischen KI-Unternehmens Dark Side of the Moon, war kürzlich erneut in die Kontroverse um die Modelldestillation verwickelt. Eine von OpenAI veröffentlichte Untersuchung ergab, dass eine koordinierte Extraktionskampagne, die auf den geschützten Schlussfolgerungsinhalt seiner Modelle abzielte, mit Personen in Verbindung stand, die mit Dark Side of the Moon in Verbindung stehen. Verwandte Aktivitäten generierten an einem einzigen Tag etwa 16.000 Anfragen und beteiligten mehr als 15.000 Benutzer.

OpenAI gab an, dass diese Vorgänge nicht das Verschlüsselungssystem durchbrachen, nicht in die Datenbank eindrangen oder nicht direkt an historische Konversationen des Benutzers gelangten, sondern durch sorgfältig konzipierte mehrrunde Modellinteraktionen versuchten, den ursprünglich verborgenen Argumentationsprozess in einer für den Anforderer sichtbaren Form wiederherzustellen.

OpenAI bezeichnete den Vorfall als „koordiniertes Modelldestillationsereignis“. Die sogenannte Modelldestillation bezieht sich darauf, ein leistungsfähigeres Lehrermodell zu verwenden, um eine große Menge an Output zu generieren, und diese Ergebnisse dann zu verwenden, um ein kleineres oder kostengünstigeres Schülermodell zu trainieren, damit dieses die Verhaltensmuster und Fähigkeiten des Lehrermodells erlernen kann. Die Destillation selbst ist eine gängige Technik im Bereich des maschinellen Lernens. Wenn jedoch kommerzielle Modellergebnisse ohne Genehmigung in großem Maßstab extrahiert und zum Trainieren konkurrierender Modelle verwendet werden, kann dies zu einem Verstoß gegen die Nutzungsbedingungen führen und sogar zu Streitigkeiten über geistiges Eigentum führen.

Laut den von OpenAI veröffentlichten Untersuchungsergebnissen traten entsprechende Aktivitäten erstmals am 1. Juli 2026 auf, als die Anzahl der Anfragen noch relativ gering war. Dann weitete sich die Aktivität allmählich aus, mit offensichtlichen Spitzenwerten am 24. und 25. Juli. Allein in diesen beiden Tagen erkannte OpenAI etwa 16.000 Anfragen mithilfe spezifischer Extraktionsmuster von mehr als 4.000 Benutzern.

OpenAI gab weiter an, dass ähnliche Aufforderungswörter und Betriebsmodi nicht nur bei den oben genannten mehr als 4.000 Benutzern auftauchen, sondern auf eine größere Benutzergruppe von mehr als 15.000 Benutzern verteilt sind. Durch die Analyse der Muster und Korrelationen zwischen diesen Anfragen stellt das Unternehmen fest, dass es sich nicht um völlig unabhängige Verhaltensweisen gewöhnlicher Benutzer handelt, sondern zu einer Aktivität mit koordinierten Merkmalen gehören.

Eine Schlüsseloperation ist von besonderem Interesse. OpenAI sagte, dass das zuständige Personal zunächst den vom Modell zurückgegebenen verschlüsselten Inferenzinhalt aus einer Konversation kopierte und dann das Modell aufforderte, den verborgenen Inhalt in einer separaten Konversation zu entschlüsseln und zu transkribieren. Mit anderen Worten: Sie haben den von OpenAI zum Schutz des Argumentationsprozesses verwendeten Verschlüsselungsmechanismus nicht direkt geknackt, sondern versucht, die eigenen Fähigkeiten des Modells zu nutzen, um das Modell einen anderen geschützten Inhalt verarbeiten zu lassen und so die Informationen indirekt wiederherzustellen.

OpenAI betonte, dass diese Aktivität weder die Verschlüsselung erfolgreich „gebrochen“ noch die Datenbank von OpenAI durchbrochen und auch keine auf dem Server gespeicherten Benutzer-Chat-Datensätze erhalten habe. Sein Erfolg liegt hauptsächlich darin, die Interaktionen zwischen Modellen so zu manipulieren, dass geschützte Inferenzinformationen, die dem Benutzer sonst nicht direkt angezeigt würden, in anderer Form wieder angezeigt werden.

OpenAI blockierte diese Art von Aktivität schließlich um den 28. Juli herum vollständig. Das Unternehmen gab an, dass es bei seiner Untersuchung herausgefunden habe, dass einer der Kernaktivitätscluster mit Personen in Zusammenhang stehe, die mit Dark Side of the Moon in Verbindung stehen. OpenAI sagte in einer öffentlichen Erklärung, dass es in der Lage sei, den Kerncluster „Personen zuzuordnen, die mit dem Kimi-Entwickler Dark Side of the Moon in Verbindung stehen“.

Dark Side of the Moon ist ein chinesisches KI-Unternehmen, dessen Modellreihe Kimi sich in den letzten Jahren rasant weiterentwickelt hat. Im Juli 2026 veröffentlichte das Unternehmen Kimi K3, ein offenes Gewichtungsmodell mit etwa 2,8 Billionen Parametern, und positionierte es als Modell der neuen Generation für Codeprogrammierung, komplexes Denken und KI-Agentenaufgaben. Kimi K3 zog nach seiner Veröffentlichung schnell die Aufmerksamkeit globaler KI-Entwickler auf sich und seine Leistung lag in einigen Tests Dritter nahe an der des führenden Closed-Source-Modells in den USA.

Diese OpenAI-Untersuchung hat auch auf die früheren Zweifel der US-Regierung an der Quelle des Kimi-Modells aufmerksam gemacht. Michael Kratzios, Direktor des Büros für Wissenschafts- und Technologiepolitik des Weißen Hauses und Chefberater für Wissenschaft und Technologie, sagte Ende Juli dieses Jahres, dass die US-Regierung über relevante Informationen verfüge und glaube, dass Dark Side of the Moon das Modell von Anthropic zur Destillation von Kimi K3 verwendet habe. Dark Side of the Moon hat den Vorwurf nicht anerkannt.

Zusätzlich zur Regierungserklärung haben kürzlich andere Forscher die Trainingsquellen des Kimi-K3-Modells analysiert. Eine Studie ergab, dass allein die Eingabe eines Teils des entschlüsselten Argumentationsinhalts von Claude Opus 4.8 in Kimi K3 den nachfolgenden Denkprozess und die endgültige Antwort von Kimi K3 erheblich verändern kann, sodass es wie ein Ausdruck erscheint, der dem von Claude näher kommt. Auf dieser Grundlage glauben die Forscher, dass die Schwierigkeit, bestimmte Claude- und GPT-Argumentationsinhalte in Kimi K3 zu extrahieren, deutlich geringer ist als bei anderen Modellen.

Allerdings beweisen diese Studien nicht allein, dass der Kimi K3 als Ganzes durch unerlaubte Methoden von anderen Modellen abgeleitet wurde. Bei großen Sprachmodellen treten ähnliche Antwortmethoden, Argumentationsstrukturen und Wissensausdrücke auf, die auch auf verschiedene Faktoren wie öffentliche Daten, ähnliche Trainingsziele, Methoden des verstärkenden Lernens und die Modellarchitektur zurückzuführen sein können. Daher ist das Vorhandensein teilweiser Verhaltensähnlichkeiten zwischen Modellen nicht gleichbedeutend mit nachgewiesenen Unregelmäßigkeiten in der Quelle ihrer Trainingsdaten.

Kimi K3 selbst enthält auch von Dark Side of the Moon entwickelte Technologie. Das Modell wurde unter Verwendung von Architekturen wie Kimi Delta Attention entworfen und ist für groß angelegte Inferenzaufgaben optimiert. Dark Side of the Moon reduziert außerdem die Inferenzkosten, indem es den KV-Cache reduziert und den Speicherbedarf jedes Tokens optimiert. Diese Technologien ermöglichen den Betrieb von Kimi K3 auf der Hardware großer Rechenzentren.

Das Besondere an dieser Kontroverse ist, dass das von OpenAI selbst behauptete Verhalten nicht einfach darin besteht, die Modellantwort zu kopieren, sondern ein Versuch ist, aktiv „geschützte Argumentation“ zu erhalten, die das Modell normalerweise nicht direkt anzeigt. Da immer mehr KI-Unternehmen versteckte Argumentations- oder verschlüsselte Argumentationsmechanismen einführen, ist diese Art von Informationen zu einem wichtigen Bestandteil des Modellfähigkeitsschutzes geworden. Wenn konkurrierende Modelle in der Lage sind, ihre Inhalte durch groß angelegte automatisierte Anfragen wiederherzustellen, stehen die von Modellanbietern zum Schutz von Trainingsergebnissen und Inferenzfunktionen verwendeten Mechanismen möglicherweise vor neuen Herausforderungen.

OpenAI hat in den letzten Jahren mehrfach gegen ähnliche Modelldestillationsverhalten vorgegangen. Das Unternehmen ist davon überzeugt, dass eine groß angelegte Automatisierung des Aufrufs von Geschäftsmodellen, der Erfassung ihrer Ergebnisse und deren Nutzung zum Trainieren konkurrierender Modelle es einer Partei mit großen Mengen an Rechenressourcen ermöglichen wird, die Fähigkeiten, die andere Modelle durch langfristige Forschung und Entwicklung entwickelt haben, zu geringeren Kosten zu reproduzieren.

Gleichzeitig zeigt dieser Vorfall auch, dass die Destillation von KI-Modellen zu einem heiklen Thema im Wettbewerb um künstliche Intelligenz zwischen China und den Vereinigten Staaten wird. Die US-Regierung hat wiederholt davor gewarnt, dass chinesische KI-Unternehmen die Modellproduktion von US-Unternehmen nutzen könnten, um ihre eigene Modellentwicklung zu beschleunigen, während chinesische Unternehmen weiterhin die Bedeutung unabhängiger Forschungs- und Entwicklungskapazitäten und offener Gewichtsmodelle betonen. In Bezug auf die aktuellen öffentlichen Informationen hat OpenAI die Entdeckung groß angelegter Extraktionsaktivitäten bestätigt und erklärt, dass sein Kernaktivitätscluster mit Menschen zusammenhängt, die mit der dunklen Seite des Mondes in Verbindung stehen. Allerdings bedarf es noch weiterer öffentlicher Beweise, um diese Zuschreibung und die Frage, ob damit verbundene Aktivitäten letztendlich dazu genutzt werden, Kimi K3 zu trainieren, zu beweisen.

Weitere Informationen:

https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign/

Verwandte Tags

Ähnliche Artikel

Kommentare

0/500
Captcha (click to refresh)
Keine Kommentare