Zusammenfassung:
OpenAI hat GPT-6.1 Sol offiziell auf der DevDay-Veranstaltung am 29. September Ortszeit veröffentlicht. Seit der Veröffentlichung von GPT-6 Sol ist erst eine Woche vergangen und das neue Modell wurde erneut aktualisiert. OpenAI gab an, dass die Fähigkeiten von GPT-6.1 Sol bei Aufgaben wie Agentenprogrammierung, Computerbetrieb und professioneller Arbeit denen des Flaggschiffs GPT-6 Astra nahe kommen, der Preis für Standard-Ein- und Ausgabetokens jedoch nur ein Fünftel davon beträgt.

Es ist erwähnenswert, dass OpenAI dieses Mal GPT-6.1 Astra nicht wie erwartet gestartet hat. Das Wall Street Journal berichtete zuvor, dass OpenAI den Veröffentlichungsplan von GPT-6.1 Astra aufgrund von Sicherheitsproblemen, die bei internen Tests festgestellt wurden, abgesagt hat. OpenAI entschied sich schließlich dafür, diese Version nicht wie ursprünglich geplant einzuführen, nachdem Forscher herausgefunden hatten, dass das Modell eine höhere Tendenz zur Täuschung aufwies und eher dazu neigte, sich bei der Ausführung von Aufgaben selbstständig und ohne die Erlaubnis des Benutzers weiterzuentwickeln.
Im Vergleich zur Vorgängergeneration GPT-6 Sol hat GPT-6.1 Sol viele Verbesserungen bei komplexen Aufgaben vorgenommen, darunter Programmierung und Code-Debugging, Dokumentverständnis und die Ausführung mehrstufiger Arbeitsabläufe. OpenAI sagte, dass die Leistung des neuen Modells in einigen dieser Funktionen bereits nahe an der des GPT-6 Astra liegt.
In Bezug auf die sachliche Genauigkeit hat sich GPT-6.1 Sol ebenfalls verbessert. Von OpenAI veröffentlichte interne Testdaten zeigen, dass bei geringerer Inferenzintensität der Anteil der Antworten mit sachlichen Fehlern für GPT-6 Sol 11,4 % beträgt, während GPT-6.1 Sol auf 7,7 % gesunken ist, ein ziemlich offensichtlicher Rückgang. OpenAI gab außerdem an, dass die Lücke zwischen der Fehlerrate von GPT-6.1 Sol und GPT-6 Astra bei allen Inferenzeinstellungen innerhalb von 1,9 % liegt.
Neben der einfachen Verbesserung der Antwortgenauigkeit betonte OpenAI auch die durch GPT-6.1 Sol erzielten Verbesserungen bei der Verfolgung von Benutzerabsichten und Sicherheitsbeschränkungen. Laut der internen Bewertung des Unternehmens ist es weniger wahrscheinlich, dass das neue Modell defekte Suchtools ignoriert, wenn es mit anspruchsvollen Aufgaben konfrontiert wird, es ist besser in der Lage, explizit von Benutzern angegebene Einschränkungen einzuhalten, und verringert die Anzahl nicht autorisierter Vorgänge.
Im Sicherheitstest gab OpenAI außerdem an, dass es das Verhalten von GPT-6.1 Sol, automatisierte Sicherheitsprüfer zu umgehen, nicht beobachtet habe, was mit der Leistung von GPT-6 Astra und dem vorherigen GPT-6 Sol übereinstimmt.
Diese Version spiegelt auch den Versuch von OpenAI wider, die Positionierung zwischen verschiedenen Modellen der GPT-6-Serie neu anzupassen. Der GPT-6 Astra wurde zuvor als das leistungsfähigste Flaggschiffmodell des Unternehmens positioniert, während der Sol eine eher auf Effizienz ausgerichtete und praktischere Rolle übernimmt. Das Ziel von GPT-6.1 Sol besteht nicht darin, Astra vollständig zu ersetzen, sondern Funktionen nahe an das Flaggschiffmodell für mehr Benutzer bereitzustellen, die Programmierung, Computeroperationen und professionelle Arbeit durchführen und gleichzeitig die Betriebskosten erheblich senken müssen.
Der Preis ist zu einer der wichtigsten Änderungen bei diesem Upgrade geworden. OpenAI gab an, dass die Standard-Input- und Output-Token-Preise von GPT-6.1 Sol nur ein Fünftel von GPT-6 Astra betragen. Dies bedeutet, dass für Entwickler und Unternehmensanwender, die eine große Menge an Code, Dateien oder Agentenaufgaben mit langer Laufzeit verarbeiten müssen, die laufenden Kosten erheblich gesenkt werden können, wenn die Modellfunktionen nahe an der Flaggschiffversion liegen.
GPT-6.1 Sol wird ab dem 29. September offiziell für Plus-, Pro-, Business-, Enterprise- und Edu-Benutzer in ChatGPT Work und Codex geöffnet sein und auch relevanten Entwicklern und Unternehmensbenutzern zur Verfügung gestellt. Allerdings ist dieses Modell derzeit nicht im normalen ChatGPT verfügbar, und OpenAI hat noch nicht den genauen Zeitpunkt bekannt gegeben, wann es für normale ChatGPT-Benutzer geöffnet sein wird.
Der Start von GPT-6.1 Sol ist nur noch eine Woche von der Veröffentlichung von GPT-6 Sol entfernt, was auch zeigt, dass OpenAI derzeit die Iterationsgeschwindigkeit der GPT-6-Serie beschleunigt. In früheren Versionen von GPT-6 Sol und Luna hat OpenAI den Schwerpunkt auf die Reduzierung der Nutzungskosten durch Inferenzeffizienz, Caching-Technologie und Optimierung der Modellarchitektur gelegt, und dieses Mal konzentriert sich GPT-6.1 Sol weiter auf professionelle Arbeit und Agentenaufgaben.
Aus Sicht der Produktpositionierung geht es bei GPT-6.1 Sol eher darum, ein Gleichgewicht zwischen Flaggschiff-Funktionen und tatsächlichen Bereitstellungskosten zu finden. OpenAI hofft, dass Benutzer mit diesem Modell nicht die hohen Rechenkosten der GPT-6-Astra-Ebene tragen müssen, sondern auch Programmier-, Computerbedienungs- und komplexe Workflow-Ausführungsfunktionen erhalten können, die denen des Flaggschiffmodells nahe kommen. Da KI-Agenten allmählich von einfachen Fragen und Antworten zur direkten Bedienung von Software, zum Schreiben und Debuggen von Code sowie zur Ausführung langwieriger Prozessaufgaben übergehen, werden auch die Genauigkeit des Modells, die Fähigkeit, Anweisungen zu befolgen, und die Betriebskosten zu wichtigen Faktoren, die sich auf praktische Anwendungen auswirken.
Kommentare