Letzte Woche brachte OpenAI GPT-4.5 auf den Markt, sein bisher größtes Spitzenmodell. OpenAI behauptet, dass GPT-4.5 das bisher sachkundigste Modell ist, das durch eine weitere Erweiterung des Vortrainingsprozesses erstellt wurde. Im Vergleich zu den älteren Modellen von OpenAI verfügt das GPT-4.5-Modell nicht nur über mehr Wissen, sondern auch über verbesserte Schreibfähigkeiten und eine verfeinerte Persönlichkeit.
Heute debütierte das GPT-4.5-Modell auf ChatbotArena und belegte in den meisten Kategorien den ersten Platz. In den folgenden Kategorien belegt GPT-4.5 den ersten Platz und liegt in der Kategorie „Multi-Turn“ weit vorne. Auch in der Style-Control-Rangliste liegt GPT-4.5 weit vorn.
Mehrere Runden
Harte Erinnerung
Programmierung
Mathe
kreatives Schreiben
Tracking-Anleitung
längere Anfragen
Das neueste Grok-3-Modell von xAI (grok-3-preview-02-24) erschien ebenfalls zum ersten Mal auf der Arena-Bestenliste und belegte den ersten Platz bei „Schwierigkeitstipps“ (Englisch) sowie den ersten Platz bei „Codierung“, „Mathe“, „Kreatives Schreiben“, „Anweisungsverfolgung“ und „Lange Abfragen“. Die rasanten Fortschritte von GPT-4.5 und Grok-3 verdeutlichen den zunehmend härteren Wettbewerb im Bereich der künstlichen Intelligenz.
GPT-4.5 von OpenAI übertraf mehrere andere Benchmarks für künstliche Intelligenz. Im „Knockout“-Benchmark belegte es den ersten Platz. Das Knockout-Turnier ist ein Mehrparteien-Wettbewerb, der das soziale Denken, die Strategie und die Täuschungsfähigkeiten von LLM auf die Probe stellt. In der Rangliste der IQ-Testergebnisse übertrifft GPT-4.5 alle anderen Nicht-Inferenzmodelle der Branche. Beim SimpleQA-Halluzinationsraten-Benchmark schneidet GPT-4.5 von allen großen Sprachmodellen von OpenAI am schlechtesten ab.
Letzten Monat gab OpenAI-CEO Sam Altman bekannt, dass GPT-4.5 das letzte nicht denkende Kettenmodell von OpenAI ist. Darüber hinaus wird OpenAI o3 nicht mehr als eigenständiges Modell veröffentlichen. Stattdessen wird OpenAI die Modelle der o-Serie und der GPT-Serie vereinheitlichen und so ein System schaffen, das auf der Grundlage von Benutzeranfragen geeignete Denkzeiten bestimmt.
SamAltman bestätigte außerdem, dass sogar Benutzer des kostenlosen ChatGPT-Tarifs GPT-5 verwenden können, allerdings nur mit standardmäßigen Smart-Einstellungen. ChatGPTPlus-Benutzer können GPT-5 auf einem höheren Intelligenzniveau ausführen, während Pro-Benutzer GPT-5 auf einem höheren Intelligenzniveau ausführen können. Darüber hinaus unterstützt der einheitliche Modus alle vorhandenen ChatGPT-Funktionen wie Sprache, Canvas, Suche, eingehende Recherche usw.