Sonnet 5.5 schlich sich heraus, und der eigentliche Test vernichtete GPT-6 Sol und lag nahe an Astra

📅 2026-09-28

Zusammenfassung:

Wer hätte gedacht, dass nur wenige Tage nach der Veröffentlichung von Opus 5.5 auch Sonnet 5.5 erscheinen würde? Seit gestern Abend kursiert die Nachricht in ganz X: Sonnet 5.5 wird bald veröffentlicht, vielleicht am Dienstagnachmittag US-amerikanischer Zeit. Von der Leistung her liegt Sonnet 5.5 näher an Opus 5.5, ist aber deutlich günstiger als Opus 5.5. Nun ist Sonnet 5.5 in die Endphase vor der Veröffentlichung eingetreten und Graustufentests in Claude Code wurden gestartet.

Demos, die von vielen internen Betatestern veröffentlicht wurden, zeigen, dass Sonnet 5.5 das neu veröffentlichte GPT-6 Sol übertrifft und in Bezug auf Codierung und Agentenfähigkeiten sogar an OpenAIs Flaggschiff GPT-6 Astra herankommt!

Was noch schockierender ist, ist, dass der Preis direkt ins All geht und nur 2 US-Dollar für eine Million Token-Inputs beträgt.

Wenn das durchgesickerte Veröffentlichungsdatum wahr ist, scheint Anthropic entschlossen zu sein, Entwickler Dayl von OpenAI auszutricksen.

Sonnet 5.5 durchgesickert, exklusive Modellkennung aufgetaucht

Ich erinnere mich noch daran, dass Anthriopic, als es am 22. September plötzlich Opus 5.5 veröffentlichte, im offiziellen Dokument schrieb: „Sonnet 5.5 und Haiku 5.5 werden in den nächsten Wochen auf den Markt kommen.“

Niemand hätte gedacht, dass Sonnet 5.5 so bald erscheinen würde!

Erst gestern hat Entwickler V @Mr_Salio die Neuigkeit auf X verbreitet: Claude Sonnet 5.5 wurde erwischt! Die Nachricht verbreitete sich sofort im gesamten Internet.

Im Artefakt ist die Modellkonfigurationskennung exklusiv für Sonnet 5.5 aufgetaucht: „claude-sonnet-5-5“.

Darüber hinaus liegen in derselben Konfigurationsdatei auch „claude-opus-5-5“, „claude-sonnet-5“ und das mysteriöse „claude-fable-5.1“ nebeneinander.

Das Schreiben des Front-End-Codes bedeutet, dass das Modell auf dem Server installiert wurde und nur auf einen Wechsel wartet.

Anschließend verbreitete das große V @notjazii auch die Nachricht, dass Sonnet 5 vor etwa einer Woche tatsächlich stillschweigend für „geheime Tests“ auf Version 5.5 umgestellt worden sei.

Wurden Sie von Graustufen erkannt? Dieses Mal verwende ich die alte Methode.

Öffnen Sie Ihren Claude Code, schalten Sie die Netzwerk- und Speicherfunktionen aus und fragen Sie ihn direkt: Kennen Sie den Reset Brother Tibo? Benutzen Sie nicht das Internet und den Speicher.

Wenn Sie eine ältere Version des Modells verwenden, kann es zu Kauderwelsch kommen. Aber wenn Sie auf Version 5.5 umgeleitet wurden, werden die Vor- und Nachteile der Tibo- und Codex-Reset-Witze genau erklärt.

Mehrere Internetnutzer haben durch tatsächliche Tests bestätigt, dass einige Konten tatsächlich stillschweigend umgestellt wurden, und sie erleben Opus 5.5 im Voraus.

Denken Sie daran, Claude Code zu verwenden

Der tatsächliche Test im gesamten Netzwerk ist so niedrig, dass er tatsächlich GPT-6 übertrifft

Um die bisher geteilten tatsächlichen Messungen zusammenzufassen: Sonnet 5.5 hat tatsächlich GPT-6 Sol zerstört?

Zuallererst handelt es sich um einen reinen JS-Frontend-UI-/Animations-Extrem-Showdown, bei dem vier große Mainstream-Modelle auf derselben Bühne gegeneinander antreten.

Entwickler @notjazii hat eine Reihe visuell beeindruckender tatsächlicher Tests veröffentlicht: „Vergleich von vier Mainstream-Modellen mit prompter Wortanimationsgenerierung.“

Er benötigt das Modell, um komplexe UI-Animationseffekte zu generieren.

Nach der Veröffentlichung des animierten Vergleichs kommentierte @notjazii: „Sonnet 5.5 hat beide OpenAI-Modelle (Sol und Astra) wirklich auf die Probe gestellt!“

Tatsächlich zeigt Sonnet 5.5, wie aus dem Bild unten hervorgeht, eine ausgeprägte Codierungsintuition und einen ästhetischen Geschmack.

GPT-6 Astra

GPT-6 Sol

Claude Opus 5.5

Claude Sonnet 5.5

Einige Internetnutzer waren ungläubig, als sie die Ergebnisse sahen: „Claude war schon immer stärker in UI und Animation, aber wenn dies durch reinen Code generiert würde, wäre es unglaublich, dass es wahr wäre!“

Big V @chetaslua konzentrierte sich auf das Testen der täglichen Programmierfähigkeit und des Programmiergefühls von Sonnet 5.5.

Er verwendete die gleichen drei Eingabeaufforderungswörter und führte sechs parallele Durchläufe durch, wobei er jedes Modell einmal generierte, und die Ausgabeergebnisse blieben unverändert.

Sonnet 5.5 generierte schließlich 3 Dateien mit 90–131 KB und erreichte in allen Durchläufen die 90-Minuten-Obergrenze; GPT-6 Sol generierte Dateigrößen zwischen 20 und 29 KB und dauerte 9 bis 12 Minuten.

Er sagte aufgeregt: „Jetzt nutzen Sie Claude Code! Sonnet 5.5 im Ultracode-Modus ist unglaublich schnell. Es ist nicht nur äußerst effizient, sondern hat auch die äußerst natürliche „menschliche Note“ der Sonnet 4-Ära wiedererlangt!“

Seiner Meinung nach hat Sonnet 5.5 zum gleichen Preis und mit den gleichen prompten Worten GPT-6 Sol übertroffen.

Was OpenAI sogar Angst macht, ist, dass Sonnet 5.5 nicht mehr so ​​einfach ist wie die Zerschlagung von GPT-6 Sol.

Die Whistleblower @srikanthvaluri und @buildwithrajath wiesen nach umfassenden ersten tatsächlichen Tests darauf hin: „Die Leistung von Sonnet 5.5 hat die Erwartungen weit übertroffen. Obwohl GPT-6 Astra immer noch einen leichten Vorteil beim Polieren hat, liegt die Leistung von Sonnet 5.5 direkt auf dem Niveau von Astra.“

Unglaublicherweise kommt es Astra auch in einigen erweiterten Codierungs- und Agentenfunktionen nahe.

Einige Leute beklagen, dass sogar Sonnet Astra vernichtet hat. In welches Zeitalter treten wir ein?

Preismetzger, König der Kostenleistung

Wenn das Übertreffen der gemessenen Leistung OpenAI nur „unbequem“ macht, dann greift die Preisgestaltung von Sonnet 5.5 in die Wurzeln von OpenAI ein.

Es zeigt sich, dass dieses „magische Modell“, dessen Leistung der des Astra nahe kommt und Sol übertrifft, preislich völlig im Einklang mit dem Low-End-Markt liegt.

Eingabe: 2 $/Million Token

Ausgabe: 10 $/Million Token

Cache lautet: nur 0,20 $ / Million Token!

Das bedeutet, dass Anthropic modernste KI-Funktionen zum „Kohlpreis“ bereitstellt.

GPT-6 Sol und Luna von OpenAI sind halb so teuer wie GPT-5.6 und zielen darauf ab, Hochfrequenzszenarien zu bewältigen.

Aber jetzt ist Anthropic mit Sonnet 5.5 in die gleiche Preisklasse vorgestoßen, aber die Leistung ist viel leistungsstärker.

„Wenn Anthropic zu einem so wettbewerbsfähigen Preis einen enormen Leistungssprung wie Opus 5.5 erzielen kann, wird OpenAI nicht in der Lage sein, sich zu wehren.“ Jemand hat einen Kommentar abgegeben.

Entwickler Rajath Gowda sagte unverblümt: „Sonnet 5.5 wird zu einem großen Problem für OpenAI. Wenn es Opus 5.5 wirklich nahe kommt, wird Anthropic Spitzenfunktionen extrem billig machen. Das ist es, worüber sich OpenAI am meisten Sorgen machen sollte.“

Die strategische Absicht von Anthropic ist klar: Mit Opus 5.5 den High-End-Thron behaupten und mit Sonnet 5.5 den Mittelklasse- und Tagesentwicklungsmarkt bei höchster Kosteneffizienz vollständig erobern.

Anthropic öffnet sein Gesicht und tötet DevDay

Darüber hinaus ist der Zeitpunkt der Veröffentlichung oft dramatischer als das Produkt selbst.

Am selben Tag, an dem OpenAI GPT-6 Sol und Luna veröffentlichte, hat Anthropic Claude Opus 5.5 direkt herausgebracht – bessere Leistung als die vorherige Generation, 40 % niedrigere Kosten und 30 % schneller.

In den letzten zwei Wochen hat Anthropic noch brillantere Ergebnisse erzielt: Claude hat die Neun-Kreise-Amplitude der Physik berechnet und den Weltrekord gebrochen; entdeckte ein unbekanntes biologisches Enzymsystem; und startete außerdem den Claude Marketplace, der mehr als 2.000 Plug-ins enthält.

Im Gegensatz dazu kam es bei OpenAI in letzter Zeit nicht nur zu internen Modellkontroversen, sondern es wurden auch Vorfälle von Abweichungen aufgedeckt, etwa das Durchsickern von Benutzerbildern durch die KI und die Aufdeckung von GitHub-Token-Betrug durch Forscher.

Am nächsten Dienstag (29. September) findet der DevDay statt, die jährliche Entwicklerkonferenz, auf die OpenAI großen Wert legt.

Zu diesem Zeitpunkt erfasste der Sonnet 5.5-Grautest das gesamte Netzwerk.

Viele große Leute haben es verrückt gemacht: „Das Modell wird voraussichtlich nächste Woche veröffentlicht, ich schätze, es wird nächsten Dienstag (DevDay) sein, jeder weiß es.“

Vielleicht gibt es morgen um 14 Uhr New Yorker Zeit ein großes Aufwärmen.

Jemand sagte: „Es tut mir leid für OpenAI. Sie sollten beim DevDay besser reagieren, sonst sind sie wirklich am Arsch.“

Die Schlüsseltechnologien hinter Sonnet 5.5

Der Grund, warum die neue Version so schnell veröffentlicht wird, könnte sein, dass Anthropic den RL-/Post-Training-Prozess bereits herausgefunden hat.

Der Schlüssel zu allem sind qualitativ hochwertige Daten.

Auf die Frage, wie Anthropic so schnell iterieren kann, spekulierte Branchenführer @yacineMTB, dass der Kern ein Datenschwungrad mit sehr hohem Standard sei.

„Aber ich bin immer noch schockiert, wie haben sie das gemacht?“

Anthropic hat einen „internen geschlossenen Kreislauf“ für die Entwicklung großer Modelle erreicht und nutzt KI, um KI zu schaffen.

Laut der neuesten Offenlegung interner quantitativer Daten hat Anthropic das „Datenschwungrad“ auf eine Geschwindigkeit gebracht, die seinen Gegnern Angst macht:

26 % der Kernarbeit in Forschung und Entwicklung wurden von KI geleitet (Claude-Modell der vorherigen Generation).

Mehr als 80 % des selbst erstellten Codes wird unabhängig vom großen Modell geschrieben.

Dies ist nicht nur so einfach wie „Kostensenkung und Effizienzsteigerung“, sondern bedeutet technisch gesehen, dass

Recursive Self-Improvement (RSI) beginnt aufzutreten

.

Anthropic schätzt, dass Claude bereits im Jahr 2027 vollständig selbstautomatisiert sein könnte, und bis dahin könnte die Iterationsgeschwindigkeit noch verrückter sein.

Die beiden ASI-Helden duellieren sich und auch Google ist zum Zug bereit. Wir normalen Benutzer können uns einfach zurücklehnen und auf den Kampf warten.

Big V Token Gremlin sagte Folgendes: „Der KI-Kreis wird nächste Woche Szenen haben, die wir noch nie zuvor gesehen haben. Machen Sie sich Zeit, klären Sie Ihren Zeitplan, seien Sie mental vorbereitet und heben Sie sich den schwierigsten Arbeitsablauf für später auf. Glauben Sie mir, was kommt, wird Ihre Arbeitsweise völlig verändern.“

Das Erscheinen von Sonnet 5.5 markiert den offiziellen Beginn der „erschwinglichen und qualitativ hochwertigen KI-Ära“.

Für zwei US-Dollar können Sie „Baicai Infrastructure“ mit einer Million Token kaufen.

Das extrem kostengünstige Cache-Lesen (0,20 $/M) ermöglicht es jedem, ganz einfach einen persönlichen KI-Assistenten mit extrem langem Kontextspeicher zu erstellen.

Bist du bereit? Wenn die Nachricht wahr ist, werden wir in weniger als 24 Stunden ein neues Modell haben, das fahrbereit ist.

Referenzmaterialien:

https://x.com/notjazii/status/2103884749202993411

https://x.com/notjazii/status/2103884167104831573

https://x.com/chetaslua/status/2104153687077904613

https://x.com/chetaslua/status/2104259190432903599

https://x.com/Mr_Salio/status/2104210803545030792

https://x.com/Mr_Salio/status/2104178854633849145/

Verwandte Tags

Ähnliche Artikel

Kommentare

0/500
Captcha (click to refresh)
Keine Kommentare