xAI veröffentlicht Grok 4.7: Spezialisiert auf Programmierung und Wissensarbeit, der Preis ist auf die Hälfte der Konkurrenzprodukte reduziert

📅 2026-09-22

Zusammenfassung:

xAI, Musks Unternehmen für künstliche Intelligenz, hat Grok 4.7, eine neue Generation großer Modelle, offiziell veröffentlicht und es als das derzeit leistungsstärkste Programmier- und Wissensarbeitsmodell positioniert. Das Unternehmen gab an, dass das neue Modell nicht nur die Verarbeitungsfähigkeiten komplexer Aufgaben verbessert, sondern auch die gleiche Betriebsgeschwindigkeit und das gleiche Preissystem wie die Produkte der vorherigen Generation beibehält und mit geringeren Kosten auf dem Markt konkurriert.

image.png

Laut von xAI veröffentlichten Informationen übernimmt Grok 4.7 ein neues, größeres Grundmodell und führt während des Trainingsprozesses eine längere Optimierung des Verstärkungslernens durch. Im Vergleich zu früheren Versionen ist das neue Modell komplexeren Trainingsaufgaben ausgesetzt, wobei eine große Anzahl von Aufgaben auf mehrere Stunden ausgelegt ist. Dadurch kann das Modell erhebliche Verbesserungen beim langfristigen Denken, bei der Selbstverifizierung und bei der Verwaltung komplexer Aufgaben erzielen.

xAI sagte, dass eine der größten Änderungen in Grok 4.7 seine stärkere „Selbsttestfähigkeit“ sei. Modelle können ihre eigene Ausgabe proaktiver überprüfen, wenn sie Fragen beantworten, Code schreiben und komplexe Wissensaufgaben ausführen, wodurch Fehlerraten reduziert und die Zuverlässigkeit der Endergebnisse verbessert werden.

Gleichzeitig wurde auch die Fähigkeit des neuen Modells verbessert, extrem lange Kontexte zu verarbeiten. Bei großen Dokumenten, mehreren Aufgabenrunden und langwieriger Projektarbeit kann Grok 4.7 stabilere Informationsverwaltungsfunktionen ohne offensichtliche Leistungseinbußen aufrechterhalten, wenn der Kontext wächst, wie es bei einigen herkömmlichen Modellen der Fall ist.

Um die tatsächliche Arbeitserfahrung weiter zu verbessern, trainiert xAI Grok 4.7 auch speziell, um das Grok Bot-Betriebsframework nativ zu verstehen. Dies bedeutet, dass es nicht nur für einmalige Frage- und Antwortszenarien geeignet ist, sondern auch besser für die Teilnahme an Arbeitsabläufen als langfristiger intelligenter Agent. Das Unternehmen geht davon aus, dass dadurch die Modellleistung bei der allgemeinen Wissensarbeit, laufenden Gesprächen und Aufgaben auf Unternehmensebene verbessert wird.

Zusätzlich zu den Programmierfunktionen verfügt Grok 4.7 auch über stärkere Funktionen zur Erstellung von Dokumenten und Präsentationen. Beamte gaben an, dass das Modell nun besser in der Lage sei, professionelle Berichte, Geschäftsdokumente und Präsentationsmaterialien zu erstellen, und hofften, seinen Anwendungsbereich im Bereich der Büroautomation weiter auszubauen.

In Bezug auf die Leistung gab xAI eine Reihe interner Testergebnisse bekannt.

Im CursorBench 4.0-Test, der zur Bewertung langfristiger Software-Engineering-Fähigkeiten verwendet wird, erreichte Grok 4.7 eine Punktzahl von 46,3 %, was im Vergleich zu den 40,4 % von Grok 4.6 eine deutliche Verbesserung darstellt. Im DeepSWE-Software-Engineering-Test erreichte das neue Modell eine Punktzahl von 71 % und blieb damit weiterhin auf einem Wettbewerbsniveau, das den führenden Produkten der Branche nahe kommt.

Im EEBench-Test im Bereich Elektrotechnik erreichte Grok 4.7 eine Punktzahl von 64 %, eine Steigerung von mehr als zehn Prozentpunkten im Vergleich zur Vorgängergeneration. Bei Office-Aufgaben mit hohem Fachwissen und komplexen Arbeitsabläufen verbesserte sich die Leistung des Modells auch im AA-Aktenkoffer-Test.

In Bezug auf die rechtliche Analyse erzielte Grok 4.7 im Harvey Legal Agent Benchmark-Test eine Punktzahl von 19,6 %, was eine weitere Verbesserung im Vergleich zum Produkt der vorherigen Generation darstellt. Auch im Bereich Medical Reasoning verbesserten sich die Ergebnisse von HealthBench Professional von 48,5 % auf 56,7 %.

Im Bereich der Allgemeinwissensarbeit hat xAI insbesondere die beiden Auswertungsergebnisse GDPval und AA Briefcase hervorgehoben. Das Unternehmen ist davon überzeugt, dass diese Tests den tatsächlichen Arbeitsinhalten von Fachleuten wie Anwälten, Krankenschwestern und Finanzanalysten näher kommen, und Grok 4.7 hat in diesen Szenarien das Wettbewerbsniveau aktueller Spitzenmodelle erreicht.

image.png

image.png

image.png

Der Preis ist ein weiteres wichtiges Verkaufsargument dieser Version.

image.png

Offiziellen Daten zufolge bleibt der Input-Preis von Grok 4,7 bei 2 US-Dollar pro Million Token, und der Output-Preis beträgt 6 US-Dollar pro Million Token, was mit Grok 4,6 übereinstimmt. Im Vergleich zu einigen hochmodernen Modellen, die oft ein Vielfaches oder sogar das Zehnfache kosten, betont xAI, dass Grok 4.7 Aufgaben auf ähnlichem Niveau zu geringeren Kosten erledigen kann.

Das Unternehmen beschreibt es sogar als eine Lösung, die „konkurrenzfähige Leistung zum etwa halben Preis von Modellen des gleichen Niveaus bietet“ und hofft, durch den Kostenvorteil den Marktanteil weiter auszubauen.

In Bezug auf die Sicherheit sagte xAI, dass Grok 4.7 ein neu aufgebautes Sicherheitsschutzsystem einführt. Laut internen Testergebnissen hat das neue Modell das beste Niveau der Grok-Reihe erreicht, was die Ablehnung gefährlicher Anfragen, die Widerstandsfähigkeit gegen Jailbreak-Angriffe und die Identifizierung von Inhalten mit hohem Risiko angeht.

Insbesondere in sensiblen Bereichen wie Cybersicherheit und Biosicherheit sollen Modelle dazu beitragen, legitime Verteidigungsaufgaben zu bewältigen und gleichzeitig gefährliche oder böswillige Verwendungen zu verweigern. Offizielle Daten zeigen, dass Grok 4.7 bei einigen Netzwerksicherheitsrisikotests und Biosicherheitsbewertungen Spitzenleistungen erbracht hat.

Derzeit steht Grok 4.7 Benutzern über die API und die Grok-Plattform zur Verfügung. Entwickler können dieses Modell für die Programmierung, Wissensfragen und -antworten, das Schreiben von Dokumenten und die Entwicklung intelligenter Agentenanwendungen aufrufen.

Mit der offiziellen Einführung von Grok 4.7 hat xAI das Tempo der Produktiteration weiter beschleunigt. Von der Veröffentlichung von Grok 4.5 im Juli dieses Jahres über die Einführung von Grok 4.6 im August bis hin zu Grok 4.7 hat xAI in weniger als drei Monaten drei große Upgrades abgeschlossen. Für den hart umkämpften Markt für künstliche Intelligenz ist Grok 4.7 nicht nur ein regelmäßiges Update, sondern zeigt auch die strategische Absicht von xAI, Branchenführer durch schnellere Iterationen, niedrigere Preise und stärkere Arbeitskapazitäten herauszufordern.

Verwandte Tags

Ähnliche Artikel

Kommentare

0/500
Captcha (click to refresh)
Keine Kommentare