Die von Elon Musk gegründete KI-Firma SpaceX AI hat kürzlich das neue, fortschrittliche Modell Grok 4.6 veröffentlicht. Dieses Modell richtet sich hauptsächlich an intelligente Agenten, Programmierung und Wissensarbeitsumgebungen und verwendet eine wettbewerbsfähigere Preisstrategie, um die Betriebskosten dieser Arbeitslasten zu senken. Im Smart-Index des Drittanbieters Artificial Analysis erzielte Grok 4.6 einen Score von 61, übertraf das Open-Source-Modell Kimi K3 und erreichte das Niveau von OpenAI’s GPT-5.6 Sol Max, was einen Anstieg von 5 Punkten im Vergleich zur vorherigen Generation Grok 4.5 darstellt.
Aktuell werden die ersten beiden Plätze von Anthropic’s Claude Opus 5 und Claude Fable 5 eingenommen, während Grok 4.6 zusammen mit GPT-5.6 Sol Max den dritten Platz weltweit belegt.
Die Programmier- und Agentenfähigkeiten sind der Schwerpunkt des Upgrades von Grok 4.6. Im DeepSWE v1.1 Benchmark-Test stieg der Score von 54% auf 65,9%; der APEX-Agents Benchmark verbesserte sich von 47,1% auf 57,5%, was einem Anstieg von 10,4 Prozentpunkten entspricht und leicht über GPT-5.6 Sol Max’ 56,7% liegt; der Terminal-Bench v3.0 Score stieg ebenfalls von 15,7% auf 26%. In den letzten beiden Tests behielt jedoch Claude Fable 5 Max die Führung, was zeigt, dass Grok 4.6 zwar erhebliche Fortschritte gemacht hat, aber noch nicht in der Lage ist, die Konkurrenz umfassend zu dominieren.
Grok 4.6 zeigt Wettbewerbsfähigkeit in Preis und Leistung
In Bezug auf die Preisgestaltung liegt der Einstiegspreis für die API von Grok 4.6 bei US$2 pro Million Eingabe-Token (ca. HK$16) und US$6 pro Million Ausgabe-Token (ca. HK$47), was sich im mittleren Preissegment der fortschrittlichen Modelle befindet und weniger als die Hälfte des Preises des Standardmodells GPT-5.6 Sol beträgt. Das Modell unterstützt ein Kontextfenster von 500.000 Token; wenn die Eingabe unter 200.000 Token liegt, wird zum oben genannten Preis abgerechnet, und nach Erreichen von 200.000 Token wird der Preis erhöht. Laut SpaceX AI ist Grok 4.6 ab heute in Grok Build verfügbar und wird gleichzeitig bei der übernommenen KI-Programmierfirma Cursor eingeführt, die auch Partner wie OpenRouter,
Vercel und Cloudflare umfasst.
Auf der Trainingsseite gibt SpaceX AI an, dass Grok 4.6 im Vergleich zu Grok 4.5 länger trainiert wurde und das Reinforcement Learning für allgemeine Programmierung, Wissensarbeit, Kernel-Optimierung, Webentwicklung und computerunterstütztes Design in intelligenten Agentenumgebungen verstärkt hat. In Tests zeigte Grok 4.6 eine stärkere Selbsttest- und Validierungsfähigkeit bei langen Sequenzaufgaben. In Bezug auf die Kosteneffizienz zeigen die Daten von Artificial Analysis, dass Grok 4.6 die AA-Briefcase-Arbeitslast im Durchschnitt mit nur etwa 53 Interaktionen und 500 Millionen Eingabe-Token abschließt, während Claude Opus 5 Max etwa 103 Interaktionen und 20
Milliarden Token benötigt, was den Effizienzvorteil des ersteren deutlich macht.

