xAI veröffentlicht Grok 4.5: Fast auf Frontier-Niveau, aber deutlich günstiger als die Konkurrenz
Update –
- Artificial Analysis Resultate ergänzt
Update vom 9. Juni 2026:
Artificial Analysis stuft Grok 4.5 auf Platz vier seines Intelligence Index ein, hinter Fable 5, GPT-5.5 und Opus 4.8. Das Modell verbessere sich um 16 Punkte gegenüber Grok 4.3 und bringe SpaceXAI damit an die Leistungsgrenze, hinter OpenAI und Anthropic, aber vor allen Open-Weights-Modellen und Googles Gemini.
Der unabhängige KI-Benchmark-Dienst misst die Leistung von KI-Modellen über verschiedene Aufgaben hinweg und aggregiert den Score. Insgesamt sei Grok 4.5 sehr kosteneffizient: Eine Aufgabe im Intelligence Index koste nur 0,31 Dollar, weniger als GLM-5.2 und Kimi K2.6, und fünfmal günstiger als Claude Sonnet 5 (max), bei besserer Leistung im selben Index.

Bei agentenbasierten Aufgaben schneidet Grok 4.5 laut Artificial Analysis besonders stark ab: Auf dem Coding Agent Index erreiche Grok 4.5 in Grok Build, xAIs Claude-Code-Pendant, 76 Punkte, auf Augenhöhe mit GPT-5.5 in Codex und knapp hinter Fable 5 in Claude Code, aber bei einem Bruchteil der Kosten.
Pro Aufgabe koste Grok 4.5 in Grok Build 2,49 Dollar, verglichen mit 5,07 Dollar für GPT-5.5 in Codex und 11,80 Dollar für Fable 5 in Claude Code. Grok 4.5 verbrauche dabei im Schnitt nur 1,9 Millionen Tokens pro Aufgabe, deutlich weniger als GPT-5.5 (6,2M) und Fable 5 (7,2M).

Artificial Analysis weist auch auf eine Schwäche hin: Zwar stieg die Genauigkeit im AA-Omniscience-Index von 35 auf 52 Prozent, die Halluzinationsrate erhöhte sich aber ebenfalls von 25 auf 54 Prozent. Größere Modelle wüssten zwar mehr, seien aber auch überzeugter von falschem Wissen.
Ursprünglicher Artikel vom 9. Juni 2026:
xAI veröffentlicht Grok 4.5. Das Modell wurde laut xAI auf zehntausenden Nvidia GB300 GPUs trainiert und ist auf Programmierung, agentenbasierte Aufgaben und Wissensarbeit ausgelegt.
Grok 4.5 kratzt am Frontier-Niveau: In Benchmarks wie DeepSWE, Terminal Bench und SWE Bench Pro liegt es zwar deutlich hinter Anthropics Fable 5 und teils nur knapp hinter OpenAIs GPT-5.5, übertrifft aber im agentischen Coding-Benchmark Terminal Bench etwa Anthropics Opus 4.8.
| Modell | DeepSWE 1.1 | Terminal Bench 2.1 | SWE Bench Pro |
|---|---|---|---|
| Fable max | 70 % | 84,3 % | 80,4 % |
| GPT 5.5 xhigh | 67 % | 83,4 % | 58,6 % |
| Opus 4.8 max | 59 % | 78,9 % | 69,2 % |
| Grok 4.5 | 53 % | 83,3 % | 64,7 % |
| GLM 5.2 | 44 % | 81,0 % | 62,1 % |
Beim Training setzte xAI nach eigenen Angaben auf umfangreiche Datenfilterung, Deduplizierung und domänenspezifische Auswahl, um die Datenqualität hochzuhalten. Das Reinforcement Learning umfasst laut xAI hunderttausende Aufgaben, vor allem aus dem Bereich Software-Engineering, mit automatisierter Bewertung. Die Trainingsinfrastruktur ist auf asynchrones Lernen ausgelegt. Agentenbasierte Durchläufe können so über viele Stunden laufen, während das Training parallel weitergeht.
Laut Elon Musk hat Grok 4.5 mit 1,5 Billionen Parametern die dreifache Größe seines Vorgängers. Das Kontextfenster wurde allerdings von 1 Million auf 500.000 Tokens reduziert.
Grok 4.5 greift nach der Preis-Leistungs-Krone
xAI betont besonders die Token-Effizienz. Grok 4.5 brauche 4,2-mal weniger Tokens als Opus 4.8 bei SWE-Bench-Pro-Aufgaben und liefere Ergebnisse mit 80 Tokens pro Sekunde. Dabei kostet es nur 2 Dollar pro Million Input-Tokens und 6 Dollar pro Million Output-Tokens. Die Kombination aus günstigem Token-Preis und hoher Token-Effizienz dürfte es im Alltag sehr günstig machen.
Opus 4.8 liegt im Vergleich bei 5 Dollar Input und 25 Dollar Output pro Million Tokens. Fable 5 kostet 10 Dollar Input und 50 Dollar Output pro Million Tokens. GPT-5.5 beziehungsweise GPT-5.6 liegt bei 5 Dollar Input und 30 Dollar Output. Grok 4.5 ist damit das mit Abstand günstigste Modell in dieser Leistungsklasse, sofern sich die Benchmark-Ergebnisse in der Praxis bestätigen.
| Modell | Input (pro 1M Tokens) | Output (pro 1M Tokens) |
|---|---|---|
| Grok 4.5 | 2 $ | 6 $ |
| Opus 4.8 | 5 $ | 25 $ |
| GPT-5.5 / GPT-5.6 | 5 $ | 30 $ |
| Fable 5 | 10 $ | 50 $ |
Grok 4.5 ist ab sofort in Grok Build, Cursor und über die xAI-Konsole verfügbar. Plugins gibt es auch für Word, PowerPoint und Excel. In der EU ist das Modell noch nicht verfügbar, der Start ist laut xAI für Mitte Juli geplant. xAI trainierte das Modell gemeinsam mit dem Code-Editor Cursor, den SpaceX Mitte Juni für 60 Milliarden US-Dollar in Aktien übernahm.
KI-News ohne Hype – von Menschen kuratiert
Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.
Jetzt abonnieren