Anzeige
Skip to content

xAI veröffentlicht Grok 4.5: Fast auf Frontier-Niveau, aber deutlich günstiger als die Konkurrenz

Image description
Nano Banana Pro prompted by THE DECODER

Update –

  • Artificial Analysis Resultate ergänzt

Update vom 9. Juni 2026:

Artificial Analysis stuft Grok 4.5 auf Platz vier seines Intelligence Index ein, hinter Fable 5, GPT-5.5 und Opus 4.8. Das Modell verbessere sich um 16 Punkte gegenüber Grok 4.3 und bringe SpaceXAI damit an die Leistungsgrenze, hinter OpenAI und Anthropic, aber vor allen Open-Weights-Modellen und Googles Gemini.

Der unabhängige KI-Benchmark-Dienst misst die Leistung von KI-Modellen über verschiedene Aufgaben hinweg und aggregiert den Score. Insgesamt sei Grok 4.5 sehr kosteneffizient: Eine Aufgabe im Intelligence Index koste nur 0,31 Dollar, weniger als GLM-5.2 und Kimi K2.6, und fünfmal günstiger als Claude Sonnet 5 (max), bei besserer Leistung im selben Index.

Grok 4.5 ist ein großer Sprung für xAI, wenn auch nicht an die Spitze. Dafür ist das Modell günstig. | Bild: Artificial Analysis

Bei agentenbasierten Aufgaben schneidet Grok 4.5 laut Artificial Analysis besonders stark ab: Auf dem Coding Agent Index erreiche Grok 4.5 in Grok Build, xAIs Claude-Code-Pendant, 76 Punkte, auf Augenhöhe mit GPT-5.5 in Codex und knapp hinter Fable 5 in Claude Code, aber bei einem Bruchteil der Kosten.

Anzeige
DEC_D_Incontent-1

Pro Aufgabe koste Grok 4.5 in Grok Build 2,49 Dollar, verglichen mit 5,07 Dollar für GPT-5.5 in Codex und 11,80 Dollar für Fable 5 in Claude Code. Grok 4.5 verbrauche dabei im Schnitt nur 1,9 Millionen Tokens pro Aufgabe, deutlich weniger als GPT-5.5 (6,2M) und Fable 5 (7,2M).

In seiner Leistungsklasse ist Grok 4.5 sehr günstig und effizient, sofern sich die Benchmark-Resultate bestätigen. | Bild: AA

Artificial Analysis weist auch auf eine Schwäche hin: Zwar stieg die Genauigkeit im AA-Omniscience-Index von 35 auf 52 Prozent, die Halluzinationsrate erhöhte sich aber ebenfalls von 25 auf 54 Prozent. Größere Modelle wüssten zwar mehr, seien aber auch überzeugter von falschem Wissen.

Ursprünglicher Artikel vom 9. Juni 2026:

xAI veröffentlicht Grok 4.5. Das Modell wurde laut xAI auf zehntausenden Nvidia GB300 GPUs trainiert und ist auf Programmierung, agentenbasierte Aufgaben und Wissensarbeit ausgelegt.

Anzeige
DEC_D_Incontent-2

Grok 4.5 kratzt am Frontier-Niveau: In Benchmarks wie DeepSWE, Terminal Bench und SWE Bench Pro liegt es zwar deutlich hinter Anthropics Fable 5 und teils nur knapp hinter OpenAIs GPT-5.5, übertrifft aber im agentischen Coding-Benchmark Terminal Bench etwa Anthropics Opus 4.8.

Modell DeepSWE 1.1 Terminal Bench 2.1 SWE Bench Pro
Fable max 70 % 84,3 % 80,4 %
GPT 5.5 xhigh 67 % 83,4 % 58,6 %
Opus 4.8 max 59 % 78,9 % 69,2 %
Grok 4.5 53 % 83,3 % 64,7 %
GLM 5.2 44 % 81,0 % 62,1 %

Beim Training setzte xAI nach eigenen Angaben auf umfangreiche Datenfilterung, Deduplizierung und domänenspezifische Auswahl, um die Datenqualität hochzuhalten. Das Reinforcement Learning umfasst laut xAI hunderttausende Aufgaben, vor allem aus dem Bereich Software-Engineering, mit automatisierter Bewertung. Die Trainingsinfrastruktur ist auf asynchrones Lernen ausgelegt. Agentenbasierte Durchläufe können so über viele Stunden laufen, während das Training parallel weitergeht.

Laut Elon Musk hat Grok 4.5 mit 1,5 Billionen Parametern die dreifache Größe seines Vorgängers. Das Kontextfenster wurde allerdings von 1 Million auf 500.000 Tokens reduziert.

Grok 4.5 greift nach der Preis-Leistungs-Krone

xAI betont besonders die Token-Effizienz. Grok 4.5 brauche 4,2-mal weniger Tokens als Opus 4.8 bei SWE-Bench-Pro-Aufgaben und liefere Ergebnisse mit 80 Tokens pro Sekunde. Dabei kostet es nur 2 Dollar pro Million Input-Tokens und 6 Dollar pro Million Output-Tokens. Die Kombination aus günstigem Token-Preis und hoher Token-Effizienz dürfte es im Alltag sehr günstig machen.

Opus 4.8 liegt im Vergleich bei 5 Dollar Input und 25 Dollar Output pro Million Tokens. Fable 5 kostet 10 Dollar Input und 50 Dollar Output pro Million Tokens. GPT-5.5 beziehungsweise GPT-5.6 liegt bei 5 Dollar Input und 30 Dollar Output. Grok 4.5 ist damit das mit Abstand günstigste Modell in dieser Leistungsklasse, sofern sich die Benchmark-Ergebnisse in der Praxis bestätigen.

Modell Input (pro 1M Tokens) Output (pro 1M Tokens)
Grok 4.5 2 $ 6 $
Opus 4.8 5 $ 25 $
GPT-5.5 / GPT-5.6 5 $ 30 $
Fable 5 10 $ 50 $

Grok 4.5 ist ab sofort in Grok Build, Cursor und über die xAI-Konsole verfügbar. Plugins gibt es auch für WordPowerPoint und Excel. In der EU ist das Modell noch nicht verfügbar, der Start ist laut xAI für Mitte Juli geplant. xAI trainierte das Modell gemeinsam mit dem Code-Editor Cursor, den SpaceX Mitte Juni für 60 Milliarden US-Dollar in Aktien übernahm.

KI-News ohne Hype – von Menschen kuratiert

Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.