Grok 4.6
xAIs Frontier-Modell für langlaufende Agenten - stark im Preis-Leistungs-Verhältnis der oberen Klasse.
- Denkleistung 8,5
- Programmieren 8,4
- Agentik 8,6
- Tempo 8,0
- Preis-Leistung 8,5
Gewichtung: Denkleistung 30 % · Programmieren 25 % · Agentik 25 % · Tempo 10 % · Preis-Leistung 10 %
Zum Preis: Ab 200K Eingabe-Tokens wird die gesamte Anfrage mit 4 $ / 12 $ je Million abgerechnet.
Worum es geht
Grok 4.6 setzt auf lange Agentenläufe und aufwendigere interaktive Arbeit: Recherche, Codebasenanalyse, Anwendungsentwicklung, fertige Arbeitsergebnisse statt Textschnipsel.
Mit 2 $ / 6 $ je Million Tokens ist es das günstigste Modell der oberen Leistungsklasse - der Ausgabepreis liegt bei einem Fünftel dessen, was Claude Opus 5 kostet. Das Kontextfenster ist mit 500K allerdings nur halb so groß wie bei der Konkurrenz, und ab 200K Tokens verdoppeln sich die Sätze für die gesamte Anfrage.
Verfügbar über die xAI-API sowie über Cursor, OpenRouter, Vercel und Cloudflare.
Neu in dieser Version
Gegenüber dem Vorgänger Grok 4.5:
-
Fokus auf Langläufer
Gegenüber 4.5 spürbar verbessert bei mehrstufigen Aufgaben, die über viele Werkzeugaufrufe laufen.
-
Visuelle und interaktive Arbeit
Erzeugt vollständigere Artefakte - Anwendungen, formatierte Dokumente - statt nur Textantworten.
-
Strukturierte Ausgaben und Funktionsaufrufe
Vollständige Unterstützung, damit erst als Agenten-Backend ernsthaft einsetzbar.
Stärken und Schwächen
Dafür spricht
- Günstigster Ausgabepreis der oberen Leistungsklasse (6 $ je Million)
- Auf lange, eigenständige Agentenläufe ausgelegt
- Breite Verfügbarkeit über Drittanbieter
Das schränkt ein
- Kontextfenster mit 500K kleiner als bei der Konkurrenz
- Preisverdopplung bereits ab 200K Tokens
- Kein Audio-Input
Benchmarks
| Benchmark | Ergebnis | Einordnung |
|---|---|---|
| Artificial Analysis Intelligence Index | Plätze 7-10 | dicht bei GPT-5.6 Sol, GLM-5.3 und Kimi K3 |
Benchmark-Werte stammen von den Anbietern oder unabhängigen Auswertungen und sind untereinander nur bedingt vergleichbar.