← Alle KI-Modelle
xAI x.ai

Grok 4.6

xAIs Frontier-Modell für langlaufende Agenten - stark im Preis-Leistungs-Verhältnis der oberen Klasse.

Rang 6 von 21 Flaggschiff Proprietär Veröffentlicht 12. August 2026 grok-4.6
84,5 von 100
  • Denkleistung 8,5
  • Programmieren 8,4
  • Agentik 8,6
  • Tempo 8,0
  • Preis-Leistung 8,5

Gewichtung: Denkleistung 30 % · Programmieren 25 % · Agentik 25 % · Tempo 10 % · Preis-Leistung 10 %

Kontextfenster 500K Tokens Eingabe
Maximale Ausgabe 64K Tokens
Eingabe je 1 Mio. 2,00 $ Tokens
Ausgabe je 1 Mio. 6,00 $ Tokens
Aus dem Cache 0,50 $ je 1 Mio. Tokens

Zum Preis: Ab 200K Eingabe-Tokens wird die gesamte Anfrage mit 4 $ / 12 $ je Million abgerechnet.

Worum es geht

Grok 4.6 setzt auf lange Agentenläufe und aufwendigere interaktive Arbeit: Recherche, Codebasenanalyse, Anwendungsentwicklung, fertige Arbeitsergebnisse statt Textschnipsel.

Mit 2 $ / 6 $ je Million Tokens ist es das günstigste Modell der oberen Leistungsklasse - der Ausgabepreis liegt bei einem Fünftel dessen, was Claude Opus 5 kostet. Das Kontextfenster ist mit 500K allerdings nur halb so groß wie bei der Konkurrenz, und ab 200K Tokens verdoppeln sich die Sätze für die gesamte Anfrage.

Verfügbar über die xAI-API sowie über Cursor, OpenRouter, Vercel und Cloudflare.

Neu in dieser Version

Gegenüber dem Vorgänger Grok 4.5:

  1. Fokus auf Langläufer

    Gegenüber 4.5 spürbar verbessert bei mehrstufigen Aufgaben, die über viele Werkzeugaufrufe laufen.

  2. Visuelle und interaktive Arbeit

    Erzeugt vollständigere Artefakte - Anwendungen, formatierte Dokumente - statt nur Textantworten.

  3. Strukturierte Ausgaben und Funktionsaufrufe

    Vollständige Unterstützung, damit erst als Agenten-Backend ernsthaft einsetzbar.

Stärken und Schwächen

Dafür spricht

  • Günstigster Ausgabepreis der oberen Leistungsklasse (6 $ je Million)
  • Auf lange, eigenständige Agentenläufe ausgelegt
  • Breite Verfügbarkeit über Drittanbieter

Das schränkt ein

  • Kontextfenster mit 500K kleiner als bei der Konkurrenz
  • Preisverdopplung bereits ab 200K Tokens
  • Kein Audio-Input

Benchmarks

BenchmarkErgebnisEinordnung
Artificial Analysis Intelligence Index Plätze 7-10 dicht bei GPT-5.6 Sol, GLM-5.3 und Kimi K3

Benchmark-Werte stammen von den Anbietern oder unabhängigen Auswertungen und sind untereinander nur bedingt vergleichbar.