GLM-5.3
Das stärkste Open-Weights-Modell - auf dem Intelligence Index vor Kimi K3 und DeepSeek.
- Denkleistung 8,2
- Programmieren 8,3
- Agentik 8,2
- Tempo 7,0
- Preis-Leistung 9,5
Gewichtung: Denkleistung 30 % · Programmieren 25 % · Agentik 25 % · Tempo 10 % · Preis-Leistung 10 %
Zum Preis: Open Weights: selbst hostbar. Über API-Anbieter je nach Hoster unterschiedlich bepreist, in der Regel deutlich unter den proprietären Modellen.
Worum es geht
GLM-5.3 führt bei maximaler Denktiefe die Open-Weights-Rangliste von Artificial Analysis an (45 Punkte, Stand 8. September 2026). Damit liegt es näher an der proprietären Spitze, als es ein offen verfügbares Modell je zuvor war.
Für Unternehmen mit strengen Datenschutzanforderungen ist das der entscheidende Punkt: Das Modell lässt sich selbst betreiben, die Daten verlassen das eigene Rechenzentrum nicht. Der Preis dafür ist der Betriebsaufwand - die Hardware für ein Modell dieser Größe ist erheblich.
Daneben gibt es GLM-5.3-Flash, das mit 42 Punkten nur wenig darunter liegt und deutlich genügsamer ist.
Neu in dieser Version
Gegenüber dem Vorgänger GLM-5.2:
-
Spitze der Open-Weights-Rangliste
45 Punkte bei maximaler Denktiefe - erstmals führt ein GLM-Modell die offene Kategorie an.
-
Skalierbare Denktiefe
Der Aufwand pro Anfrage ist steuerbar; der Spitzenwert wird nur bei maximaler Einstellung erreicht.
-
Flash-Variante
GLM-5.3-Flash erreicht 42 Punkte bei deutlich geringerem Ressourcenbedarf.
Stärken und Schwächen
Dafür spricht
- Stärkstes Open-Weights-Modell auf dem Intelligence Index (45)
- Vollständig selbst betreibbar - keine Daten an Dritte
- Flash-Variante als genügsamere Alternative
Das schränkt ein
- Hoher Hardwarebedarf beim Selbstbetrieb
- Kontextfenster mit 256K kleiner als bei den proprietären Spitzenmodellen
- Kein herstellergestützter Support wie bei den großen Anbietern
Benchmarks
| Benchmark | Ergebnis | Einordnung |
|---|---|---|
| Artificial Analysis Intelligence Index | 45 | bei maximaler Denktiefe; Platz 1 der Open-Weights-Modelle |
Benchmark-Werte stammen von den Anbietern oder unabhängigen Auswertungen und sind untereinander nur bedingt vergleichbar.