Z.ai veröffentlicht GLM-5.3 als Open-Weight-Modell für agentisches Coding und Cyberabwehr

GLM-5.3 is now open-weight

Z.ai veröffentlicht GLM-5.3 als Open-Weight-Modell für agentisches Coding und Cyberabwehr

Z.ai hat GLM-5.3 als Open-Weight-Modell veröffentlicht. Das Modell ist laut Unternehmen das leistungsfähigste für agentisches Coding und Cyberabwehr und kann heruntergeladen, ausgeführt und angepasst werden. Die Gewichte sind auf Hugging Face verfügbar, ein technischer Blogbeitrag ergänzt die Details. Die Community reagiert: Unsloth AI arbeitet an GGUF-Quantisierungen für lokale Nutzung, Baseten kündigt schnelle Verfügbarkeit an. Ein Nutzer weist darauf hin, dass GLM-5.3 im Gegensatz zu früheren Versionen nicht mehr unter MIT-Lizenz steht, sondern unter einer semi-kommerziellen Lizenz ähnlich der von Kimi, MiniMax und Qwen.

GLM-5.3 ist jetzt Open-Weight – unser leistungsfähigstes Modell für agentisches Coding und Cyberabwehr ist jetzt zum Download, Ausführen und Anpassen verfügbar.
  1. revolvingthrow

    GLM 5.3 ist wahrscheinlich das Sweet-Spot-Open-Weight-Modell, wenn man über Deepseek Flash oder das neue GLM Flash hinausgehen will. Ich habe es mit Pi benutzt und hatte eine ziemlich gute Zeit, vor allem, weil es weniger empfindlich in Bezug auf Cyber und so weiter ist als die US-amerikanischen Jungs. Es liegt in den Fähigkeiten leicht hinter Kimi, aber es ist viel einfacher zu betreiben; ich würde erwarten, dass die Preise (und die Geschwindigkeit!) von Drittanbietern deutlich besser sind.

    Vorausgesetzt, man ist bereit, einen Haufen Geld für den kommenden Mac M5 Ultra mit 512 GB Unified Memory auszugeben, kann man es sogar lokal ausführen, auf 4 Bit quantisiert. Ob das auch nur annähernd vernünftig ist, nun ja, meine Frau würde mich wahrscheinlich häuten, aber vielleicht ist deine ja verständnisvoller.

  2. nkmnz

    Ich würde Sam Altman gerne fragen, ob er immer noch denkt, dass es zu gefährlich ist, GPT-3 zu veröffentlichen. Ich meine, niemand würde es nutzen, aber was ist seine Begründung, es jetzt, im Jahr 2026, nicht zu veröffentlichen?

  3. mmastrac

    Ich habe zuvor gepostet, dass DS4Flash auf zwei DGX Sparks _gut_, aber nicht _großartig_ war, aber ich muss sagen, dass GLM-5.3 ziemlich erstaunlich ist. Es hat alle zufälligen schwierigen Probleme gelöst, die ich ihm vorgeworfen habe, und es hat die Intuition, die DS4Flash zu fehlen scheint.

    Wir sind meiner Meinung nach noch lange nicht bei einem Modell der Fable-Klasse, aber die Dinge werden im nächsten Jahr interessant werden.

  4. armcat

    Was hier sehr vielversprechend ist, ist das Verhältnis von Token-Anzahl zu Genauigkeit. Ich gehe davon aus, dass ihre "Output-Tokens" Tokens bedeuten, die als Teil des Denkens und etwaiger Tool-Aufrufe generiert werden (was von Dienstanbietern aus Abrechnungssicht als "Input-Tokens" bezeichnet wird). Die chinesischen Modelle wie Qwen3.8 und GLM 5.2 überdenken in unseren Workloads (die hochkomplexe Datenanalyseaufgaben sind) unglaublich stark. Das ist ein Faktor von 3-4x gegenüber Opus- und GPT-Modellen. Selbst mit günstigeren Preisen pro 1 Million Tokens sind die Kosten am Ende höher, in einigen Fällen 2x. Das ist also sehr vielversprechend von GLM 5.3. Ich freue mich darauf, es auszuprobieren.

  5. scosman

    Ich benutze es immer häufiger. Fühlt sich an wie Opus 4.8, im besten Sinne des Wortes.

  6. redox99

    Ich finde GLM 5.3 Flash interessanter als 5.3. Die Tatsache, dass 5.3 keine Vision hat, ist irgendwie ein Ausschlusskriterium. Außerdem scheint 5.3 Flash besser darin zu sein, hübsche UIs zu erstellen.

  7. fra

    Dank an DeepInfra für den ersten Drittanbieter dafür auf OpenRouter (https://openrouter.ai/z-ai/glm-5.3?endpoint=b711bea7-3994-49...).

  8. kixiQu

    Bedeutet das, dass es bald auf Bedrock verfügbar sein wird? Ich höre großartige Dinge über dieses Modell, aber ich möchte die Datenverarbeitungspraktiken von AWS...

Mehr von diesem Tag

2026-08-28